Uruchamianie Gemma w Kubernetes Engine

Google Cloud Kubernetes Engine oferuje szeroki zakres opcji wdrażania modeli Gemma z wysoką wydajnością i niskim opóźnieniem przy użyciu preferowanych platform programistycznych. Zapoznaj się z tymi przewodnikami wdrażania Hugging Face, vLLM, TensorRT-LLM na GPU i TPU z JetStream oraz przewodnikami dotyczącymi aplikacji i dostrajania:

Wdrażanie i udostępnianie

Analizowanie danych

Dostrajanie