تشغيل Gemma باستخدام Kubernetes Engine

توفّر خدمة Google Cloud Kubernetes Engine مجموعة كبيرة من خيارات النشر لتشغيل نماذج Gemma بأداء عالٍ ووقت استجابة سريع باستخدام أُطر التطوير المفضّلة. يمكنك الاطّلاع على أدلة النشر التالية بشأن Hugging Face وvLLM وTensorRT-LLM على وحدات معالجة الرسومات وتنفيذ TPU باستخدام JetStream، بالإضافة إلى أدلة التطبيقات والضبط:

التفعيل والعرض

تحليل البيانات

ضبط دقيق