Kubernetes Engine के साथ Gemma चलाना

Google Cloud Kubernetes Engine, Gemma मॉडल को बेहतर परफ़ॉर्मेंस और कम समय में प्रोसेस करने के लिए, डिप्लॉयमेंट के कई विकल्प उपलब्ध कराता है. इसके लिए, पसंदीदा डेवलपमेंट फ़्रेमवर्क का इस्तेमाल किया जा सकता है. Hugging Face, vLLM, जीपीयू पर TensorRT-LLM, और JetStream के साथ TPU पर एक्ज़ीक्यूशन के लिए, डिप्लॉयमेंट से जुड़ी ये गाइड देखें. इसके अलावा, ऐप्लिकेशन और ट्यूनिंग से जुड़ी गाइड भी देखें:

डिप्लॉय और सर्व करना

डेटा का विश्लेषण करें

फ़ाइन-ट्यून