דילוג לתוכן הראשי
תחומים טכנולוגיים
close
AI ו-ML
פיתוח אפליקציות
אירוח אפליקציות
Compute
ניתוח נתונים וצינורות עיבוד נתונים
מסדי נתונים
סביבות מבוזרות, היברידיות ומרובות עננים (multi-cloud)
פתרונות לתעשייה
העברה
קשרים מקצועיים
ניראות ומעקב
אבטחה
Storage
כלים למכפלה וקטורית (cross product)
close
ניהול גישה ומשאבים
ניהול עלויות ושימוש
תשתית כקוד
SDK, שפות, frameworks וכלים
/
מסוף
English
Deutsch
Español
Español – América Latina
Français
Indonesia
Italiano
Português
Português – Brasil
עברית
中文 – 简体
中文 – 繁體
日本語
한국어
היכנס
Google Kubernetes Engine (GKE)
GKE AI/ML
התחלת תקופת ניסיון בחינם
סקירה כללית
מדריכים
תחומים טכנולוגיים
עוד
סקירה כללית
מדריכים
כלים למכפלה וקטורית (cross product)
עוד
מסוף
Discover
מבוא לעומסי עבודה של AI/ML ב-GKE
עיון במסמכי התיעוד של GKE
סקירה כללית
המסמכים העיקריים בנושא GKE
מאמרי עזרה בנושא AI/ML ב-GKE
מסמכי התיעוד של GKE Networking
מסמכי תיעוד בנושא אבטחה ב-GKE
מסמכי ניהול המכשירים בארגון באמצעות GKE
בחירת האופן שבו יתקבלו וינוצלו מאיצים ב-GKE
תאימות של AI/ML ב-GKE
מתחילים
למה כדאי להשתמש ב-GKE להסקת מסקנות מ-AI/ML
הסבר פשוט על מושגי התאמה אוטומטית לעומס (autoscaling) לעומסי עבודה של AI/ML ב-GKE
מדריך למתחילים: הפעלת מודל ה-AI הראשון ב-GKE
הצגת מודלים של AI להסקת מסקנות
מידע על הסקת מסקנות ממודלים של AI/ML ב-GKE
ניתוח הביצועים והעלויות של מודלים שמוצגים באמצעות GKE Inference Quickstart
חשיפת אפליקציות AI באמצעות GKE Inference Gateway
שיטות מומלצות להסקת מסקנות
סקירה כללית
בחירה של אסטרטגיית איזון עומסים להסקת מסקנות
שינוי אוטומטי של קנה מידה של עומסי עבודה של הסקת מסקנות ב-GPU
שינוי אוטומטי של קנה מידה של עומסי עבודה של הסקת מסקנות של מודלים גדולים של שפה (LLM) ב-TPU
אופטימיזציה של עומסי עבודה של הסקת מסקנות של LLM במעבדי GPU
אופטימיזציה של עומסי עבודה של הסקת מסקנות באצווה
דוגמאות להסקת מסקנות