أطلقت Google DeepMind نموذج Gemini Omni 1.1 Flash، تحديث تدريجي لنموذجها متعدد الوسائط يقدم أدوات تحكم للمطورين لضبط سلوك المخرجات عبر النصوص والصور والصوت والفيديو.
يركز التحديث على منح فرق الإنتاج مخرجات أكثر قابلية للتنبؤ والتحكم — وهي نقطة ألم شائعة للمؤسسات التي تنشر الذكاء الاصطناعي متعدد الوسائط على نطاق واسع. يمكن للمطورين الآن ضبط معاملات تنسيق المخرجات واتساق الأسلوب والسلوك الخاص بكل وسيط دون حاجة للضبط الدقيق.
صُمم Gemini Omni 1.1 Flash للتطبيقات التي تحتاج دمج أنواع مخرجات متعددة في سير عمل واحد، مثل وكلاء خدمة العملاء الذين يولدون ردوداً نصية مع مساعدات بصرية، أو أدوات إنشاء محتوى تنتج مخرجات منسقة من نصوص وصور.
النموذج متاح عبر واجهة Gemini API وGoogle Cloud، مع تسعير موجه لأعباء العمل الإنتاجية عالية الإنتاجية.