إطلاق · DeepMind ·

DeepMind تطلق Gemini Omni 1.1 Flash مع تحكم أدق للمطورين

أطلقت DeepMind نموذج Gemini Omni 1.1 Flash، تحديث يمنح المطورين تحكماً أدق في المخرجات متعددة الوسائط، ويستهدف حالات الاستخدام الإنتاجية التي تحتاج سلوكاً قابلاً للتنبؤ.

استناداً إلى تقرير DeepMind — تحليل وصياغة دليلي

أطلقت Google DeepMind نموذج Gemini Omni 1.1 Flash، تحديث تدريجي لنموذجها متعدد الوسائط يقدم أدوات تحكم للمطورين لضبط سلوك المخرجات عبر النصوص والصور والصوت والفيديو.

يركز التحديث على منح فرق الإنتاج مخرجات أكثر قابلية للتنبؤ والتحكم — وهي نقطة ألم شائعة للمؤسسات التي تنشر الذكاء الاصطناعي متعدد الوسائط على نطاق واسع. يمكن للمطورين الآن ضبط معاملات تنسيق المخرجات واتساق الأسلوب والسلوك الخاص بكل وسيط دون حاجة للضبط الدقيق.

صُمم Gemini Omni 1.1 Flash للتطبيقات التي تحتاج دمج أنواع مخرجات متعددة في سير عمل واحد، مثل وكلاء خدمة العملاء الذين يولدون ردوداً نصية مع مساعدات بصرية، أو أدوات إنشاء محتوى تنتج مخرجات منسقة من نصوص وصور.

النموذج متاح عبر واجهة Gemini API وGoogle Cloud، مع تسعير موجه لأعباء العمل الإنتاجية عالية الإنتاجية.

أبرز النقاط

  • Gemini Omni 1.1 Flash يضيف تحكماً أدق للمطورين
  • يستهدف حالات الاستخدام الإنتاجية متعددة الوسائط
  • لا حاجة للضبط الدقيق لتخصيص المخرجات
  • متاح عبر Gemini API وGoogle Cloud

ما أهمية ذلك

ينتقل الذكاء الاصطناعي متعدد الوسائط من العروض التوضيحية إلى الإنتاج، ويمكن التحكم هو العائق. Gemini Omni 1.1 Flash يلبي حاجة المؤسسات لمخرجات متعددة الوسائط قابلة للتنبؤ دون ضبط دقيق مكلف، مما قد يسرّع النشر الفعلي.

مقالات ذات صلة

  1. The Verge ·

    Roland تطلق Melody Flip أول أداة موسيقية توليدية بالذكاء الاصطناعي

  2. The Verge ·

    Anker تطلق MindBase، محور ذكاء اصطناعي محلي لأمن المنزل الذكي