جوجل تطلق Gemini 3.8 Live وGemini 3.8 Live Extended Thinking
جوجل تطلق Gemini 3.8 Live وGemini 3.8 Live Extended Thinking

جوجل تطلق Gemini 3.8 Live وGemini 3.8 Live Extended Thinking لمحادثات صوتية أكثر ذكاءً

جوجل تطلق Gemini 3.8 Live وExtended Thinking لمحادثات صوتية أسرع وأذكى، متاحة الآن للمطورين والمستخدمين.

كشفت جوجل ديب مايند عن نموذجين جديدين للتفاعل الصوتي المباشر: Gemini 3.8 Live وGemini 3.8 Live Extended Thinking، وتصفهما الشركة بأنهما الأكثر تقدمًا حتى الآن في هذا المسار، مع تحسينات ملموسة في الاستدلال ومعالجة المهام بالتوازي.

ما الجديد فعليًا

يعالج Gemini 3.8 Live المدخلات البصرية في الوقت شبه الفعلي، ويكتشف 97 لغة تلقائيًا وينتقل بينها أثناء الحديث دون أن يطلب منك ذلك. كما ينفّذ استدعاء الأدوات والاتصالات الخارجية في الخلفية دون مقاطعة تدفق المحادثة — فلا تشعر بالتوقف بينما يبحث عن معلومة أو يشغّل أداة.

أما نسخة Extended Thinking فتضيف طبقة استدلال أعمق للمهام المعقدة، بحيث يحادثك النموذج ويفكّر في الوقت نفسه، ويستخدم عبارات لفظية طبيعية مثل "دعني أتحقق من ذلك" بدل الصمت المربك أثناء المعالجة.

على مستوى الأداء، تعلن جوجل تصدّر النموذج لمؤشر Speech to Speech Quality Index برصيد 82.6، وكفاءة تنفيذ مهام موكلة بنسبة 68.6% على اختبار τ-Voice، ودرجة 97.7% في Big Bench Audio.

أين تجده

النموذجان متاحان الآن عبر Gemini API وGoogle AI Studio للمطورين، وفي معاينة خاصة داخل Gemini Enterprise للمؤسسات، بينما يصلان لعموم المستخدمين عبر Search Live وGemini Live مباشرة.

المصدر: مدونة Google DeepMind — blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking

No comments yet