جيميناي 3.0 لايف Gemini 3.8 Live رسميًا بمزايا وخصائص ثورية قوية للغاية!
جوجل تطلق Gemini 3.8 Live الجديد .. ذكاء اصطناعي يفكر ويتحدث معك في نفس الوقت

أعلنت جوجل رسميًا عن نموذجَي Gemini 3.8 Live وGemini 3.8 Live Extended Thinking، في خطوة جديدة تهدف إلى تطوير المساعدات الصوتية وجعلها أكثر قدرة على فهم المستخدم والتفكير وتنفيذ المهام المعقدة أثناء استمرار المحادثة.
وتقدم النماذج الجديدة تحسينات في الذكاء والاستدلال المتوازي Parallel Reasoning، مع إمكانية التعامل مع الصوت والصورة، وتنفيذ الأدوات واستدعاءات API في الخلفية دون الحاجة إلى إيقاف الحوار مع المستخدم.
ما الفرق بين Gemini 3.8 Live وExtended Thinking؟
صممت جوجل Gemini 3.8 Live ليكون مناسبًا للعمل على نطاق واسع مع التركيز على سرعة المحادثة وكفاءة التكلفة، إلى جانب تقديم حوار صوتي أكثر سلاسة وفهم السياق المرئي.
أما Gemini 3.8 Live Extended Thinking فهو النموذج الأقوى، وصُمم للمهام عالية التعقيد التي تحتاج إلى التفكير والاستدلال متعدد الخطوات.
والميزة اللافتة هنا أن النموذج يستطيع التفكير والتحدث في الوقت نفسه، بدلًا من الانتظار حتى تنتهي عملية الاستدلال بالكامل قبل بدء الرد.
Gemini يمكنه تنفيذ مهمة والاستمرار في الحديث معك
من أهم التحسينات في Gemini 3.8 Live قدرته على تنفيذ الأدوات واستدعاءات API في الخلفية أثناء استمرار المحادثة.
فعند إعطاء Gemini مهمة تحتاج إلى تنفيذ عدة خطوات، يمكنه تأكيد استلام الطلب والاستمرار في الحديث مع المستخدم بالتزامن مع تنفيذ العمليات المطلوبة.
أما إصدار Extended Thinking فيمكنه استخدام عبارات أولية مثل «دعني أتحقق من ذلك»، ثم تقديم تحديثات صوتية حول تقدمه أثناء تنفيذ المهمة متعددة الخطوات.
وتهدف هذه الآلية إلى جعل التفاعل مع Gemini أقرب إلى التعامل مع مساعد حقيقي يستطيع التفكير والعمل والتحدث في الوقت نفسه.
فهم الصور والفيديو في الوقت الفعلي تقريبًا
يدعم Gemini 3.8 Live معالجة المدخلات المرئية في الوقت الفعلي تقريبًا، ما يسمح له باستخدام المعلومات التي يراها كجزء من سياق المحادثة.
ويفتح ذلك الباب أمام سيناريوهات يمكن فيها للمستخدم توجيه الكاميرا نحو شيء ما ثم التحدث مع Gemini عنه بشكل مباشر.
كما يستطيع النموذج اكتشاف الانتقال تلقائيًا بين 97 لغة مدعومة أثناء المحادثة، ما يجعل التبديل بين اللغات أكثر سلاسة دون الحاجة إلى تحديد اللغة يدويًا في كل مرة.
نتائج قوية في اختبارات المحادثات الصوتية
كشفت جوجل أيضًا عن مجموعة من نتائج الاختبارات الخاصة بنموذج Gemini 3.8 Live Extended Thinking.
وبحسب الأرقام التي استشهدت بها الشركة، سجل النموذج 82.6 نقطة في مؤشر Artificial Analysis Speech to Speech Quality Index، ليحتل المركز الأول إجمالًا في هذا الاختبار.
كما سجل:
- 68.6% في اختبار τ-Voice لتنفيذ المهام المعتمدة على الوكلاء الذكيين.
- 35.1% في اختبار Sierra τ-Voice-banking الذي يحاكي مهام مصرفية ومالية معقدة.
- 97.7% في اختبار Big Bench Audio.
وفي الوقت نفسه، حصل Gemini 3.8 Live على المركز الثاني في Speech Agent Arena.
وتشير جوجل أيضًا إلى أن النموذجين حققا توازنًا قويًا بين الدقة وجودة المحادثة عند التعامل مع سير العمل المعقد في اختبار ServiceNow EVA-Bench.
وتظل هذه النتائج مرتبطة بالاختبارات والمنهجيات المحددة المستخدمة، ولا تعني بالضرورة تفوق النموذج في جميع سيناريوهات الاستخدام الواقعية.
Gemini يدخل Gmail وDocs وKeep بالصوت
لا تقتصر النماذج الجديدة على تطبيق Gemini فقط، إذ توسع جوجل قدرات المحادثة الصوتية إلى خدماتها الأخرى.
سيكون Gemini 3.8 Live Extended Thinking متاحًا داخل Gemini Live، بينما سيصل Gemini 3.8 Live إلى Search Live.
كما ستتوفر قدرات Extended Thinking لمشتركي Google AI Pro وUltra داخل Google Workspace في Docs، إلى جانب توفرها لمشتركي Google AI داخل Gmail وKeep.
وهذا يعني أن المستخدم سيتمكن من الاعتماد بصورة أكبر على صوته لتنفيذ مهام داخل خدمات جوجل بدلًا من الكتابة والتنقل يدويًا بين الأدوات.
دعم واسع للمطورين
توفر جوجل النموذجين أيضًا للمطورين من خلال Gemini API وGoogle AI Studio.
وتدعم منظومة Gemini Live API عددًا من منصات تطوير تطبيقات الصوت والوسائط في الوقت الفعلي، من بينها Agora وLangChain وLiveKit وPipecat وVercel وFishjam وVision Agents.
ويمكن لهذه الأدوات التعامل مع جزء كبير من البنية التحتية المعقدة الخاصة ببث الصوت والوسائط في الوقت الفعلي، ما يسمح للمطورين بالتركيز بصورة أكبر على بناء تجربة المستخدم.
كما تعمل جوجل مع شركات ومنصات مثل Salesforce وGenspark وLumeris على استخدام قدرات النماذج الجديدة.
SynthID داخل جميع الأصوات المولدة
أكدت جوجل أن جميع المقاطع الصوتية التي يتم إنشاؤها بواسطة منتجات الذكاء الاصطناعي التابعة لها ستحمل علامة SynthID.
وتُدمج هذه العلامة الرقمية داخل الصوت بطريقة غير محسوسة للمستخدم، مع إمكانية اكتشافها لاحقًا للمساعدة في التعرف على المحتوى الذي تم إنشاؤه بواسطة الذكاء الاصطناعي.
وتهدف جوجل من ذلك إلى الحد من إساءة استخدام المحتوى الصوتي المولد والمساعدة في مواجهة التضليل.
أين تتوفر النماذج الجديدة؟
يتوفر Gemini 3.8 Live للمطورين عبر Gemini API وGoogle AI Studio، وللمستخدمين عبر Search Live، بينما يحصل عملاء المؤسسات عليه في معاينة خاصة داخل Gemini Enterprise.
أما Gemini 3.8 Live Extended Thinking فيتوفر للمطورين أيضًا عبر Gemini API وGoogle AI Studio، وللمستخدمين من خلال Gemini Live، إلى جانب دمجه في بعض تطبيقات Workspace وفق نوع اشتراك Google AI.
وتخطط جوجل كذلك لتوسيع توفر النماذج الجديدة لعملاء الشركات وخدمات تجربة العملاء خلال الفترة المقبلة.





