جوجل

جيميناي نانو بانانا 2.1 – Nano Banana 2.1 رسميًا بمزايا ثورية قوية جدا!

أعلنت جوجل رسميًا عن جيميناي نانو بانانا 2.1 (Gemini Nano Banana 2.1)، أحدث نماذجها المخصصة لتوليد الصور وتحريرها بالذكاء الاصطناعي، مع تحسينات كبيرة في جودة الصور، ودقة تنفيذ الأوامر، وثبات الأشخاص والعناصر، وكتابة النصوص داخل التصميمات.

ويأتي النموذج الجديد كتحديث مباشر لإصدار Nano Banana 2، مع الحفاظ على السرعة والكفاءة التي تتميز بها نماذج Flash، إلى جانب تحسينات واضحة تجعل النموذج أكثر دقة في إنشاء الصور وإجراء التعديلات المتتالية عليها.

ويعتمد Nano Banana 2.1 على نموذج Gemini 3.6 Flash، ويستهدف المستخدمين والمصممين وصناع المحتوى والمطورين الذين يحتاجون إلى توليد الصور أو تعديلها بسرعة مع الحفاظ على قدر أكبر من التفاصيل والثبات.

جودة صور أفضل بدقة تصل إلى 4K

يدعم Nano Banana 2.1 إنشاء الصور بدقات 1K و2K و4K، مع تحسين جودة التفاصيل والواقعية مقارنة بالإصدار السابق.

كما أصلحت جوجل بعض المشكلات التي كانت تظهر عند إنشاء الصور العريضة والبانورامية، وخاصة مع نسب الأبعاد 1:4 و4:1 و1:8 و8:1 عند استخدام دقتي 2K و4K.

تصميمات أجمل وأكثر احترافية

من أبرز التحسينات في الإصدار الجديد تطوير قدرات التصميم البصري.

وأصبح النموذج أفضل في ترتيب العناصر داخل الصورة، واختيار التكوين المناسب، وتوزيع الأشخاص والمنتجات والنصوص بطريقة أكثر توازنًا.

ويظهر ذلك بصورة خاصة عند إنشاء:

  • الإعلانات.
  • البوسترات.
  • منشورات مواقع التواصل.
  • أغلفة المحتوى.
  • التصميمات التسويقية.
  • الإنفوجرافيك.

وتشير اختبارات Google DeepMind إلى تحقيق النموذج نتائج قوية في جودة التصميم وتفضيل المستخدمين مقارنة ببعض نماذج جوجل السابقة.

تعديل أجزاء محددة من الصورة بدقة أكبر

حصل التعديل باستخدام الأقنعة Mask-Based Editing على تحسينات مهمة.

وتسمح هذه التقنية للمستخدم بتحديد جزء معين من الصورة وتعديله، مثل الملابس أو الخلفية أو أحد العناصر، بدلًا من إعادة إنشاء الصورة بالكامل.

ويعني ذلك إمكانية تنفيذ تعديلات دقيقة مع تقليل احتمالية تغيير أجزاء أخرى لم يطلب المستخدم تعديلها.

وتعد هذه الميزة مهمة جدًا عند الرغبة، على سبيل المثال، في تغيير خلفية صورة مع الحفاظ على الشخص، أو تعديل منتج داخل إعلان دون التأثير على بقية التصميم.

ثبات أفضل للوجوه والشخصيات

ركزت جوجل بشكل كبير على تحسين ثبات الشخصيات Subject Consistency.

وأصبح Nano Banana 2.1 أفضل في الحفاظ على مظهر الشخص نفسه عند إنشاء عدة صور أو إجراء تعديلات متتالية.

ويشمل ذلك الحفاظ بصورة أفضل على:

  • ملامح الوجه.
  • شكل الشخصية.
  • الشعر.
  • الملابس.
  • السمات الأساسية.
  • شكل المنتجات والعناصر.

وتفيد هذه التحسينات المستخدمين الذين يرغبون في إنشاء مجموعة من الصور للشخص نفسه مع تغيير المكان أو الملابس أو الوضعية دون فقدان هويته الأساسية.

وأظهرت اختبارات Google DeepMind تحسن النموذج بصورة خاصة في ثبات الشخصية الواحدة وعدة شخصيات داخل الصور.

دمج حتى 14 صورة مرجعية

يدعم Nano Banana 2.1 استخدام ما يصل إلى 14 صورة مرجعية في المهمة الواحدة.

ويمكن للنموذج الحفاظ على اتساق ما يصل إلى 4 شخصيات، إلى جانب الحفاظ على تفاصيل ما يصل إلى 10 عناصر أو منتجات.

وتفتح هذه الميزة الباب أمام إنشاء تصميمات أكثر تعقيدًا من خلال جمع شخصيات ومنتجات وعناصر من عدة صور داخل مشهد واحد.

تحسين الحفاظ على المنتجات والعناصر

لم تقتصر تحسينات الثبات على الأشخاص فقط، بل أصبح النموذج أفضل أيضًا في الحفاظ على شكل المنتجات أثناء نقلها بين مشاهد مختلفة.

ويمكن أن تكون هذه الميزة مفيدة في الإعلانات التجارية، حيث يمكن استخدام صورة المنتج نفسه وإنشاء عدة خلفيات أو سيناريوهات تسويقية مع تقليل التغييرات غير المرغوب فيها في شكله.

وأظهرت اختبارات جوجل تحسنًا في Product Consistency والتعديل باستخدام عدة صور مرجعية.

تنفيذ أدق للأوامر

حسّنت جوجل قدرة Nano Banana 2.1 على فهم التعليمات وتنفيذها بصورة أكثر دقة.

ويصبح ذلك مهمًا عندما يحتوي الأمر على عدد كبير من التفاصيل، مثل:

تغيير الخلفية مع الحفاظ على الوجه، وتعديل الملابس، والإبقاء على وضعية الجسم، وعدم تغيير عنصر معين داخل التصميم.

كما تحسنت قدرة النموذج على التعامل مع التعديلات المتتالية عبر المحادثة دون فقدان السياق السابق بسهولة.

كتابة النصوص داخل الصور أصبحت أفضل

حصلت قدرة النموذج على كتابة النصوص داخل الصور على تحسينات جديدة.

وأصبح Nano Banana 2.1 أفضل في إنشاء:

  • العناوين.
  • البوسترات.
  • الإعلانات.
  • الإنفوجرافيك.
  • المخططات.
  • المواد التعليمية.
  • التصميمات التي تجمع الصور والنصوص.

كما حسّنت جوجل دقة تخطيط النصوص والعناصر داخل الإنفوجرافيك.

ومع ذلك، تشير جوجل إلى أن النصوص الصغيرة جدًا والفقرات الطويلة لا تزال من الجوانب التي يمكن أن تظهر فيها أخطاء.

تحسين كبير في الإنفوجرافيك

يعد إنشاء الإنفوجرافيك من أبرز المجالات التي تحسنت في الإصدار الجديد.

وحقق Nano Banana 2.1 نتائج أفضل في اختبارات جوجل المتعلقة بتصميم الإنفوجرافيك ودقة المعلومات الموجودة داخله، خصوصًا عند استخدام قدرات التفكير.

وهذا يجعله أكثر فائدة لإنشاء الرسومات التعليمية والمخططات والتصميمات التي تحتاج إلى الجمع بين المعلومات والعناصر البصرية بطريقة منظمة.

ثلاثة مستويات للتفكير

أضافت جوجل إمكانية التحكم في مقدار التفكير الذي يستخدمه النموذج قبل إنتاج النتيجة.

ويتوفر ذلك عبر ثلاثة مستويات:

  • Minimal
  • Medium
  • High

ويأتي مستوى Medium كإعداد افتراضي.

ويمكن استخدام مستوى High في المهام الأكثر تعقيدًا التي تتطلب فهم العديد من العناصر والتعليمات والعلاقات بينها.

البحث عبر Google للحصول على نتائج أكثر دقة

يدعم Nano Banana 2.1 الاستفادة من Google Web Search وGoogle Image Search.

ويمكن للنموذج استخدام البحث للحصول على معلومات أو مراجع حديثة عند الحاجة، بدلًا من الاعتماد فقط على معلوماته الداخلية.

وقد تكون هذه الخاصية مفيدة عند إنشاء صور مرتبطة بأماكن أو معلومات أو موضوعات من العالم الحقيقي.

يدعم النصوص والصور والفيديو وملفات PDF

يدعم النموذج عبر Gemini API إدخال عدة أنواع من المحتوى، تشمل:

  • النصوص.
  • الصور.
  • الفيديو.
  • ملفات PDF.

ويمكنه إنتاج الصور والنصوص في النتائج.

وتحدد وثائق Gemini API حد الإدخال عند 131,072 رمزًا وحد الإخراج عند 32,768 رمزًا في هذه الواجهة.

أين يتوفر Nano Banana 2.1؟

توسع جوجل إتاحة النموذج عبر عدد كبير من خدماتها، ومن بينها:

  • تطبيق Gemini.
  • Google AI Studio.
  • Gemini API.
  • وضع الذكاء الاصطناعي في بحث Google.
  • Google Ads.
  • Google Flow.
  • Google Stitch.

وتشير Google DeepMind إلى إتاحة النموذج أيضًا عبر عدد من منصات جوجل الموجهة للشركات والمطورين.

أما بالنسبة للمطورين، فأصبح النموذج متاحًا بصورة مستقرة تحت الاسم:

gemini-nano-banana-2.1

كما تضعه جوجل باعتباره البديل الموصى به لنموذج gemini-3.1-flash-image في وثائقها الخاصة بإصدارات Gemini API.

ما أبرز القيود الحالية؟

رغم التحسينات الكبيرة، أوضحت جوجل أن النموذج لا يزال يواجه بعض القيود.

ومن بينها:

  • أخطاء محتملة عند كتابة النصوص الصغيرة جدًا.
  • صعوبة التعامل مع الفقرات الطويلة داخل الصور.
  • عدم ثبات الأشخاص بصورة مثالية في جميع الحالات.
  • عدم تنفيذ جميع التعليمات بدقة في بعض الصور.
  • حدوث أخطاء أحيانًا في تحديد الاتجاهات مثل اليمين واليسار.
  • بعض القيود في فهم العلاقات ثلاثية الأبعاد.
  • احتمالية ظهور معلومات غير دقيقة في بعض النتائج.
  • حدوث بطء أو انتهاء مهلة التنفيذ في حالات محدودة.

وتؤكد جوجل أنها تواصل العمل على تحسين هذه الجوانب في الإصدارات المقبلة.

تحديث مهم لصناع المحتوى والمصممين

يجمع جيميني نانو بانانا 2.1 بين سرعة نماذج Flash وتحسينات واضحة في جودة الصور وتعديلها، لكن أبرز ما يميزه هو القدرة الأفضل على الحفاظ على الأشخاص والمنتجات أثناء إجراء تعديلات متعددة.

ومع دعم صور 4K، ودمج ما يصل إلى 14 صورة مرجعية، وتحسين الكتابة والإنفوجرافيك، والتعديل الدقيق لأجزاء الصورة، والاستفادة من بحث Google، يصبح الإصدار الجديد واحدًا من أهم تحديثات جوجل الأخيرة في مجال إنشاء الصور وتحريرها بالذكاء الاصطناعي.

المصدر

زر الذهاب إلى الأعلى
Tes