جوجل تطلق نموذج توليد الصور Nano Banana 2.1 بتحسينات كبيرة في إجراء التعديلات وثبات العناصر
أعلنت جوجل إطلاق Nano Banana 2.1، وهو الإصدار المطوّر من نموذجها لتوليد الصور وتحريرها بالذكاء الاصطناعي، مع تحسينات ملحوظة في التصميم البصري، وتعديل أجزاء محددة من الصور، والحفاظ على ثبات هوية العناصر والشخصيات.
يستند النموذج الجديد إلى تقنيات Gemini 3.6 Image، ويعزز القدرات التي قدمها الإصدار السابق Nano Banana 2، المعروف باسم Gemini 3.1 Flash Image، الذي جمع بين جودة الصوار المرتفعة وسرعة نماذج Flash.
ركزت جوجل في Nano Banana 2.1 على ثلاثة جوانب رئيسية. أولاً، التصميم البصري، حيث أصبح النموذج قادرًا على إنتاج تركيبات أكثر جاذبية وأصول بصرية أكثر صقلًا. ثانيًا، التحرير باستخدام الأقنعة Mask-based Editing، التي تتيح تحديد جزء معين من الصورة وتعديله بدقة، بدلًا من إعادة توليد المشهد كاملًا عند إجراء تغيير محدود. ثالثًا، ثبات العناصر والشخصيات، حيث أصبح النموذج أكثر قدرة على الحفاظ على مظهر الشخص أو العنصر وهويته عند إجراء تعديلات متتالية أو إنشاء عدة صور مرتبطة بالمشهد نفسه.
تكتسب هذه الميزة أهمية خاصة عند إنشاء صور لشخصية أو منتج في مشاهد متعددة، إذ تساعد في الحفاظ على الملامح والهوية البصرية نفسها عبر عمليات التوليد المختلفة.
بدأت جوجل طرح Nano Banana 2.1 في عدد من خدماتها، منها تطبيق Gemini، ووضع AI Mode في بحث جوجل، ومنصة Google AI Studio، وأداة Google Flow، ومنصة Stitch، وإعلانات جوجل، بالإضافة إلى منصة Gemini Enterprise.
أصبح النموذج متاحًا للمطورين بصورة عامة تحت المعرّف gemini-nano-banana-2.1، مع دعم مدخلات النصوص والصور والصوت والفيديو، وإمكانية إنشاء الصور بدقات قدرها 1K و 2K و 4K.



إرسال التعليق