جوجل تطلق Nano Banana 2.1 لتحسين توليد الصور بالذكاء الاصطناعي
أعلنت جوجل عن إطلاق الإصدار الجديد من نموذجها لتوليد الصور وتحريرها بالذكاء الاصطناعي، المعروف باسم Nano Banana 2.1. هذا الإصدار يأتي مع تحسينات ملحوظة في التصميم البصري وتعديل أجزاء محددة من الصور، مع الحفاظ على ثبات هوية العناصر والشخصيات.
الأساس التقني
يستند النموذج الجديد على تقنيات Gemini 3.6 Image، مما يطور القدرات التي قدمها الإصدار السابق Nano Banana 2، المعروف أيضًا باسم Gemini 3.1 Flash Image. هذا الإصدار السابق جمع بين جودة الصور المرتفعة وسرعة نماذج Flash.
الجوانب الرئيسية للتحسين
تركز جوجل في Nano Banana 2.1 على ثلاثة جوانب رئيسية. أولها التصميم البصري، حيث أصبح النموذج قادرًا على إنتاج تركيبات أكثر جاذبية وأصول بصرية أكثر صقلًا.
ثانيًا، يحصل المستخدمون على تحسينات في التحرير باستخدام الأقنعة Mask-based Editing، التي تتيح تحديد جزء معين من الصورة وتعديله بدقة، بدلًا من إعادة توليد المشهد كاملًا عند إجراء تغيير محدود.
ثالثًا، يتعلق التحسين بثبات العناصر والشخصيات، حيث أصبح النموذج أكثر قدرة على الحفاظ على مظهر الشخص أو العنصر وهويته عند إجراء تعديلات متتالية أو إنشاء عدة صور مرتبطة بالمشهد نفسه.
أهمية الثبات البصري
تكتسب هذه الميزة أهمية خاصة عند إنشاء صور لشخصية أو منتج في مشاهد متعددة، إذ تساعد في الحفاظ على الملامح والهوية البصرية نفسها عبر عمليات التوليد المختلفة.
توفر النموذج
بدأت جوجل طرح Nano Banana 2.1 في عدد من خدماتها، منها تطبيق Gemini، ووضع AI Mode في بحث جوجل، ومنصة Google AI Studio، وأداة Google Flow، ومنصة Stitch، وإعلانات جوجل، بالإضافة إلى منصة Gemini Enterprise.
دعم المطورين
أصبح النموذج متاحًا للمطورين بصورة عامة تحت المعرّف gemini-nano-banana-2.1، مع دعم مدخلات النصوص والصور والصوت والفيديو، وإمكانية إنشاء الصور بدقات قدرها 1K و 2K و 4K.
التعليقات 0
كن أول من يعلق على هذا الخبر