أطلقت شركة Google أحدث أدوات توليد الصور عبر تقنيات الذكاء الاصطناعي، مما يجعل **نماذج Gemini API** الجديدة متاحة بشكل عام للمطورين في جميع أنحاء العالم. تحديداً، يشمل هذا الإطلاق نموذجي Nano Banana Pro وNano Banana 2 لدعم سير العمل الجاهز للإنتاج. وتوفر هذه الأدوات خيارات مستقرة للمبدعين الذين يحتاجون إلى تحكم دقيق أو إنتاج كميات كبيرة.
مواصفات نماذج Gemini API الجديدة
تستهدف الخيارات الجديدة احتياجات مختلفة في تطوير التطبيقات والبرمجيات. على سبيل المثال، يركز نموذج Nano Banana 2، المعروف أيضاً باسم Gemini 3.1 Flash Image، على السرعة وفعالية التكلفة. وبناءً على ذلك، يمكن للمطورين استخدام هذا الخيار لمهام العمل عالية الحجم التي تتطلب معالجة سريعة. تم تصميم هذا النموذج للتعامل مع المهام واسعة النطاق دون تكبد تكاليف تشغيلية عالية.
وفي الوقت نفسه، يخدم نموذج Nano Banana Pro، أو Gemini 3 Pro Image، سير العمل الإبداعي المعقد. يوفر هذا النموذج دقة احترافية لمهام التصميم التفصيلية. ونتيجة لذلك، يمكن للمستخدمين تحقيق دقة أعلى في مخرجاتهم البصرية. وهو مناسب بشكل خاص للمشاريع التي تتطلب تفاصيل دقيقة وجودة رندر عالية.
القدرات والميزات الأساسية
تتشارك كلا نماذج Gemini API في العديد من نقاط القوة التقنية الأساسية. ومن أبرز هذه الميزات الحفاظ على اتساق الموضوع عبر خمس شخصيات مختلفة في الصورة الواحدة. تتيح هذه الميزة للمطورين إنشاء محتوى بصري متسلسل مع الحفاظ على استقرار هويات الشخصيات. بالإضافة إلى ذلك، تدعم النماذج رندر النصوص بدقة وتوطينها، مما يساعد في توليد نصوص مقروءة داخل الصور بلغات مختلفة.
علاوة على ذلك، يمكن للمطورين الاستفادة من ترقية الدقة إلى 4K ونسب العرض إلى الارتفاع المخصصة لتناسب تنسيقات العرض المتنوعة. يقبل النظام ما يصل إلى 14 صورة مرجعية كمدخلات لتوجيه أفضل أثناء عملية التوليد. والأهم من ذلك، يضمن الربط مع بحث Google الدقة الواقعية في الصور التي يتم إنشاؤها، مما يقلل من الأخطاء في التمثيلات البصرية. وتساعد هذه القدرة في التحقق من التفاصيل الواقعية قبل رندر المخرجات النهائية.
تكاملات المطورين الحالية
قامت العديد من منصات الأجهزة الذكية بالفعل بدمج نماذج Gemini API هذه في أنظمتها. على سبيل المثال، يستخدم المطورون هذه التقنية لتوليد شبكات ثلاثية الأبعاد باستخدام أداة SplineTool. وفي الوقت نفسه، يستخدم مطورون آخرون منصة Krea_ai لتمكين ميزات التحرير في الوقت الفعلي. وتوضح هذه التكاملات كيفية عمل النماذج في بيئات التطوير النشطة.
ومن خلال استخدام هذه المنصات، يمكن للمبدعين اختبار حدود قدرات توليد الصور الجديدة. يظهر الجمع بين الأدوات ثلاثية الأبعاد والتحرير في الوقت الفعلي مرونة واجهة برمجة التطبيقات. وبالتالي، من المتوقع أن تعتمد المزيد من التطبيقات هذه النماذج في الأشهر المقبلة.
جاهزية الإنتاج والوصول
أصبحت النماذج الآن مستقرة وجاهزة لبيئات الإنتاج. ويمكن للمطورين الوصول إليها مباشرة من خلال واجهة برمجة التطبيقات الرسمية. يتيح هذا الإطلاق للشركات توسيع نطاق مهام توليد الصور بأداء يمكن التنبؤ به. وفي الختام، يوفر توفر هذه الأدوات للمطورين خيارات موثوقة لبناء تطبيقات بصرية. ويمكن للأطراف المهتمة استكشاف الوثائق الرسمية لبدء التكامل.
المصدر: X (@googledevs)




