ما هو GPT Image 2؟
GPT Image 2 هو نموذج توليد صور متطور من OpenAI، مدمج بشكل أصيل في ChatGPT باسم ChatGPT Images 2.0. وعلى خلاف الأدوات المستقلة السابقة مثل DALL·E 3، يجمع بين قدرات فهم اللغة في GPT-series والتوليف البصري المتقدم. يُنتج النموذج صورًا دقيقة وقابلة للاستخدام، مُحسّنة للمهام المهنية أكثر من التجريب الفني البحت.
القدرات الرئيسية
- عرض نصي شبه مثالي: يحقق دقة على مستوى الحرف تبلغ ~99%، ويعرض نصًا مقروءًا ودقيقًا سياقيًا بالإنجليزية وبالأنظمة الكتابية غير اللاتينية. يتعامل مع الفقرات الطويلة والقوائم والملصقات والرسوم المعلوماتية دون الطباعة المشوشة الشائعة في النماذج السابقة.
- تركيب معقد ووفاء بالتخطيط: ينتج مخرجات مُنظَّمة مثل نماذج أولية لواجهة المستخدم UI، ومخططات الطوابق، وتصوّرات البيانات، والشرائح، والخرائط، وصفحات المانغا، وشبكات متعددة العناصر (على سبيل المثال، مصفوفات أيقونات 10x10 أو ملصقات المنتجات).
- دعم متعدد اللغات والثقافات: يولّد نصوصًا دقيقة ومرئيات ذات صلة ثقافية بلغات متعددة.
- تحرير الصور ومعالجة المراجع: يطبّق تعديلات على الصور المرفوعة مع الحفاظ على التفاصيل والوجوه والأنماط بدرجة عالية من الاتساق.
- إنشاء على دفعات: ينشئ ما يصل إلى 8 صور متسقة انطلاقًا من مطالبة واحدة، مع الحفاظ على اتساق الشخصيات والكائنات عبر المجموعة.
- واقعية فوتوغرافية وقابلية الاستخدام: تبدو المخرجات أكثر طبيعية وجاهزة للإنتاج، مع شوائب أقل، وأيقونات أفضل، وتكوين احترافي.