GPT Image 2: نموذج OpenAI جديد لإنشاء الصور - وهو موجود بالفعل في NeuralSpace
باختصار عن الشيء الرئيسي (BLUF)
GPT Image 2 هو نموذج OpenAI الجديد لتوليد الصور، وهو متاح بالفعل في NeuralSpace. نشرح ما الذي تغيّر مقارنة بالإصدار الأول، ولماذا تحتاج إلى 16 مرجعاً، وكيف تعمل فحوصات المحتوى المدمجة، وكيف تجرب النموذج بنفسك.
هل تتذكر كيف تبدو مولدات الصور العادية وكأنها السقف؟ ثم قامت OpenAI بطرح صورة GPT 1 بهدوء داخل ChatGPT - وركض الجميع ليصنعوا شخصيات كرتونية لأنفسهم. إذن فالتاريخ الآن يعيد نفسه. GPT Image 2 هو نموذج جديد من OpenAI يقوم بإنشاء صور أفضل بشكل ملحوظ من سابقتها. وقد أضفناها بالفعل إلىNeuralSpace.
ما هي صورة GPT 2 على أية حال؟
باختصار، هذا هو الجيل التالي من توليد الصور الأصلية من OpenAI. ليس نموذجًا مستقلاً منفصلاً للصور، ولكن قدرة GPT المضمنة على إنشاء الصور وتحريرها. في الأساس، تكتب الطلب في النص ويرسم النموذج.
كان الإصدار الأول (GPT Image 1 / 1.5) مفاجئًا بالفعل من حيث الجودة. لكنها واجهت مشكلات: غالبًا ما كان النص الموجود في الصور يظهر ملتويًا، وكانت التفاصيل عائمة، وعند محاولة تحرير شيء ما، يمكن للنموذج إعادة رسم الصورة بالكامل. GPT Image 2 عبارة عن إصلاح للأخطاء. عمل جاد.

ما الذي تغير مقارنة بالإصدار الأول
الشيء الرئيسي هو جودة عرض النص. إذا سبق لك أن حاولت إنشاء صورة مع تعليق وانتهى الأمر بفوضى غير قابلة للقراءة، انسَ الأمر. تقوم صورة GPT 2 برسم النص على الصور بشكل صحيح. العبارات اللاتينية والسيريلية وحتى الطويلة - تعمل بشكل أكثر استقرارًا.
النقطة الثانية هي القرار. في السابق كان السقف 1 كيلو. تدعم GPT Image 2 حاليًا الجيل 1K و2K و4K. لم تعد أربعة آلاف بكسل "صورة لمنشور"، ولكنها رسم توضيحي كامل يمكن طباعته.
والثالث - المراجع. يقبل النموذج ما يصل إلى 16 صورة مرجعية في وقت واحد. قم بتحميل صورة ورسم تخطيطي ولوحة مزاجية - وستأخذها صورة GPT 2 في الاعتبار عند الإنشاء. هل تريد إخفاء الوجه عن الصورة، مع وضع الشخص في سيناريو مختلف؟ هذا هو ما هي المراجع ل.
لماذا 16 مرجعا - سيناريوهات عملية
قد يبدو الأمر وكأنه رقم تسويقي، ولكنه مفيد حقًا في الواقع العملي. بعض الأمثلة:
- شخصية متسقة.قم بتحميل من 3 إلى 5 صور لنفس الشخص أو الشخصية من زوايا مختلفة. "يتذكر" النموذج المظهر ويولد مشاهد جديدة مع الحفاظ على ملامح الوجه
- المرجع الأسلوبي + المحتوى.تحدد إحدى الصور النمط (على سبيل المثال، الألوان المائية أو فن البكسل)، والأخرى - المحتوى. تتلقى المحتوى بالنمط المطلوب
- صور المنتج.تقوم بتصوير المنتج من زوايا مختلفة، وإضافة خلفية مرجعية - وتحصل على لقطة للمنتج بدون استوديو للصور
- جيل المزاج.اجمع 10 صور ملهمة ووصف ما تريد. يقوم النموذج بتجميع شيء ما عند التقاطع
لنكون صادقين، في وقت سابق، كان من الضروري تسييج خطوط الأنابيب من ControlNet وIP-Adapter ومجموعة من الامتدادات لـ Stable Diffusion. وهنا قمت بتحميل الصور وكتبت النص وضغطت على الزر.
فحص المحتوى المدمج
تأتي صورة GPT 2 مع nsfw_checker - الإشراف الذي يقوم بتصفية المحتوى الصريح في المخرجات. هذا هو قرار OpenAI، وليس قرارنا. بالنسبة لمعظم المهام - التصميم والتوضيح والتسويق والترفيه - لا توجد قيود على الإطلاق. ولكن إذا كنت تريد الحرية الكاملة، فإن NeuralSpace لديها نماذج أخرى لا تحتوي على مثل هذه المرشحات:Midjourney, Flux 2 Pro, Nano Banana.
كيفية المحاولة في NeuralSpace
لا رقص مع VPN والبطاقات الأجنبية. اذهب الىصفحة توليد الصور، حدد نموذج "GPT Image 2" من القائمة المنسدلة. تكتب طلبًا، إذا كنت ترغب في ذلك، قم بتحميل الصور المرجعية (حتى 16 قطعة)، وحدد نسبة العرض إلى الارتفاع والدقة - وقم بإنشائها.
الإعدادات ضئيلة ولكنها كافية:
- نسبة العرض إلى الارتفاع: تلقائي، 1:1، 9:16، 16:9، 4:3، 3:4
- الدقة: 1K، 2K، 4K
الدفع - بالروبل، من خلال أي طريقة مناسبةصفحة التجديد. لا توجد اشتراكات: ادفع فقط مقابل التوليد الفعلي.
GPT Image 2 مقابل النماذج الأخرى - متى تختار ما
NeuralSpace عبارة عن مجمع، لدينا أكثر من 14 نموذجًا لإنشاء الصور. ولذلك فإن السؤال ليس "GPT Image 2 أو لا شيء"، ولكن "ما هي المهمة الأفضل؟"
GPT Image 2- الخيار الأفضل عندما تحتاج إلى نص على صورة، والعمل مع المراجع، وتفاصيل عالية ودقة تصل إلى 4K. ممتاز للصور الواقعية والرسوم التوضيحية للمنتج والتركيبات المعقدة.
Midjourney- إذا كنت بحاجة إلى صورة فنية "مذهلة" مع إضاءة وأجواء مثيرة. لا يزال Midjourney أفضل في الخيال والفن المفاهيمي.
Nano Banana 2- للمهام التي تتطلب السرعة والعمل مع بحث Google. يدعم ما يصل إلى 14 مرجعًا، وينتج نتائج أسرع.
Ideogram- التخصص في الطباعة والنص الدقيق. إذا كنت بحاجة إلى نقش، فإن Ideogram وGPT Image 2 هما الرائدان الآن.
جرب نماذج مختلفة لنفس الاستعلام - قد تفاجئك النتائج. كل منهم متاح في واجهة واحدة علىصفحة الجيل.
سيرة ذاتية
GPT Image 2 ليست ثورة، ولكنها خطوة ملحوظة للغاية إلى الأمام. النص الموجود في الصور أصبح قابلاً للقراءة أخيرًا. دقة 4K مفيدة حقًا. يفتح 16 مرجعًا سيناريوهات كانت تتطلب في السابق خطوط أنابيب معقدة.
إذا لم تكن قد حاولت ذلك بعد -قم بالتسجيل في NeuralSpaceوالاختبار. وإذا كنت تستخدم نماذج أخرى بالفعل، فما عليك سوى التبديل إلى GPT Image 2 في القائمة والمقارنة. ستسمح لك الرموز الإضافية عند التسجيل بإنشاء عدة صور مجانًا.




الأسئلة المتداولة (الأسئلة الشائعة)
سؤال: كيف تحصل على أفضل نتيجة من الشبكة العصبية؟
الإجابة: استخدم المطالبات التفصيلية (الأوصاف) باللغة الإنجليزية، واضبط نمط المشهد وتفاصيله.
سؤال: هل يمكن استخدام هذه المواد لأغراض تجارية؟
الإجابة: نعم، المحتوى الذي تم إنشاؤه ملك لك بالكامل.