← सभी लेख

ChatGPT Images 2.5 (Sunburst और Flare): नया मॉडल क्या कर सकता है और इसे अपने ब्राउज़र में कैसे आज़माएं

GPT-Image-2.5 घोषणा: Sunburst और Flare मॉडल, OpenAI के आधिकारिक डेमो से फ़्रेम

OpenAI ने छवि निर्माण की एक नई पीढ़ी जारी की है -GPT-Image-2.5. परिवार में दो मॉडल शामिल हैं:Sunburst, अधिक स्पष्ट विवरण, अधिक प्राकृतिक प्रकाश व्यवस्था और संपादनों पर अधिक नियंत्रण पर ध्यान केंद्रित किया गया हैFlare, गति के लिए बनाया गया। दोनों पारदर्शी पृष्ठभूमि का समर्थन करते हैं और API के माध्यम से उपलब्ध हैं। हमने अपनी साइट पर दोनों पारिवारिक संस्करण जोड़े हैंChatGPT Images 2.5- आप सीधे ब्राउज़र में छवियां उत्पन्न और संपादित कर सकते हैं, किसी API कुंजी या सदस्यता की आवश्यकता नहीं है:NeuralSpace पर मॉडल पेज(लिंक पहले से चयनित मॉडल के साथ जनरेटर खोलता है)।

OpenAI के आधिकारिक डेमो से फ़्रेम: GPT-Image-2.5 घोषणा - Sunburst और Flare मॉडल

पिछली पीढ़ी की तुलना में क्या नया है

OpenAI के अनुसार, Sunburst ड्रा होता हैस्पष्ट रूप से अधिक तीक्ष्ण विवरणसाथअधिक प्राकृतिक प्रकाश, और - सबसे महत्वपूर्ण - संपादन करते समय आपको अधिक नियंत्रण देता है: एक ही फ्रेम पर संपादन की लंबी श्रृंखला अब अलग नहीं होती है। Flare सबसे तेज़ भाई-बहन है: यह 50% से अधिक तेज़ी से उच्च-गुणवत्ता वाली छवियां प्रदान करता है।

दोनों प्रकार साइट पर उपलब्ध हैं: Sunburst गुणवत्ता और सटीक संपादन के लिए, Flare गति और विचारों को आजमाने के लिए। कीमत वैरिएंट पर निर्भर नहीं करती - केवल रिज़ॉल्यूशन पर।

गुणवत्ता स्तर के बजाय दो प्रकार और तीन रिज़ॉल्यूशन

जेनरेशन 2.5 में कोई निम्न-से-अधिकतम पैमाना नहीं है: इसके बजाय एक प्रकार और एक रिज़ॉल्यूशन है।Sunburstअधिक सटीकता से रेखांकन करता है और संपादन सीमाओं का सम्मान करता है;Flareएक तैयार फ्रेम काफी तेजी से वितरित करता है। संकल्प विवरण और कीमत निर्धारित करता है:1Kड्राफ्ट और विचारों को आजमाने के लिए,2Kसोशल मीडिया और वेबसाइटों के लिए कार्यशील केंद्र के रूप में,4Kप्रिंट और बड़े प्रारूप के लिए अंतिम के रूप में।

किफायती रणनीति: Flare 1K पर ड्राफ्ट, सर्वोत्तम प्रॉम्प्ट से Sunburst 2K या 4K पर एक फाइनल। मूल्य प्रति चित्र गिना जाता है और दिखाया जाता हैपहलेआप जेनरेट दबाते हैं - कोई बैलेंस नहीं होने से आश्चर्य होता है, और यदि जेनरेशन विफल हो जाती है, तो टोकन स्वचालित रूप से वापस कर दिए जाते हैं।

एकल स्रोत छवि से संपादन की श्रृंखला

इस पीढ़ी का हस्ताक्षर कौशल संपादन है। OpenAI के आधिकारिक डेमो में, संपादन की एक लंबी श्रृंखला एक शुरुआती फ्रेम पर लागू की जाती है: जैकेट का रंग बदलें, पृष्ठभूमि बदलें, चश्मा जोड़ें, दृश्य को बरसात के मौसम में बदलें, इसे पेस्टल में या वास्तुशिल्प जल रंग के रूप में फिर से बनाएं - और हर चरण केवल वही बदलता है जो पूछा गया था।

OpenAI के आधिकारिक डेमो से फ़्रेम: एक स्रोत छवि पर संपादन की एक श्रृंखला - जैकेट का रंग, पृष्ठभूमि, चश्मा

साइट पर, संपादन मोड स्वचालित रूप से चालू हो जाता है: एक से सोलह संदर्भ छवियां (प्रत्येक 30 एमबी तक) संलग्न करें और एक निर्देश लिखें। कोई अलग टॉगल नहीं है - मॉडल अनुरोध में छवियों की उपस्थिति से मोड को समझता है।

ChatGPT ऐप डेमो क्या दिखाता है: स्केच, लक्षित संपादन और टेम्पलेट

मॉडल रिलीज़ के साथ-साथ, OpenAI ने ChatGPT ऐप को भी ताज़ा किया, और व्यावहारिक समीक्षाएँ इस पीढ़ी के चरित्र को अच्छी तरह से दिखाती हैं। पहला,स्केच-आधारित इनपुट: ऐप में आप एक दृश्य का एक मोटा आरेख (सोफे, खिड़कियों, एक कुत्ते के सिल्हूट के लिए एक बॉक्स) बना सकते हैं और मॉडल डूडल को एक पूर्ण इंटीरियर में बदल देता है - यह बिना किसी पाठ निर्देश के भी स्केच की व्याख्या करता है। जनरेशन भी पहले की तुलना में काफ़ी तेज़ महसूस होती है।

दूसरा,लक्षित संपादन उपकरणतैयार फ़्रेम के शीर्ष पर: एक क्षेत्र को घेरें और "यहाँ एक बिल्ली रखने" के लिए कहें, एक बैच में कई टिप्पणियाँ छोड़ें ("इस पौधे को मृत बनाएं", "बाहर एक इंद्रधनुष जोड़ें", "दीवारों को ग्रे बनाएं"), इरेज़र के साथ एक ऑब्जेक्ट को हाइलाइट करें ताकि मॉडल समझ सके कि क्या हटाना है और अंतर को सफाई से भरना है। बैकग्राउंड रिमूवर एक क्लिक में किसी स्पष्ट विषय को उसकी पृष्ठभूमि से अलग कर देता है।

तीसरा,संदर्भ तस्वीरें. समीक्षाओं में मॉडल को पुराने स्नैपशॉट को पुनर्स्थापित करते हुए दिखाया गया है (चकाचौंध हटाएं, इसे साफ़ करें, बच्चे को एक सूट में रखें - और यह अभी भी वही बच्चा है), वास्तविक स्थानों को फिर से डिज़ाइन करना (एक बजरी पिछवाड़ा एक रॉक गार्डन बन जाता है) और तीन अलग-अलग चित्रों को एक तस्वीर में संयोजित करना। एक और असाधारण कौशल हैपहचान संरक्षण: लंबी संपादन शृंखला में लोग और जानवर खुद को पहचाने हुए रहते हैं - छवि पुनरावृत्ति से पुनरावृत्ति तक खराब नहीं होती है, जहां आमतौर पर छवि मॉडल की आलोचना की जाती है। ऐप को भी फायदा हुआखाके— लोकप्रिय प्रारूपों के लिए शुरुआती बिंदु: लोगो, पोस्टर, इंटीरियर डिज़ाइन, चित्रण।

स्केच इनपुट और टेम्प्लेट ChatGPT ऐप सुविधाएं हैं और API का हिस्सा नहीं हैं। हमारी साइट पर दोनों प्रकार - Sunburst और Flare - उपलब्ध हैं: टेक्स्ट-टू-इमेज जेनरेशन, संदर्भ-आधारित संपादन (प्रत्येक 30 एमबी की 16 छवियों तक - बहाली, रंग बदलना, पृष्ठभूमि प्रतिस्थापन, रीस्टाइलिंग), 1K/2K/4K रिज़ॉल्यूशन और एक दर्जन पहलू अनुपात। साइट पर किसी फ़ोटो को पुनर्स्थापित करने या दोबारा काम करने के लिए, बस इसे संदर्भ के रूप में संलग्न करें और एक निर्देश लिखें।

समीक्षा से अलग व्यावहारिक मामला हैवीडियो थंबनेल: लेखक संपादनों की एक श्रृंखला (एक सशक्त पृष्ठभूमि, एक बड़ा विषय, एक पठनीय रूप) के माध्यम से एक आकर्षक YouTube पूर्वावलोकन इकट्ठा करता है - वही लक्षित-संपादन यांत्रिकी, केवल लक्ष्य "सुंदर" के बजाय "क्लिक करने योग्य" है। साइट पर यह कार्य उसी तरह से काम करता है: संदर्भ के रूप में एक फ्रेम संलग्न करें और पृष्ठभूमि और उच्चारण के बारे में एक निर्देश जोड़ें।

विवरण में परिशुद्धता

दूसरी पहचान छोटी-छोटी बातों का तुरंत पालन करना है: कितनी वस्तुएं हैं, किस तरफ हैं, घड़ी क्या पढ़ रही है, इमारत में कितनी मंजिलें हैं। OpenAI का डेमो फ़्रेम दिखाता है जहां मॉडल एक ही बार में विवरण से कई सटीक स्थितियों को पुन: पेश करता है।

OpenAI के आधिकारिक डेमो से फ़्रेम: मॉडल विवरण से सटीक विवरण प्रस्तुत करता है - पोज़, ऑब्जेक्ट गिनती, घड़ी की सूइयां

मूल पारदर्शिता बॉक्स से बाहर

परिवार में दोनों मॉडल सपोर्ट करती हैंमूल पारदर्शिता: पूर्ण अल्फा चैनल वाला ऑब्जेक्ट कोलाज, लेआउट या गेम के लिए तुरंत तैयार होता है - कोई मैन्युअल कटआउट नहीं। डेमो नई पृष्ठभूमि पर संयोजित एक वस्तु को दिखाता है।

OpenAI के आधिकारिक डेमो से फ़्रेम: मूल पारदर्शिता - पूर्ण PNG अल्फा, ऑब्जेक्ट को नई पृष्ठभूमि पर रखा गया है

साइट के बारे में एक नोट: जनरेटर के पास कोई अलग पारदर्शी-पृष्ठभूमि स्विच नहीं है - यह खंड बताता है कि मॉडल OpenAI डेमो में क्या कर सकता है, मॉडल पृष्ठ पर कोई विकल्प नहीं है।

कितना खर्चा

2.5 के लिए OpenAI की टोकन दरें पिछली पीढ़ी से मेल खाती हैं, और साइट पर प्रति-छवि मूल्य केवल रिज़ॉल्यूशन (1K/2K/4K) पर निर्भर करता है - हमेशा आपके जेनरेट करने से पहले दिखाया जाता है। Flare 1K पर ड्राफ्ट, Sunburst 2K या 4K पर फाइनल। आप अपने आंतरिक टोकन बैलेंस से भुगतान करते हैं; किसी सदस्यता की आवश्यकता नहीं है.

इसे ब्राउज़र में आज़माएँ

मॉडल पहले से ही इमेज जेनरेशन स्टूडियो में लाइव है: मॉडल सूची में "ChatGPT Images 2.5" चुनें, फ्रेम का वर्णन करें और यदि आवश्यक हो तो संदर्भ संलग्न करें।ChatGPT Images 2.5 को NeuralSpace पर खोलें.