Společnost OpenAI spustila ChatGPT Images 2.5, novou verzi modelu generování obrázků zabudovaného do ChatGPT, společnost potvrdila v úterý. Aktualizace se zaměřuje na tři přetrvávající slabá místa nástrojů pro obrázky AI: rychlost generování, tendenci malých úprav zakódovat celé obrázky a obtížnost popisu vizuálních nápadů v textu.
Podle OpenAI vytváří Images 2.5 ostřejší detaily, přirozenější osvětlení a bohatší textury než jeho předchůdce a lépe zachovává podobu lidí, domácích mazlíčků a předmětů pořízených z referenčních fotografií. Generování je až o 50 % rychlejší než Images 2.0, předchozí verze. For more context on this story, see our ongoing artificial intelligence updates.
Úpravy, které změní pouze to, na co se ptáte
Nejčastější stížností na generátory obrázků AI bylo, že požadavek na jednu malou změnu – jiné pozadí, opravený řádek textu – často překreslí celý obrázek. OpenAI říká, že Obrázky 2.5 jsou vytvořeny tak, aby upravovaly pouze to, co uživatel požaduje, zatímco zbytek obrázku ponechává nedotčený, a to i v několika kolech úprav v dlouhé konverzaci.
Společnost Axios, která získala předběžný přístup k modelu, to otestovala tak, že nechala systém navrhnout tetování, revidovat jej z poznámek a iterovat logo v několika kolech, aniž by ztratila původní koncept – vícestupňový pracovní postup, který obvykle rozbije dřívější modely obrázků.
Skica, šablony a komentáře
Aktualizace zavádí funkci nazvanou Sketch, která uživatelům umožňuje kreslit hrubé čmáranice přímo v ChatGPT – rozložení místnosti, tvar oblečení – a použít tuto kresbu jako vodítko pro konečný obrázek. Zadáním „@Sketch“ v konverzaci nástroj vyvoláte. Sázka OpenAI spočívá v tom, že ukazování a kreslení je často rychlejší a přesnější než psaní dalšího odstavce rychlého textu.
Vedle Sketch přidal OpenAI šablony pro běžné formáty, jako jsou plakáty a zboží, možnost zanechat komentáře přímo k obrázku za účelem cílených úprav a možnost sdílet přesnou výzvu za výtvorem, aby ho ostatní mohli remixovat se svými vlastními fotografiemi.
Adele Li, produktová vedoucí OpenAI pro obrázky, řekla Axios, že cílem je udržet lidi aktivně zapojeny do kreativního procesu. "Nástroj náčrtu a tyto šablony jsou jakýmsi pokusem přimět lidi, aby se více zapojili do procesu tvorby, než aby byli pasivní silou," řekl Li.
Dva nové modely API pro vývojáře
Vývojáři získávají dva nové modely prostřednictvím OpenAI API. GPT-Image-2.5 Flare je zaměřen na velkoobjemovou, každodenní generaci, jako je sociální obsah a produktové fotografie, přičemž upřednostňuje nižší latenci. GPT-Image-2.5 Sunburst je umístěn jako pomalejší, ale přesnější volba pro dokonalou práci v kampani.
Rozdělení odráží to, jak OpenAI rozvrstvila své textové modely, což umožňuje technickým týmům kompromis mezi cenou a rychlostí na jedné straně a kvalitou výstupu na straně druhé. Společnosti, které vytvářejí image ve svých vlastních produktech, si nyní mohou vybrat mezi těmito dvěma, aniž by opustily rodinu Images 2.5.
Vodoznak a provenience zůstávají na svém místě
OpenAI říká, že nové modely si zachovávají bezpečnostní kontroly používané předchozími verzemi obrázků, spolu s přihlašovacími údaji C2PA a neviditelným vodoznakem, který pomáhá identifikovat obrázky generované AI. Standardy provenience se stávají stále důležitějšími s tím, jak se fotorealistické snímky šíří napříč sociálními platformami, a OpenAI čelila trvalému tlaku ze strany regulátorů a držitelů práv, aby byla syntetická média detekovatelná.
Konkurenční a přeplněné pole
Uvedení na trh přichází na stále přeplněnější trh generování obrázků. TechRepublic poznamenává, že Canva dodala v roce 2026 více než 100 aktualizací sady Visual Suite zaměřených na třenice kreativních pracovních postupů, zatímco konkurenti včetně Googlu a xAI pokračují v iteraci svých vlastních obrazových modelů. Začátkem tohoto roku hodnocení arény ukázalo, že OpenAI's GPT-Image-2 a xAI's Imagine se obchodují na předních příčkách žebříčků lidských preferencí.
Pro OpenAI je strategie s Images 2.5 méně o nezpracovaných srovnávacích skóre a více o návrhu interakce: snížení počtu rychlých přepisů potřebných k získání použitelného výsledku. Jak uvedla TechRepublic, cílem aktualizace je, aby se generování obrázků AI necítilo jako psaní magického kouzla do krabice, ale spíše jako skutečné vytváření něčeho.
Dostupnost
Podle OpenAI se ChatGPT Images 2.5 zavádí pro všechny uživatele ChatGPT, ChatGPT Work a Codex na desktopu, mobilu a webu. Modely Flare a Sunburst API jsou vývojářům k dispozici okamžitě, přičemž ceny jsou podrobně uvedeny na stránkách dokumentace modelu OpenAI.
Pro malé podniky a tvůrce je praktický význam přímočarý: méně regenerací k opravě štítku, ruky nebo pozadí znamená rychlejší obrat na letácích, produktových snímcích a sociálních příspěvcích, kde jsou nástroje AI image nejvíce využívány. Hodnocení TechRepublic bylo, že aktualizace snižuje úroveň dovedností pro získání použitelného výsledku, zaměřeného přímo na lidi, kteří se nechtějí stát experty na rychlé inženýrství, jen aby vytvořili slušný leták nebo produktový snímek. Zda se náčrt a úpravy založené na komentářích stanou výchozím způsobem, jakým lidé řídí obrazové modely – spíše než dlouhé výzvy – bude metrikou, kterou budeme v nadcházejících měsících sledovat.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →