این شرکت روز سه شنبه تایید کرد که OpenAI ChatGPT Images 2.5 را راه اندازی کرده است، نسخه جدیدی از مدل تولید تصویر ساخته شده در ChatGPT. این به‌روزرسانی روی سه نقطه درد مداوم ابزارهای تصویری هوش مصنوعی تمرکز دارد: سرعت تولید، تمایل ویرایش‌های کوچک به درهم‌کوبی کل تصاویر، و دشواری توصیف ایده‌های بصری در متن.

به گفته OpenAI، Images 2.5 جزئیات واضح‌تر، نور طبیعی‌تر و بافت‌های غنی‌تر را نسبت به نسخه قبلی خود تولید می‌کند و کار بهتری برای حفظ شباهت افراد، حیوانات خانگی و اشیاء گرفته شده از عکس‌های مرجع انجام می‌دهد. نسل تا 50 درصد سریعتر از Images 2.0 نسخه قبلی است. For more context on this story, see our ongoing breaking AI news.

ویرایشی که فقط خواسته شما را تغییر می دهد

رایج‌ترین شکایت در مورد تولیدکننده‌های تصویر هوش مصنوعی این است که درخواست یک تغییر کوچک - پس‌زمینه متفاوت، یک خط متن اصلاح‌شده - اغلب کل تصویر را دوباره ترسیم می‌کند. OpenAI می‌گوید Images 2.5 فقط برای ویرایش آنچه کاربر درخواست می‌کند ساخته شده است، در حالی که بقیه تصویر را دست نخورده باقی می‌گذارد، حتی در چندین دور ویرایش در یک مکالمه طولانی.

Axios که دسترسی اولیه به مدل را دریافت کرد، این را با طراحی یک خالکوبی، اصلاح آن از روی یادداشت‌ها، و تکرار بر روی یک لوگو در چندین دور بدون از دست دادن مفهوم اصلی آزمایش کرد - یک گردش کار چند مرحله‌ای که معمولاً مدل‌های تصویر قبلی را خراب می‌کند.

طرح، الگوها و نظرات

این به روز رسانی قابلیتی به نام Sketch را معرفی می کند که به کاربران امکان می دهد یک doodle خشن را مستقیماً در ChatGPT ترسیم کنند - چیدمان اتاق، شکل یک لباس - و از آن نقاشی به عنوان راهنمای تصویر نهایی استفاده کنند. تایپ کردن «Sketch@» در یک مکالمه، ابزار را بالا می‌آورد. شرط OpenAI این است که نشان دادن و ترسیم اغلب سریع‌تر و دقیق‌تر از نوشتن پاراگراف دیگری از متن سریع است.

در کنار Sketch، OpenAI قالب‌هایی را برای فرمت‌های رایج مانند پوسترها و کالاها، امکان گذاشتن نظرات مستقیم روی یک تصویر برای هدف قرار دادن ویرایش‌های خاص، و گزینه‌ای برای اشتراک‌گذاری درخواست دقیق در پشت یک اثر اضافه کرد تا دیگران بتوانند آن را با عکس‌های خود ترکیب کنند.

ادل لی، سرپرست محصولات OpenAI در زمینه تصاویر، به Axios گفت که هدف این است که مردم را فعالانه در فرآیند خلاقانه درگیر کند. لی گفت: «ابزار طراحی و این الگوها به نوعی تلاشی است تا مردم را بیشتر درگیر فرآیند خلقت کند، نه اینکه آنها یک نیروی منفعل باشند.

دو مدل API جدید برای توسعه دهندگان

توسعه دهندگان دو مدل جدید را از طریق OpenAI API دریافت می کنند. GPT-Image-2.5 Flare برای تولید روزانه و پرحجم مانند محتوای اجتماعی و عکس‌های محصول، با اولویت تاخیر کمتر طراحی شده است. GPT-Image-2.5 Sunburst به عنوان گزینه کندتر اما دقیق‌تر برای کار کمپین صیقلی قرار گرفته است.

این تقسیم نشان می دهد که OpenAI چگونه مدل های متنی خود را طبقه بندی کرده است و به تیم های مهندسی بین هزینه و سرعت در یک طرف و کیفیت خروجی از طرف دیگر مبادله می کند. شرکت هایی که تولید تصویر را در محصولات خود ایجاد می کنند، اکنون می توانند بدون ترک خانواده Images 2.5، بین این دو انتخاب کنند.

واترمارک و منشأ در جای خود باقی می مانند

OpenAI می‌گوید مدل‌های جدید بررسی‌های ایمنی مورد استفاده در نسخه‌های تصویر قبلی را همراه با اعتبار محتوای C2PA و واترمارک نامرئی برای کمک به شناسایی تصاویر تولید شده توسط هوش مصنوعی حفظ می‌کنند. استانداردهای منشأ اهمیت فزاینده‌ای پیدا کرده‌اند، زیرا تصاویر واقعی واقعی در سراسر پلتفرم‌های اجتماعی پخش می‌شوند، و OpenAI با فشار مداوم از سوی تنظیم‌کننده‌ها و دارندگان حقوق برای قابل تشخیص کردن رسانه‌های مصنوعی مواجه شده است.

یک میدان رقابتی و شلوغ

پرتاب در یک بازار شلوغ تولید تصویر فرود می آید. TechRepublic خاطرنشان می‌کند که Canva بیش از 100 به‌روزرسانی Visual Suite را در سال 2026 ارسال کرده است که اصطکاک گردش کار خلاقانه را هدف قرار داده است، در حالی که رقبای خود از جمله Google و xAI به تکرار مدل‌های تصویر خود ادامه می‌دهند. در اوایل سال جاری، رتبه‌بندی Arena نشان داد که OpenAI's GPT-Image-2 و XAI's Imagine مکان‌های تجاری نزدیک به بالاترین رتبه‌های برتر اولویت‌های انسانی هستند.

برای OpenAI، استراتژی Images 2.5 کمتر در مورد امتیازات معیار خام و بیشتر در مورد طراحی تعامل است: کاهش تعداد بازنویسی‌های سریع مورد نیاز برای به دست آوردن یک نتیجه قابل استفاده. همانطور که TechRepublic می گوید، هدف این به روز رسانی این است که تولید تصویر با هوش مصنوعی کمتر شبیه تایپ یک طلسم جادویی در یک جعبه باشد و بیشتر شبیه ساختن چیزی باشد.

در دسترس بودن

به گفته OpenAI، ChatGPT Images 2.5 برای همه کاربران ChatGPT، ChatGPT Work و Codex در دسک‌تاپ، موبایل و وب منتشر می‌شود. مدل‌های Flare و Sunburst API بلافاصله در دسترس توسعه‌دهندگان قرار می‌گیرند و قیمت آن در صفحات اسناد مدل OpenAI شرح داده شده است.

برای کسب‌وکارهای کوچک و سازندگان، اهمیت عملی ساده است: بازسازی‌های کمتر برای تعمیر برچسب، دست یا پس‌زمینه به معنای چرخش سریع‌تر در آگهی‌ها، عکس‌های محصول و پست‌های اجتماعی است که در آن ابزارهای تصویری هوش مصنوعی بیشترین استفاده را دارند. ارزیابی TechRepublic این بود که این به‌روزرسانی سطح مهارت را برای به دست آوردن یک نتیجه قابل استفاده پایین می‌آورد، دقیقاً افرادی را هدف قرار می‌دهد که نمی‌خواهند به متخصصان مهندسی سریع تبدیل شوند تا فقط یک آگهی یا عکس محصول مناسب تولید کنند. اینکه Sketch و ویرایش مبتنی بر نظر به روشی پیش‌فرض تبدیل شوند که افراد مدل‌های تصویر را هدایت می‌کنند - به جای درخواست‌های طولانی - معیاری است که باید در ماه‌های آینده مراقب آن باشیم.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →