
ChatGPT Images 2.5 با ویرایش دقیقتر و تولید تصویر تا ۵۰ درصد سریعتر معرفی شد
OpenAI مدل جدید ChatGPT Images 2.5 را معرفی کرده است؛ مدلی که برای افزایش دقت و کیفیت تولید و ویرایش تصویر عرضه میشود. این مدل جزئیات شارپتر، نورپردازی طبیعیتر و بافتهای غنیتر ارائه میکند و در حفظ ویژگیهای سوژههای موجود در عکس مرجع و اجرای دستورهای ویرایشی بهتر عمل میکند. OpenAI همچنین میگوید تأخیر تولید تصویر نسبت به Images 2.0 تا ۵۰ درصد کاهش یافته است.
به گفته OpenAI، کاربران هر هفته بیش از ۳ میلیارد تصویر را با ChatGPT Images و مدلهای GPT-Image در API تولید میکنند. ChatGPT Images 2.5 میتواند سوژههای آشنا را با تکیه بر عکسهای مرجع به محیطها، سبکهای بصری و ترکیببندیهای تازه منتقل کند، در حالی که ویژگیهای متمایز، نور و بافت طبیعیتر باقی میمانند. این دقت، جریانهای کاری مبتنی بر تصاویر مرجع در API را نیز قابلاعتمادتر میکند.
تمرکز دیگر OpenAI روی ویرایش دقیقتر است و ChatGPT Images 2.5 تلاش میکند فقط بخش درخواستی کاربر را تغییر دهد و سایر جزئیات را ثابت نگه دارد؛ حتی وقتی سوژه یا پسزمینه پیچیده باشد. در API تصاویر، توسعهدهندگان میتوانند عناصری مانند محصول، پسزمینه یا متن را هدفمند تغییر دهند و سوژه، ترکیببندی و هویت بصری پیرامون آن را حفظ کنند. ویدیوهایی متشکل از چند تصویر نیز این توانایی را نشان میدهند.
این مدل در گفتوگوهای طولانی ChatGPT نیز ویرایشهای چندمرحلهای را منسجمتر دنبال میکند. تغییرات قبلی احتمال بیشتری دارد که در مراحل بعدی حفظ شوند و هر ویرایش تازه بر نتیجه قبلی بنا شود، بدون اینکه کیفیت تصویر بهمرور افت کند. OpenAI میگوید این سازگاری به توسعهدهندگان اجازه میدهد تغییرات هدفمند انجام دهند، بدون اینکه کل دارایی بصری را از ابتدا بازسازی کنند.
ChatGPT Images 2.5 در درک دستورهای بصری پیچیده و تبدیل آنها به خروجی منسجم نیز پیشرفت کرده است، محتوای تصاویر دارای اطلاعات دنیای واقعی دقیقتر شده و مدل از چیدمانهای پیچیده، از جمله پسزمینههای شفاف، پشتیبانی بهتری دارد و بازتاب سبکهای بصری نیز دقیقتر شده است. این قابلیتها اجرای بریفهای خلاقانه، تولید داراییهای همسو با هویت برند، طراحی رابط کاربری با سلسلهمراتب مشخص و ساخت تصاویر ارائه را برای کسبوکارها قابلاعتمادتر میکند.
نمونه تصاویر تولید شده با ChatGPT Images 2.5:










OpenAI همزمان قابلیت Sketch را در ChatGPT معرفی کرده است؛ ابزاری که به کاربر اجازه میدهد مستقیماً داخل ChatGPT طرح بکشد و آن را راهنمای بصری تصویر نهایی قرار دهد. کاربر میتواند چیدمان یک اتاق، فرم کلی یک لباس یا نقاشی ساده را ترسیم کند و سپس با توضیح سبک و جزئیات، آن را به تصویری کامل تبدیل کند. برای استفاده کافی است عبارت @Sketch را در ChatGPT وارد کنید.
برای شروع ساخت تصاویر نیز قالبهای آماده ارائه شدهاند تا کاربر از صفحهای خالی آغاز نکند، قالبهایی مانند Poster و Merch برای فرمتهای رایج در دسترس هستند و میتوان اطلاعات، عناصر طراحی و سبک بصری را به آنها اضافه کرد. امکان افزودن نظر یا کامنت مستقیم روی تصاویر نیز ویرایشهای متمرکزتر را ممکن میکند. هنگام اشتراکگذاری تصویر، کاربر میتواند پرامپت استفادهشده را نیز در اختیار دیگران بگذارد.
در API، دو مدل GPT-Image-2.5 Flare و GPT-Image-2.5 Sunburst معرفی شدهاند. Flare همان بهبودهای کیفیت، ویرایش و سرعت Images 2.5 را ارائه میدهد و انتخاب پیشفرض برای بیشتر برنامهها است؛ این مدل نسبت به GPT-Image-2 تصاویر باکیفیتتری تولید میکند و تا ۵۰ درصد تأخیر کمتری دارد. Flare برای محتوای سازندگان، شبکههای اجتماعی، تجربههای محصول، جستوجوی بصری، نمونهسازی سریع و تولید در حجم بالا مناسب است.
GPT-Image-2.5 Sunburst برای جریانهای کاری حرفهای تصویری طراحی شده که به کنترل دقیقتر در ویرایش نیاز دارند و زمان بیشتری برای تولید تصویر صرف میکنند. OpenAI آن را برای تولید خلاقه آماده کمپین و تصاویر پرداختشده محصول معرفی کرده است. هر دو مدل API در دسترس توسعهدهندگان هستند و جزئیات قیمتگذاری آنها در بخش قیمتهای API ارائه میشود. OpenAI همچنین بازخورد مشتریان اولیه درباره مدلهای جدید را منتشر کرده است.
ChatGPT Images 2.5 با سازوکارهای ایمنی OpenAI عرضه شده و برای کاهش خروجیهای آسیبزا، بررسیهایی روی پرامپتها و تصاویر انجام میدهد. این شرکت از فراداده C2PA و واترمارک نامرئی برای کمک به شناسایی تصاویر ساختهشده با ابزارهایش استفاده میکند و جزئیات ارزیابیها و رویکرد ایمنی را در System Card توضیح داده است. ChatGPT Images 2.5 از امروز برای کاربران ChatGPT، ChatGPT Work و Codex روی دسکتاپ، موبایل و وب عرضه میشود.




