آنچه در این مقاله میخوانید [پنهانسازی]
اگر برای ساخت یا ویرایش تصویر از ChatGPT استفاده می کنی، ChatGPT Images 2.5 نسل جدید مدل تصویری OpenAI است که روی سه موضوع اصلی تمرکز دارد: جزئیات واضح تر، ویرایش دقیق تر و تولید سریع تر. OpenAI این نسخه را در 8 سپتامبر 2026 معرفی کرد و می گوید زمان تولید تصویر در مقایسه با Images 2.0 تا 50 درصد کاهش یافته است. مدل جدید همچنین سوژه های موجود در عکس مرجع را بهتر حفظ می کند، نور و بافت طبیعی تری می سازد و در ویرایش های چند مرحله ای ثبات بیشتری دارد.
Images 2.5 دقیقا چه تغییری ایجاد کرده است؟
مدل تولید تصویر ChatGPT دیگر فقط برای ساخت یک عکس از روی توضیح متنی نیست. کاربر می تواند با متن شروع کند، تصویر مرجع بدهد، بخش مشخصی را تغییر دهد و بعد طی چند مرحله تصویر را اصلاح کند. OpenAI تلاش کرده این فرآیند بیشتر شبیه همکاری مرحله به مرحله با یک طراح باشد.
یکی از مهم ترین تغییرها این است که مدل بهتر تشخیص می دهد چه چیزی باید تغییر کند و چه چیزی باید ثابت بماند. اگر فقط بخواهی رنگ یک محصول را عوض کنی، نباید چهره فرد، نور، ترکیب بندی و سایر عناصر تصویر نیز تغییر کنند. OpenAI می گوید نسخه جدید در چنین ویرایش های هدفمندی دقیق تر شده است.
کیفیت سوژه و تصاویر مرجع بهتر شده است
وقتی یک تصویر مرجع وارد می کنی، حفظ ویژگی های اصلی اهمیت زیادی دارد. این موضوع مخصوصا برای پرتره، عکس محصول، شخصیت ثابت یا مجموعه تصاویر یک کمپین مهم است.
OpenAI اعلام کرده مدل جدید سوژه های موجود در تصاویر مرجع را بهتر حفظ می کند. ویژگی های متمایز سوژه با احتمال بیشتری در خروجی باقی می مانند و نورپردازی و بافت نیز طبیعی تر شده اند. این یعنی اگر فرد یا محصولی را وارد یک صحنه تازه کنی، نتیجه بهتر می تواند هویت بصری منبع اصلی را نگه دارد.
البته حفظ بهتر به معنی بازسازی صد درصد یکسان در تمام شرایط نیست. تغییر شدید زاویه، سبک یا محیط همچنان می تواند تفاوت ایجاد کند. برای پروژه های حساس بهتر است عکس مرجع واضح باشد و تغییرات به صورت مرحله ای انجام شوند.
ویرایش دقیقتر بدون خراب شدن بقیه تصویر
یکی از مشکلات قدیمی مدل های تصویری این بود که یک اصلاح کوچک گاهی باعث تغییر کل تصویر می شد. مثلا کاربر می خواست نوشته روی بسته بندی عوض شود، اما مدل پس زمینه یا ظاهر محصول را هم تغییر می داد.
در نسخه جدید، مدل بهتر می تواند فقط عنصر مورد نظر را تغییر دهد و بقیه تصویر را حفظ کند. OpenAI مثال هایی مثل تغییر محصول، پس زمینه یا بخشی از متن را مطرح کرده و تاکید دارد که سوژه، ترکیب بندی و ظاهر برند می توانند ثابت بمانند.
در ChatGPT امکان Comment روی تصویر نیز اضافه شده است. کاربر می تواند روی قسمت مشخصی از تصویر نظر بگذارد و توضیح دهد چه تغییری می خواهد. این روش برای اصلاح یک رنگ، شیء، نوشته یا بخش مشخص از تصویر بسیار ساده تر است.
ویرایش چند مرحلهای چه مزیتی دارد؟
یک تصویر حرفه ای معمولا با یک پرامپت به نتیجه نهایی نمی رسد. شاید ابتدا ترکیب بندی را بسازی، بعد نور را تغییر دهی، رنگ ها را اصلاح کنی و در مرحله آخر متن یا جزئیات کوچک را تنظیم کنی.
OpenAI می گوید Images 2.5 در Multi-turn Editing ثبات بیشتری دارد. تغییرهای قبلی بهتر حفظ می شوند و درخواست جدید با احتمال کمتری باعث خراب شدن اصلاحات قبلی یا افت کیفیت تصویر می شود.
این قابلیت برای کاور، تبلیغات، عکس محصول و طراحی های برند محور اهمیت دارد. کاربر می تواند به جای نوشتن یک پرامپت بسیار طولانی، تصویر را مرحله به مرحله اصلاح کند.
قابلیت Sketch چیست؟
Sketch یکی از امکانات جدیدی است که همراه نسل تازه Images وارد ChatGPT شده است. کاربر می تواند یک طرح ساده بکشد و آن را به عنوان راهنمای بصری در اختیار مدل قرار دهد. لازم نیست طراحی حرفه ای باشد. حتی چند خط ساده می تواند محل عناصر یا ساختار کلی تصویر را مشخص کند.
مثلا می توانی جای تقریبی محصول، تیتر و شخصیت را روی صفحه مشخص کنی و بعد توضیح بدهی که خروجی نهایی باید یک پوستر تبلیغاتی مدرن باشد. مدل از اسکچ برای درک بهتر ترکیب بندی استفاده می کند.
طبق Release Notes رسمی، در نسخه موبایل می توان از بخش پیام گزینه Sketch را باز کرد، طرح را کشید و سپس توضیحات تکمیلی را اضافه کرد.
Templates چه کاربردی دارند؟
OpenAI مجموعه ای از Template ها را نیز برای فرمت های پرکاربرد تصویری اضافه کرده است. به جای شروع از یک صفحه خالی، می توان قالبی مثل Poster یا تصویر محصول را انتخاب کرد و سپس جزئیات مورد نظر را وارد کرد.
این قابلیت برای افرادی مناسب است که ایده دارند اما نمی دانند پرامپت تصویری را چگونه ساختاربندی کنند. قالب یک نقطه شروع فراهم می کند و کاربر بعد از آن می تواند اطلاعات، عناصر طراحی و سبک مورد نظر را مشخص کند.
البته Template جای پرامپت دقیق را نمی گیرد. اگر رنگ برند، نسبت تصویر، نوع نور یا چیدمان خاصی اهمیت دارد، بهتر است همان موارد را هم مشخص کنی.
درک سبک و دستورهای پیچیده بهتر شده است
نسخه جدید فقط در کیفیت رندر پیشرفت نکرده است. OpenAI می گوید مدل در فهم دستورهای بصری پیچیده نیز بهتر شده و می تواند Layout های دشوارتر، اطلاعات واقعی و حتی پس زمینه شفاف را بهتر مدیریت کند.
این پیشرفت برای پروژه های حرفه ای اهمیت زیادی دارد. اگر چند تصویر برای یک برند تولید می شود، مدل باید زبان بصری، ترکیب بندی و جهت هنری را در خروجی های مختلف حفظ کند.
برای همین می توان از آن در طراحی محتوای شبکه اجتماعی، پوستر، تصاویر ارائه، کانسپت رابط کاربری و عکس های تبلیغاتی استفاده کرد. هرچه Creative Brief دقیق تر باشد، احتمال رسیدن به خروجی هماهنگ نیز بیشتر می شود.
سرعت تولید تصویر چقدر افزایش یافته است؟
OpenAI اعلام کرده Latency تولید تصویر نسبت به Images 2.0 تا 50 درصد کاهش یافته است. این تفاوت زمانی بیشتر احساس می شود که چند نسخه از یک طرح می سازی یا چند مرحله ویرایش پشت سر هم انجام می دهی.
عبارت «تا 50 درصد» مهم است. این عدد به معنی نصف شدن زمان تولید همه تصاویر نیست. سرعت واقعی می تواند به کیفیت، پیچیدگی درخواست، اندازه خروجی و شرایط سرویس بستگی داشته باشد.
با این حال، تولید سریع تر باعث می شود فرآیند آزمون و خطا روان تر شود. کاربر می تواند یک ایده را بسازد، نتیجه را ببیند و سریع تر درخواست اصلاح بعدی را ثبت کند.
Flare و Sunburst در API چه هستند؟
OpenAI همراه این نسل دو مدل جدید برای توسعه دهندگان معرفی کرده است. GPT-Image-2.5 Flare گزینه سریع تر برای تولید تصاویر باکیفیت روزمره است. OpenAI آن را انتخاب پیش فرض برای بیشتر کاربردها معرفی می کند و می گوید برای محتوای شبکه اجتماعی، تجربه محصول، نمونه سازی سریع و تولید با حجم بالا مناسب است.
GPT-Image-2.5 Sunburst مدل قدرتمندتر برای جریان هایی است که دقت ویرایش اهمیت بیشتری دارد. این گزینه برای تصاویر محصول حرفه ای، Creative کمپین و پروژه هایی که کنترل دقیق روی تغییرات لازم دارند طراحی شده است. در مقابل، زمان تولید آن می تواند بیشتر باشد.
هر دو مدل متن و تصویر را به عنوان ورودی می پذیرند و از سطح های کیفیت low، medium، high، xhigh، max و auto پشتیبانی می کنند.
هزینه مدلهای جدید در API
طبق مستندات OpenAI، هزینه هر یک میلیون توکن متنی ورودی برای هر دو مدل 5 دلار است. توکن تصویری ورودی 8 دلار و توکن تصویری خروجی 30 دلار به ازای هر یک میلیون توکن قیمت دارد. ورودی Cache شده نیز هزینه پایین تری دارد.
هزینه واقعی یک تصویر می تواند بر اساس کیفیت و میزان توکن مصرف شده متفاوت باشد. اگر قرار است یک فروشگاه یا سرویس تولید محتوا روزانه تعداد زیادی تصویر بسازد، بهتر است هزینه نهایی بر اساس مصرف واقعی همان پروژه اندازه گیری شود.
دسترسی به مدل جدید چگونه است؟
OpenAI اعلام کرده Images 2.5 برای کاربران ChatGPT، ChatGPT Work و Codex در نسخه های دسکتاپ، موبایل و وب عرضه شده است. Release Notes همچنین می گوید محدودیت های موجود تولید تصویر تغییر نکرده اند.
برای توسعه دهندگان نیز Flare و Sunburst از طریق API ارائه شده اند. بنابراین می توان قابلیت تولید یا ویرایش تصویر را داخل فروشگاه آنلاین، نرم افزار طراحی، ابزار بازاریابی یا یک محصول اختصاصی قرار داد.
ایمنی و تشخیص تصاویر تولید شده
OpenAI می گوید نسل جدید بر همان لایه های ایمنی تولید تصویر بنا شده است و درخواست ها و تصاویر برای جلوگیری از برخی خروجی های آسیب زا بررسی میشوند.
این شرکت همچنین استفاده از C2PA Metadata و Watermark نامرئی را ادامه می دهد تا شناسایی تصاویر ساخته شده با ابزارهای OpenAI آسان تر شود. جزئیات بیشتر درباره ارزیابی های ایمنی نیز در System Card این مدل منتشر شده است.
در استفاده حرفه ای همچنان باید حقوق تصویر، مجوز استفاده از عکس های مرجع و قوانین انتشار محتوا در نظر گرفته شوند. تولید شدن یک تصویر توسط هوش مصنوعی به تنهایی همه مسائل حقوقی آن را حل نمی کند.
کاربردهای واقعی نسل جدید Images
تولیدکننده محتوا می تواند برای پست، کاور و تبلیغات چند نسخه از یک ایده بسازد. فروشگاه آنلاین می تواند محیط، رنگ یا بعضی جزئیات عکس محصول را تغییر دهد. طراح می تواند با Sketch ترکیب بندی مورد نظر خود را سریع تر به مدل منتقل کند.
تیم های مارکتینگ نیز از ویرایش دقیق تر سود می برند. اگر فقط یک محصول یا متن باید در Creative تغییر کند، دیگر لازم نیست کل طرح از ابتدا بازسازی شود.
برای توسعه دهندگان نیز انتخاب میان سرعت Flare و دقت بیشتر Sunburst اجازه می دهد مدل متناسب با نوع محصول انتخاب شود. به همین دلیل مدل تولید تصویر ChatGPT بیش از گذشته به یک ابزار کامل برای ساخت و اصلاح دارایی های بصری نزدیک شده است.
جمع بندی
نسل جدید نشان می دهد رقابت مدل های تصویری دیگر فقط بر سر ساخت عکس زیبا نیست. سرعت، حفظ سوژه، درک بهتر دستور، ویرایش دقیق و ثبات در چند مرحله حالا به همان اندازه مهم هستند.
ChatGPT Images 2.5 تلاش می کند تولید تصویر را به یک فرآیند تعاملی تبدیل کند. کاربر می تواند از متن، عکس مرجع، Sketch یا Template شروع کند و بعد با اصلاح های هدفمند به نتیجه نهایی برسد. برای توسعه دهندگان نیز دو مدل متفاوت فراهم شده تا میان سرعت و دقت انتخاب کنند.







