اوپن‌ای‌آی نسل جدید مدل تصویرساز خود را با نام ChatGPT Images 2.5 معرفی کرد و در کنار آن، قابلیتی خلاقانه به نام Sketch را به محیط چت افزود. قابلیتی که مرز بین ایده اولیه روی کاغذ و خروجی نهایی حرفه‌ای را به طرز چشمگیری کوتاه می‌کند.

بر اساس اعلام رسمی، کاربران اکنون می‌توانند تنها با کشیدن یک طرح ساده و ابتدایی، دستور تصویری دقیق‌تری به هوش مصنوعی بدهند و نتیجه‌ای واقع‌گرایانه و با جزئیات بالا دریافت کنند. این ویژگی برای طراحان، تولیدکنندگان محتوا و حتی کاربران عادی که ایده‌ای در ذهن دارند اما مهارت طراحی پیشرفته ندارند، کاربردی خواهد بود.

قابلیت Sketch چگونه کار می‌کند؟

برای استفاده از این ابزار جدید، کافی است عبارت Sketch@ را در کادر گفت‌وگوی ChatGPT تایپ کنید. بلافاصله یک پنجره اختصاصی طراحی باز می‌شود که در آن می‌توان با استفاده از ماوس یا قلم نوری، طرح اولیه را ترسیم کرد.

پس از رسم طرح، کاربر می‌تواند با افزودن توضیحات متنی، سبک، فضا، رنگ و جزئیات مورد نظر خود را مشخص کند. هوش مصنوعی سپس بر اساس همین ترکیب «طرح دستی + پرامپت متنی»، تصویری نهایی با کیفیت بالا تولید می‌کند. به گفته اوپن‌ای‌آی، این رویکرد باعث می‌شود کنترل کاربر بر ترکیب‌بندی و چینش عناصر تصویر به مراتب بیشتر از نوشتن یک متن ساده باشد.

ویرایش هوشمند با قابلیت نظرگذاری روی تصویر

در کنار Sketch، ابزار ویرایش تصاویر ChatGPT نیز بهینه شده است. اکنون کاربران می‌توانند به‌صورت مستقیم روی بخش‌های مختلف تصویر نظر یا دستور ویرایشی ثبت کنند. برای مثال، می‌توان روی چشم یک پرتره کلیک کرد و نوشت «رنگ چشم را آبی روشن کن» یا روی پس‌زمینه اشاره کرد و خواستار تغییر آن شد.

این قابلیت، روند اصلاحات جزئی را بسیار ساده‌تر کرده و نیاز به توصیف کلی و دوباره‌نویسی پرامپت را از بین می‌برد. اوپن‌ای‌آی تأکید کرده که مدل جدید در دنبال کردن دستورهای ویرایشی مرحله‌به‌مرحله دقت بسیار بیشتری دارد و تغییرات را بدون برهم زدن ساختار کلی تصویر اعمال می‌کند.

بهبود کیفیت تصویر و افزایش ۵۰ درصدی سرعت

مدل ChatGPT Images 2.5 فقط یک ابزار طراحی جدید نیست، بلکه از نظر کیفیت خروجی نیز ارتقای قابل توجهی داشته است. اوپن‌ای‌آی می‌گوید تصاویر تولیدشده با این نسخه دارای نورپردازی طبیعی‌تر، بافت‌های غنی‌تر و جزئیات دقیق‌تر هستند.

داخل خبر (468x60)

این بهبود به‌ویژه در تولید چهره انسان، بافت پارچه، پوست، سطوح فلزی و صحنه‌های پیچیده با چند منبع نوری به خوبی دیده می‌شود. همچنین مدل جدید در درک دستورات پیچیده و چندبخشی عملکرد بهتری دارد و کمتر دچار خطا در تفسیر پرامپت می‌شود.

از نظر عملکرد، مدت‌زمان تولید تصویر در نسخه ۲.۵ نسبت به نسخه ۲.۰ تا ۵۰ درصد کاهش یافته است. این یعنی کاربران می‌توانند در زمان کوتاه‌تری به نتیجه دلخواه برسند و چرخه آزمون و خطا برای رسیدن به تصویر ایده‌آل سریع‌تر انجام شود.

دسترسی همگانی در تمام نسخه‌ها

اوپن‌ای‌آی اعلام کرده که دسترسی به مدل ChatGPT Images 2.5 و قابلیت Sketch هم‌اکنون برای تمامی کاربران در نسخه‌های وب، اپلیکیشن موبایل، نسخه دسکتاپ و همچنین سرویس‌های سازمانی و تیمی ChatGPT فعال شده است.

این عرضه همگانی نشان می‌دهد اوپن‌ای‌آی قصد دارد ابزارهای خلاقانه تصویرسازی را از یک قابلیت جانبی به بخشی اصلی از تجربه چت تبدیل کند؛ جایی که متن، تصویر و طراحی دستی به صورت یکپارچه با هم ترکیب می‌شوند.

رقابت داغ در بازار هوش مصنوعی مولد تصویر

معرفی Sketch در حالی انجام می‌شود که رقابت میان شرکت‌های بزرگ هوش مصنوعی برای جذب کاربران خلاق شدت گرفته است. گوگل، ادوبی و میدجرنی نیز در ماه‌های اخیر ابزارهای مشابهی برای کنترل بیشتر بر خروجی تصویر معرفی کرده‌اند، اما رویکرد اوپن‌ای‌آی با تکیه بر سادگی «یک طرح سریع + یک توضیح کوتاه» تلاش می‌کند فاصله میان ایده و اجرا را به حداقل برساند.

به نظر می‌رسد با ادغام طراحی تعاملی در محیط چت، ChatGPT یک گام دیگر به سمت تبدیل شدن به یک دستیار خلاق همه‌جانبه برداشته است؛ دستیاری که نه‌تنها متن می‌نویسد، بلکه می‌بیند، طراحی می‌کند و ایده‌های بصری کاربران را به واقعیت نزدیک‌تر می‌کند.