چتجیپیتی با مدل مجهز به تولید تصویر پیشرفته شد؛ دقت رنگ و متن بهینه گردید
چتجیپیتی با مدل مجهز به تولید تصویر پیشرفته شد؛ دقت رنگ و متن بهینه گردید, شرکت OpenAI قابلیت جدیدی با نام تصاویر در چتجیپیتی را به چتبات محبوب خود اضافه کرده است که از قدرت مدل برای ساخت تصاویر مستقیماً در محیط گفتگو بهره میبرد. این ویژگی جدید دقت در بازتولید رنگها و رندر متن در داخل تصاویر را به میزان قابلتوجهی ارتقا داده است.
انتشار عمومی و محدودیتهای اولیه به گفته تارا کریستینسن، سخنگوی OpenAI، این قابلیت از امروز برای کلیه کاربران در دسترس قرار گرفته است.
زخورد و استقبال کاربران در آینده بازنگری خواهند شد.
یکپارچگی بصری بهتر با معماری گابریل گو، مدیر تیم تحقیقاتی OpenAI، در گفتگو با از نتایج مثبت این ویژگی خبر داد. او توضیح داد که مدل که توانایی پردازش انواع دادهها را دارد، پایه این پیشرفت است.
مثلث آبی تولید میکردند.
مدل جدید چتجیپیتی این مشکل را برطرف کرده و میتواند بین ۱۵ تا ۲۰ عنصر متفاوت را به درستی در یک تصویر جایگذاری کند، در حالی که مدلهای پیشین تنها توانایی مدیریت ۵ تا ۸ عنصر را بدون خطا داشتند. رویکرد اتورگریسیو کلید کیفیت بالا گابریل گو تأکید کرد که این پیشرفت ناشی از رویکرد اتورگریسیو است؛ یعنی چتجیپیتی تصاویر را همانند تولید متن، به صورت تدریجی از بالا به پایین و از چپ به راست میسازد.
این روش برخلاف مدلهای مبتنی بر دیفیوژن مانند DALL·E است که کل تصویر را به صورت همزمان پردازش میکنند. همین مکانیزم تدریجی عامل اصلی بهبود یکپارچگی و دقت بصری در خروجیهای جدید است. نتیجه ماهها تست و بهینهسازی مدیر تیم تحقیقاتی OpenAI این قابلیت را حاصل ماهها تست گسترده و تکراری تیمش معرفی کرد.
اگرچه در پردازش متون بسیار ریز و کوچک در تصاویر همچنان چالشهایی وجود دارد، اما به طور کلی مدل جدید توانسته کیفیت متن و تصویر را به صورت همزمان و با دقت بالا حفظ کند.
