دلار آمریکا۲۶۸٬۷۰۰• ۰٪یورو۳۰۱٬۶۸۰• ۰٪درهم امارات۷۳٬۴۰۳• ۰٪سکه امامی۲۷۰٬۹۳۰٬۰۰۰• ۰٪طلای ۱۸ عیار۲۶٬۵۴۷٬۲۰۰• ۰٪انس طلا۴٬۱۴۰ $▼ ۰٫۰۲٪تتر۲۶۸٬۹۳۱• ۰٪بیت‌کوین۸۵٬۷۷۱ $▼ ۰٫۰۳٪اتریوم۲٬۷۱۲ $▲ ۰٪سولانا۱۲۰٫۶۴ $▲ ۰٫۲۹٪
همه نرخ‌ها

GPT-4o قدرت تصویرسازی ChatGPT را متحول کرد

عصر جدیدی در خلق تصاویر دیجیتال آغاز شده است! OpenAI با معرفی قابلیت‌های پیشرفته GPT-4o در ChatGPT، استانداردهای تولید تصاویر مبتنی بر هوش مصنوعی را به کلی دگرگون کرده است.

GPT-4o قدرت تصویرسازی ChatGPT را متحول کرد
GPT-4o قدرت تصویرسازی ChatGPT را متحول کرد

به گزارش نگاه فناوری:عصر جدیدی در خلق تصاویر دیجیتال آغاز شده است! OpenAI با معرفی قابلیت‌های پیشرفته GPT-4o در ChatGPT، استانداردهای تولید تصاویر مبتنی بر هوش مصنوعی را به کلی دگرگون کرده است. این ارتقاء چشمگیر نه‌تنها کیفیت بصری خروجی‌ها را بهبود بخشیده، بلکه درک مفهومی سیستم از توصیفات متنی را نیز به سطحی بی‌سابقه رسانده است.
شرکت OpenAI با افزودن ویژگی «Images in ChatGPT» و بهره‌گیری از مدل GPT-4o، تحولی چشمگیر در قابلیت‌های تولید تصویر چت‌بات خود ایجاد کرده است. این به‌روزرسانی، که از امروز در دسترس تمامی کاربران قرار گرفته است، دقت رنگ‌ها و کیفیت رندر متن در تصاویر را به طور قابل ملاحظه‌ای بهبود می‌بخشد.

ویژگی‌های کلیدی به‌روزرسانی جدید

به گفته تارا کریستینسن، سخنگوی OpenAI، کاربران نسخه عادی ChatGPT با وجود برخی محدودیت‌ها، در تعداد تصاویر درخواستی محدودیتی ندارند و این محدودیت‌ها نیز ممکن است با توجه به تقاضای کاربران، در آینده تغییر کند.

گابریل گو، مدیر تیم تحقیقاتی OpenAI، در مصاحبه‌ای با Verge، از نتایج مثبت این ویژگی جدید سخن گفت. او اشاره کرد که مدل «GPT-4o omnimodal»، که توانایی پردازش انواع مختلف داده‌ها را دارد، در توسعه این قابلیت به کار رفته است.

یکی از بهبودهای قابل توجه در این به‌روزرسانی، ویژگی «Binding» در ساخت تصاویر است. مدل‌های قدیمی‌تر اغلب در حفظ انسجام تصاویر، به ویژه هنگام اضافه کردن عناصر متعدد، دچار مشکل می‌شدند. اما مدل جدید ChatGPT قادر است تا 15 تا 20 عنصر را به طور صحیح در یک تصویر جای دهد، در حالی که مدل‌های قبلی تنها می‌توانستند 5 تا 8 عنصر را بدون خطا تولید کنند.

GPT-4o قدرت تصویرسازی ChatGPT را متحول کرد

نحوه عملکرد و مزایای به‌روزرسانی

گابریل گو توضیح داد که مدل جدید ChatGPT از رویکرد «Autoregressive» برای تولید تصاویر استفاده می‌کند. این بدان معناست که تصاویر به صورت تدریجی، از بالا به پایین و از چپ به راست، ایجاد می‌شوند، مشابه نحوه نگارش متن. این روش با مدل‌های قبلی مانند DALL·E که از روش «Diffusion model» برای پردازش همزمان کل تصویر استفاده می‌کردند، متفاوت است و به احتمال زیاد، بهبود یکپارچگی تصاویر ناشی از این تغییر رویکرد است.

مدیر تیم تحقیقاتی OpenAI تاکید کرد که این ویژگی جدید، نتیجه آزمایش‌های مکرر تیم او در ماه‌های اخیر است. با این حال، او اذعان کرد که مدل جدید هنوز در پردازش متون ریز و کوچک در تصاویر با مشکل مواجه است. با این وجود، به طور کلی، کیفیت متن و تصاویر به طور همزمان حفظ می‌شود.

با این به‌روزرسانی، ChatGPT به ابزاری قدرتمندتر برای تولید تصاویر با کیفیت و یکپارچه تبدیل شده است و کاربران می‌توانند از امکانات جدید این چت‌بات برای خلق تصاویر خلاقانه و جذاب بهره‌مند شوند.

نظر شما

—
هنوز رأیی ثبت نشده
  1. ۵۰
  2. ۴۰
  3. ۳۰
  4. ۲۰
  5. ۱۰

این مطلب چقدر به کارتان آمد؟

روی ستاره‌ها بزنید

واکنش شما

اولین نفری باشید که واکنش نشان می‌دهد.

خطایی در این مطلب دیدید؟ به تحریریه گزارش دهید؛ اصلاحیه‌ها طبق اصول تحریریه ثبت می‌شوند.

نویسنده

نویسنده

نویسنده اخبار فناوری، موبایل و هوش مصنوعی در نگاه فناوری.

همه مطالب زهرا صفاری

دیدگاه‌ها

۰/۲٬۰۰۰

دیدگاه‌ها پس از بررسی تحریریه منتشر می‌شوند. توهین، تبلیغ و لینک‌های بی‌ربط حذف می‌شوند؛ نقد فنی و مستند همیشه خوش‌آمد است.

هنوز دیدگاهی ثبت نشده است. اولین نفری باشید که نظرش را می‌نویسد.

مطالب مرتبط