Переглядаючи цей сайт, ви погоджуєтесь з нашою політикою конфіденційності
Прийняти
  • Про нас
  • Редакційна політика CyberCalm
  • Політика конфіденційності
  • Контакти
CyberCalm
  • Кібербезпека
    КібербезпекаПоказати ще
    Що таке квішинг? Як захиститися від QR-кодового фішингу
    Що таке квішинг: як працює фішинг через QR-коди і як захиститися
    09.09.2026
    Чи безпечно постійно тримати Bluetooth увімкненим на смартфоні
    Чи безпечно постійно тримати Bluetooth увімкненим на смартфоні
    07.09.2026
    Як змінити пароль у Facebook на телефоні та компʼютері — і що робити, якщо забули старий
    Як змінити пароль у Facebook на телефоні та компʼютері — і що робити, якщо забули старий
    06.09.2026
    Спуфінг: як шахраї підробляють номери, сайти й голоси — і що з цим робити
    Спуфінг: як шахраї підробляють номери, сайти й голоси — і що з цим робити
    05.09.2026
    Доксинг: що це таке, хто такі доксери і що робити, якщо вас доксять
    Доксинг: що це таке, хто такі доксери і що робити, якщо вас доксять
    04.09.2026
  • Сервіси
    • Gmail і Google
    • YouTube
    • Facebook
    • Instagram
    • Telegram і WhatsApp
    • X і TikTok
  • Смартфон
  • Комп’ютер
  • Приватність
  • Огляди
  • Новини
  • Сканер
Соцмережі
  • Facebook
  • Instagram
  • YouTube
  • TikTok
  • X (Twitter)
  • Threads
Спеціальні теми
  • Штучний інтелект
  • Кібервійна
  • Маніпуляції в медіа
  • Дезінформація
  • Безпека дітей в Інтернеті
  • Розумний будинок
Техногіганти
  • Google
  • Apple
  • Microsoft
  • OpenAI
  • Anthropic
  • Meta
  • Samsung
Читання: ChatGPT нарешті може генерувати зображення з розбірливим текстом
Розмір шрифтаAa
CyberCalmCyberCalm
Пошук
  • Кібербезпека
  • Смартфон
  • Комп’ютер
  • Приватність
  • Огляди
  • Сервіси
  • Новини
  • Сканер безпеки сайту
Follow US
  • Про проєкт Cybercalm
  • Політика конфіденційності
  • Контакти
© 2025 Cybercalm. All Rights Reserved.
Головна / Новини / ChatGPT нарешті може генерувати зображення з розбірливим текстом

ChatGPT нарешті може генерувати зображення з розбірливим текстом

Наталя Зарудня
ByНаталя Зарудня
Головний редактор
Головний редактор та засновниця CyberCalm. Понад 10 років у кібербезпеці та технологічній журналістиці. Пишу про захист даних, мобільну безпеку, штучний інтелект та соціальні мережі.
Follow:
26.03.2025
Поширити
5 хв. читання
ChatGPT нарешті може генерувати зображення з розбірливим текстом

У ChatGPT тепер можна генерувати зображення з GPT-4o. Нова модель генерації зображень, яка прийшла на зміну DALL-E 3, відрізняється точнішим відображенням тексту, покращеними можливостями «прив’язки» і простотою використання.

На відміну від традиційної дифузійної методології генерації зображень, яка «зафарбовує» деталі поверх випадкового шуму, GPT-4o використовує систему авторегресії зверху-вниз, збоку-вбік. Це повільніше, ніж дифузія, але переваги авторегресії очевидні. GPT-4o здатний генерувати зображення з ідеально розбірливим текстом – те, чого постійно не вдавалося досягти моделям зі штучним інтелектом, таким як DALL-E 3.

Мало того, ви можете вказати текстовий вміст для згенерованих зображень. Напишіть запит на кшталт «дай мені фотореалістичне зображення дівчини, яка пише на дошці від руки», скажіть ШІ будь-які слова, які ви хочете бачити на дошці, і він видасть вам щось досить точне. І, що, мабуть, ще важливіше, модель досить добре пише 2D-стилізований текст для ресторанних меню, рекламних оголошень та інших речей, які можуть бути корисними для бізнесу або любителів.

Авторегресійний підхід також допомагає з «прив’язкою» – простіше кажучи, ШІ не плутається в підказках, які містять кілька предметів. Якщо попросити DALL-E 3 намалювати червоне коло, синій трикутник, зелене серце, рожеву зірку і фіолетовий квадрат, він може заплутатись і згенерувати неправильні фігури або кольори. GPT-4o, з іншого боку, може точно обробляти до 20 різних об’єктів.

У поєднанні з можливостями рендерингу тексту, покращена прив’язка створює цікаві можливості для корпоративного мистецтва або реклами, хоча це також просто корисна річ, яка полегшує генерацію зображень.

Звичайно, GPT-4o генерує зображення просто «краще», ніж DALL-E 3. Фотореалістичні зображення виглядають більш наближеними до життя, цифрове мистецтво виглядає менш розмитим або зернистим, а нові методи виведення зменшують необхідність друкувати довгі, складні підказки. Модель також може похвалитися покращеною «узгодженістю символів», що означає, що символ або об’єкт, згенерований в одній підказці, може бути точно перенесений у наступні підказки – якщо ви скажете ШІ повторно використати кіборга-кішку, яку він створив, він не змінить колір кішки тощо.

OpenAI визнає, що його нова модель генерації зображень недосконала. Вона все ще бореться з галюцинаціями, математичними зображеннями (наприклад, діаграмами або графіками), багатомовним текстом тощо. Проте, це, безумовно, покращення порівняно з попередніми моделями генерації зображень компанії.

Також: Використання ChatGPT викликає відчуття самотності, – Дослідження

OpenAI стверджує, що генерація зображень GPT-4o містить засоби захисту для запобігання зловживанню, а також вдосконалені методи нанесення водяних знаків, щоб допомогти людям відрізнити контент, створений ШІ, від справжнього, створеного людиною. Але я ризикну припустити, що ці запобіжники можна обійти, якщо докласти певних зусиль. І OpenAI все ще використовує водяні знаки C2PA, які є лише метаданими. Потрібно дуже мало зусиль, щоб видалити ці метадані з зображення – C2PA неефективний для запобігання поширенню дезінформації.

Новий генератор зображень GPT-4o також не зменшить занепокоєння щодо авторських прав чи добросовісного використання. Згідно із заявою, наданою The Wall Street Journal, він навчався на суміші «загальнодоступних» і ліцензованих даних. ШІ-компанії, як відомо, нахабно ігнорують базові закони про авторське право, а OpenAI не ділиться своїми навчальними даними з громадськістю, тож не соромтеся робити власні висновки з цього приводу. (До речі, OpenAI дійсно піклується про авторські права, коли її роботу крадуть).

Генерувати зображення з GPT-4o можна вже сьогодні. Просто відкрийте ChatGPT у вашому браузері, попросіть ШІ згенерувати зображення і насолоджуйтеся. Зверніть увагу, що впровадження не завершено, тому деякі користувачі все ще можуть зіткнутися зі старою моделлю DALL-E 3.

Генератор зображень GPT-4o
Генератор зображень GPT-4o

 

Найкращий спосіб визначити різницю – поспостерігати, як завантажується згенероване зображення. DALL-E 3 завантажує зображення за допомогою колеса, що обертається, в той час як зображення GPT-4o завантажуються за допомогою приємної анімації, що нагадує рух планшетного сканера зверху вниз з боку в бік.

Всі користувачі ChatGPT мають доступ до генерації зображень GPT-4o, включно з безкоштовними користувачами. Однак, безкоштовні користувачі стикаються з обмеженнями у використанні, як і при використанні DALL-E 3. До речі, DALL-E 3 залишиться доступним у користувацьких форматах GPT для тих, хто хоче ним користуватися.

О, привіт 👋
Приємно познайомитися!

Підпишіться, щоб щотижня отримувати найцікавіші статті на свою поштову скриньку.

Ми не розсилаємо спам! Ознайомтеся з нашою політикою конфіденційності для отримання додаткової інформації.

Перевірте свою поштову скриньку або папку зі спамом, щоб підтвердити підписку.

ТЕМИ:ChatGPTDALL-E 3GPT-4oOpenAIШтучний Інтелект
ДЖЕРЕЛО:OpenAI
Поділитися
Facebook Threads Копіювати посилання Друк
Що думаєте?
В захваті0
Сумно0
Смішно0
Палає0
Овва!0
Попередня стаття Як змінити ім'я користувача у X (Twitter)? - ІНСТРУКЦІЯ Як змінити ім’я користувача у X (Twitter)? – ІНСТРУКЦІЯ
Наступна стаття Як розпізнати небезпечні вкладення та шкідливе ПЗ в електронній пошті Як розпізнати небезпечні вкладення та шкідливе ПЗ в електронній пошті

В тренді

Що таке квішинг? Як захиститися від QR-кодового фішингу
Що таке квішинг: як працює фішинг через QR-коди і як захиститися
09.09.2026
Чи безпечно постійно тримати Bluetooth увімкненим на смартфоні
Чи безпечно постійно тримати Bluetooth увімкненим на смартфоні
07.09.2026
Що таке суперкукі та як захистити вашу конфіденційність в мережі
Суперкукі: що це таке, чому вони майже зникли і що прийшло їм на зміну
09.09.2026
Як користуватися браузером Tor: встановлення, мости й налаштування безпеки
Як користуватися браузером Tor: встановлення, мости й налаштування безпеки
07.09.2026
Смартфон на столі з підключеною через OTG-перехідник USB-флешкою
Як підключити флешку до телефона на Android і що робити, якщо вона не працює
07.09.2026

Рекомендуємо

Спуфінг: як шахраї підробляють номери, сайти й голоси — і що з цим робити
Кібербезпека

Спуфінг: як шахраї підробляють номери, сайти й голоси — і що з цим робити

05.09.2026
Як розпізнати фейкову новину, створену ШІ: 7 перевірок, які працюють у 2026 році
Кібербезпека

Як розпізнати фейкову новину, створену ШІ: 7 перевірок, які працюють у 2026 році

03.09.2026
Монітор на робочому столі зі спрощеним списком результатів пошуку
Огляди

Альтернативи Google: 8 пошуковиків, які варто спробувати у 2026 році

02.09.2026
Проросійське угруповання UAC-0099 вбудувало у шкідливий код запит про ядерну зброю, щоб зірвати ШІ-аналіз
Кібербезпека

Проросійське угруповання UAC-0099 вбудувало у шкідливий код запит про ядерну зброю, щоб зірвати ШІ-аналіз

02.09.2026

Гарячі теми

  • Кібербезпека
  • Штучний інтелект
  • Смартфони
  • Комп'ютери
  • Соцмережі
  • Безпека дітей в Інтернеті

Приєднуйтесь

Ласкаво просимо до CyberCalm – вашого надійного провідника у світі цифрової безпеки та спокою!

Інформація
  • Про нас
  • Редакційна політика CyberCalm
  • Політика конфіденційності
  • Контакти
Навігація
  • Кібербезпека
  • Сервіси
  • Смартфон
  • Комп’ютер
  • Приватність
  • Огляди
  • Новини
  • Партнерські матеріали
CyberCalmCyberCalm
© 2025 Cybercalm. All Rights Reserved.
Cybercalm
Welcome Back!

Sign in to your account

Username or Email Address
Password

Lost your password?