Модель теперь точнее отображает текст и следует инструкциям пользователя.

Стартап OpenAI улучшила нейросеть GPT-4o, добавив расширенные возможности генерации изображений. Теперь ИИ не только создает высококачественные визуальные объекты, но и точно передаёт текст, чего не могли добиться предыдущие модели.


Главная особенность обновления — динамическое редактирование изображений. Вместо создания с нуля при каждом новом запросе GPT-4o позволяет вносить пошаговые изменения, следуя инструкциям пользователя. Модель может манипулировать 10-20 объектами в сцене, интегрировать элементы из нескольких изображений и изменять загруженные фото.
Хотя GPT-4o ещё не идеален (проблемы с текстом, возможные артефакты), OpenAI уверена в его потенциале. Новый инструмент обещает стать ещё одним шагом к универсальной генерации изображений с детальной кастомизацией.

