Шутка на старте: представьте, что ваш компьютер говорит художнику — «подумай ещё раз» — и тот действительно думает. Забавно? Конечно. И полезно.

OpenAI представила ChatGPT Images 2.0 — не просто апдейт, а будто художник получил мозги-асистента. Новая модель GPT Image 2 умеет «думать», то есть при генерации может заглянуть в сеть, учесть файлы, которые вы загрузили, и пронести логику через весь набор картинок. Хотите серию кадров — пожалуйста: до восьми изображений из одного промпта, с одинаковыми персонажами, предметами и стилем. Как если бы режиссёр дал команду: «Сделай серию», и ассистент всё запомнил.

Она лучше следует инструкциям, точнее сохраняет детали, умеет писать текст прямо в картинке и поддерживает разное соотношение сторон — от широченных 3:1 до вертикальных 1:3. Разрешение выросло до 2K. И да, модель теперь лучше работает с немалой группой языков: японский, корейский, китайский, хинди и бенгали — заметный прогресс для шрифтов и вывесок в кадре.

Практически это выглядит так: вы зашиваете файл-план комнаты, просите «сделай варианты для каждой комнаты в одном стиле», и ИИ выдаёт серию согласованных рендеров. Или пишете сценарий для манги — и получаете страницу за страницей с одним и тем же героем.

Кому это доступно? Функция «thinking» — в пакетах Plus, Pro, Business, Enterprise, но многие обновления уже доступны всем пользователям ChatGPT и Codex. Конкуренция растёт: Google и Microsoft тоже не дремлют с собственными моделями, но OpenAI явно подняла планку удобства и связности изображений.

Хочется сказать: удобнее, чем спорить с жалким фотошопом в три часа ночи! Подробнее: https://www.theverge.com/ai-artificial-intelligence/916166/openai-chatgpt-images-2