Оглавление

Компания OpenAI объявила о выходе ChatGPT Images 2.5 — следующего поколения своей визуальной модели, которая обещает значительно сократить дистанцию между текстовым промптом и качественным результатом. Как сообщается в официальном блоге OpenAI, обновление фокусируется на улучшении детализации, ускорении генерации и внедрении инструментов прямого графического взаимодействия с нейросетью.

Еженедельно пользователи создают более 3 миллиардов изображений, и запрос на скорость стал критическим. В новой версии латентность сокращена на 50% по сравнению с предыдущим поколением. Для тех, кто привык ждать появления картинки по несколько десятков секунд, такой прирост производительности может кардинально изменить привычный рабочий процесс, превращая генерацию из томительного ожидания в живой диалог.

Инструментарий для точного контроля

Одной из самых примечательных новинок стала функция Sketch. Теперь пользователю не обязательно подбирать десятки эпитетов, чтобы объяснить расположение объектов в кадре — достаточно набросать эскиз прямо в интерфейсе ChatGPT. Модель использует этот рисунок как композиционную основу, сохраняя контуры и структуру при наложении выбранного стиля и текстур.

Для упрощения работы в систему внедрены шаблоны для популярных форматов, таких как рекламные флаеры и товарные фотографии. Также появилась возможность оставлять комментарии непосредственно к частям изображения для точечного редактирования. Теперь можно просто указать на конкретную область и попросить изменить деталь, не перерисовывая весь холст целиком.

Разработчики также получили доступ к двум специализированным версиям через API:

  • GPT‑Image‑2.5 Flare: универсальная модель с минимальной задержкой, подходящая для массовой генерации контента и прототипирования.
  • GPT‑Image‑2.5 Sunburst: решение для премиальных задач, где требуется максимальная точность и контроль, пусть и за счет чуть более долгой генерации.

Работа с референсами и консистентность

Проблема «галлюцинаций» и потери деталей при работе с исходными фото долгое время была ахиллесовой пятой генеративного искусства. Images 2.5 демонстрирует прогресс в сохранении черт лица, освещения и текстур при переносе субъекта из референсного снимка в новые условия. Это делает инструмент применимым для создания серийных изображений с одним и тем же персонажем.

Снижение латентности вдвое при одновременном росте консистентности — это серьезная заявка на доминирование в профессиональном пайплайне. Однако за глянцевыми примерами скрывается «стратегическая гибкость» OpenAI в вопросе авторских прав на обучающие выборки. Модель стала лучше понимать геометрию, но пока неясно, насколько эффективно она справляется с текстом внутри изображений на кириллице, что остается вечной проблемой для западных нейросетей. Скорость впечатляет, но без прозрачности данных этот инструмент остается мощной, но закрытой «черной коробкой».

Многоэтапное редактирование стало более надежным: при внесении правок в длинном диалоге нейросеть лучше «помнит» предыдущие изменения. Это избавляет от досадных ситуаций, когда при попытке сменить цвет шляпы персонаж внезапно меняет пол или национальность. Каждое последующее действие теперь опирается на текущий контекст, не деградируя в качестве со временем.

Безопасность и доступность

Вопрос этики и безопасности остается в фокусе. OpenAI продолжает внедрять метаданные стандарта C2PA и невидимые водяные знаки для идентификации ИИ-контента. В систему встроены фильтры, блокирующие попытки создания вредоносного или неприемлемого контента на этапе обработки промпта.

Обновление уже начало раскатываться для пользователей ChatGPT, включая планы Work и Codex, на всех платформах — от десктопных браузеров до мобильных приложений. Разработчикам предлагается ознакомиться с обновленной тарифной сеткой для Flare и Sunburst в документации API, чтобы оценить экономическую целесообразность перехода на новые мощности.