Перейти к содержанию

Генерация изображений

Создание визуальных материалов по запросу пользователя

Обзор

Функция Генерация изображений позволяет создавать изображения в формате PNG по текстовым запросам. Результат отображается непосредственно в чате, откуда его можно скачать.

Создание изображения по текстовому запросу в интерфейсе AI-платформы

Настройка

AI-платформа поддерживает пять моделей генерации изображений через OpenAI, Azure и Vertex AI (Google). В будущем планируется добавить другие варианты, например Stability AI.

Поддерживаемые модели

  • GPT-Image-1.5 — новейшая модель для создания изображений производственного качества. Обеспечивает точное управление результатом через запрос и надёжно воспроизводит текст и структурированные макеты внутри изображения.
  • GPT-Image-1 — более новая модель с улучшенным следованием запросу. Подходит в качестве модели по умолчанию для большинства сценариев.
  • Nano Banana — быстрая и экономичная модель Gemini Flash. Хорошо подходит для творческих экспериментов и несложных задач.
  • Nano Banana Pro — усовершенствованная модель Gemini для создания детализированных изображений профессионального качества с разрешением до 4K. Подходит для сложных задач, где важны согласованность и точность деталей.
  • DALL-E 3 — модель предыдущего поколения, которая хорошо подходит для выразительных изображений и художественно насыщенных стилей.

Использование

Настройте модели генерации изображений в панели администратора: Конфигурация → Генерация изображений.

После настройки действие Генерация изображений можно использовать с любым AI-агентом или языковой моделью AI-платформы.

Если агент должен применить определённое действие, явно укажите это в запросе. Например: «Используй генерацию изображений и создай иллюстрацию по следующему описанию».