На ввод (в запросе пользователя) модель может принимать:
Текст (0.12 ₽)
Изображения (0.12 ₽)
На выводе модель выдает:
Изображения (14.40 ₽)
Цены указаны за 1000 токенов / 1 шт. изображения (зависит от модели). В среднем 2000 токенов требуется для генерации 1 изображения.
Поддержка файлов
txt
pdf
csv
png
jpg
jpeg
bmp
webp
tiff
Поддержка функций
Размышление: есть
Веб-поиск: есть
Генерация изображений
Размеры:
512
1K
2K
4K
Соотношения сторон:
1:1
1:4
1:8
2:3
3:2
3:4
4:1
4:3
4:5
5:4
8:1
9:16
16:9
21:9
Качество:
—
Описание модели
gemini-3.1-flash-image — это экспериментальная предварительная версия новой скоростной мультимодальной модели от Google, оптимизированной для генерации и анализа изображений.
Она сочетает в себе высокую скорость архитектуры Flash с улучшенными возможностями нового поколения, предлагая разработчикам и энтузиастам ранний доступ к будущему визуального ИИ.
Ключевые возможности и улучшения
Улучшенная генерация изображений
Модель демонстрирует прогресс в качестве и детализации генерируемых изображений по сравнению с предыдущим стабильным релизом.
Ожидаются лучшая работа со сложными запросами, композицией и рендерингом текста в рамках картинки.
Продвинутый визуальный анализ (Vision)
Gemini 3.1 Flash Image Preview обладает усовершенствованными способностями к «зрению».
Это означает более точное распознавание объектов, сцен и текста (OCR) на загружаемых изображениях, а также более глубокое понимание контекста.
Скорость и эффективность
Модель сохраняет ДНК линейки Flash, будучи оптимизированной для быстрого ответа и обработки данных с высокой эффективностью, что делает её привлекательным выбором для приложений, где важна скорость.
Для каких задач подходит
Gemini 3.1 Flash Image подходит для задач, где необходимо быстро создавать, анализировать и обрабатывать визуальный контент. Экспериментальный статус модели делает её особенно интересной для тестирования новых возможностей генеративного ИИ и разработки приложений, ориентированных на работу с изображениями.
Генерация изображений: создание иллюстраций, рекламных креативов, концептов, визуалов для сайтов, презентаций и социальных сетей.
Создание дизайн-концепций: разработка идей для оформления, персонажей, интерьеров, рекламных материалов и различных визуальных проектов.
Анализ изображений: распознавание объектов, сцен, деталей и текста на фотографиях, схемах, скриншотах и других визуальных материалах.
Распознавание текста: извлечение информации с изображений, документов, вывесок, этикеток и других источников с использованием OCR.
Работа со сложными композициями: создание изображений с несколькими объектами, персонажами и визуальными элементами по подробному текстовому описанию.
Быстрое прототипирование: оперативная проверка визуальных идей и создание нескольких вариантов изображения без длительного ожидания результата.
Разработка мультимодальных приложений: интеграция генерации и анализа изображений в цифровые сервисы, инструменты для работы с контентом и пользовательские приложения.