Название от разработчика: gemini-3-pro-image-preview
Дата выхода: ноябрь, 2025
Тип модели: для генерации изображений
Контекст: 66К
Статус: активная
Доступно в API: Да
Модальности и цены
На ввод (в запросе пользователя) модель может принимать:
Текст (0.48 ₽)
Изображения (0.48 ₽)
На выводе модель выдает:
Изображения (28.80 ₽)
Цены указаны за 1000 токенов / 1 шт. изображения (зависит от модели). В среднем 2000 токенов требуется для генерации 1 изображения.
Поддержка файлов
txt
pdf
csv
png
jpg
jpeg
bmp
webp
tiff
Поддержка функций
Размышление: есть
Веб-поиск: есть
Генерация изображений
Размеры:
1K
2K
4K
Соотношения сторон:
1:1
2:3
3:2
3:4
4:3
4:5
5:4
9:16
16:9
21:9
Качество:
—
Описание модели
gemini-3-pro-image — это доступ к следующему поколению мультимодальных моделей от Google. Эта версия демонстрирует качественный скачок в создании и понимании изображений, сочетая мощнейший интеллект архитектуры 3.0 с фотореалистичной генерацией нового уровня.
Google предоставляет доступ к этой модели, чтобы разработчики и энтузиасты могли оценить возможности движка Gemini 3.0.
В отличие от предыдущих версий (1.5 и 2.0), поколение 3.0 Pro Image нацелено на полное стирание границ между сгенерированным контентом и реальностью. Модель обладает глубоким пониманием физики света, текстур и композиции, а также способна анализировать изображения с точностью, близкой к экспертной человеческой оценке.
Возможности gemini-3-pro-image
Гиперреалистичная генерация
Gemini 3.0 Pro Image способна создавать изображения, которые практически невозможно отличить от профессиональных фотографий. Она идеально работает с:
Сложным освещением и отражениями.
Текстурами кожи и материалов.
Корректным отображением текста внутри изображений (вывески, этикетки).
Интеллектуальное редактирование
Модель не просто создает картинку заново, она позволяет вносить точечные изменения в существующие изображения с помощью команд на естественном языке, сохраняя исходный стиль и композицию.
Глубокий визуальный анализ
Способность "видеть" вышла на новый уровень. Модель может проанализировать видеопоток в реальном времени, описывая действия, эмоции людей и даже предсказывая дальнейшее развитие событий в кадре.
Сравнение поколений (Vision)
Параметр
Gemini 3.0 Pro Image
Gemini 2.5 Flash Image
DALL-E 3
Качество генерации
Next-Gen (Экстремальное)
Высокое
Высокое
Понимание физики света
Продвинутое
Базовое
Хорошее
Текст на изображении
Отличное
Хорошее
Среднее
Скорость
Средняя (в стадии Preview)
Очень высокая
Средняя
Сравнение качества генерации
Лучший способ оценить модель — увидеть результат. Ниже приведены примеры генерации по промпту:
«Киберпанк-кошка с неоновыми усиками и механическим хвостом сидит на фоне ночного города с летающими автомобилями, цифровой арт»