Gemini 3.1 Pro: мультимодальность и длинный контекст
Обзор Gemini 3.1 Pro: сильные стороны в работе с изображениями и большими документами, отличия от Flash-версии, подключение через единый API в рублях.
Gemini 3.1 Pro — старшая модель Google для задач, где важны мультимодальность и работа с большими объёмами контекста. Она хорошо подходит там, где на вход идут не только текст, но и изображения, а документы приходится анализировать целиком.
Сильные стороны
- Мультимодальность — понимает изображения и текст в одном запросе, что удобно для анализа скриншотов, схем и сканов.
- Длинный контекст — большие документы и кодовые базы помещаются без ручной нарезки, что упрощает RAG и аналитику.
- Рассуждения — уверенно держит сложные многоэтапные задачи и извлечение данных из объёмных источников.
- Структурированный вывод — стабильный JSON и следование форматам для интеграций.
Место в линейке: Pro или Flash
| Задача | Рекомендация |
|---|---|
| Анализ больших документов, мультимодальность | Gemini 3.1 Pro — максимум качества |
| Быстрые массовые запросы, чат, простые задачи | Gemini 3.5 Flash — скорость и цена |
| Смешанная нагрузка | Flash по умолчанию, Pro на сложных запросах |
Цена через AI Gateway
Модель доступна через единый OpenAI-совместимый API — с оплатой в рублях и без VPN. Актуальные цены линейки Gemini:
| Модель | Ввод, ₽/1М | Вывод, ₽/1М | Контекст |
|---|---|---|---|
| Google: Gemini 3.1 Pro Preview | 314 | 1 881 | 1.0M |
| Google: Gemini 3.5 Flash | 235 | 1 411 | 1.0M |
Подключение
from openai import OpenAI
client = OpenAI(
base_url="https://ai-gatewey.ru/v1",
api_key="sk-aigate-ваш_ключ",
)
resp = client.chat.completions.create(
model="google/gemini-3.1-pro-preview",
messages=[{"role": "user", "content": "Разбери структуру этого договора по разделам"}],
)
print(resp.choices[0].message.content)model: тот же код работает с Claude, GPT или DeepSeek из каталога. Удобно сравнивать Gemini Pro и Flash на своих документах.Частые вопросы
Чем Gemini 3.1 Pro отличается от Flash?
Pro — старший тир: глубже в рассуждениях и надёжнее на сложных мультимодальных и длинноконтекстных задачах. Flash быстрее и дешевле и хорошо закрывает массовые и простые запросы.
Подходит ли Gemini для работы с изображениями?
Да, модель мультимодальна и понимает изображения вместе с текстом в одном запросе — это удобно для анализа скриншотов, схем и сканов документов.
Как попробовать?
Зарегистрируйтесь — ключ выдаётся сразу, первый запрос занимает пару минут. Тарифы и условия — на странице тарифов.
Gemini 3.1 Pro — через единый API в рублях
Попробовать