К содержимому
сравнение моделей

Google: Gemini 3.8 FlashThinking Machines: Inkling Small

Живое сравнение из каталога AI Gateway: цены в рублях, контекст и возможности. Обе модели доступны через один OpenAI-совместимый API — переключение одним параметром model.

ПараметрGoogle: Gemini 3.8 FlashThinking Machines: Inkling Small
Цена, ₽/1М токенов653209
Ввод, ₽/1М13178
Вывод, ₽/1М653209
Контекст1.0M524K
КатегорияАудиоАудио
МодальностьАудиоАудио
ВозможностиИнструменты, JSON-режимИнструменты
ДоступОт тарифа ProОт тарифа Go

Зелёным — лучшее значение. Цены каталога обновляются автоматически.

Чем Google: Gemini 3.8 Flash отличается от Thinking Machines: Inkling Small

Thinking Machines: Inkling Small дешевле: 209 ₽ за 1 млн токенов против 653 ₽ у Google: Gemini 3.8 Flash — разница в 3,1 раза. На объёме 10 млн токенов в месяц это 4 442 ₽ разницы в счёте.

Вывод у Google: Gemini 3.8 Flash дороже ввода в 5 раз, у Thinking Machines: Inkling Small — в 2,7 раза. Если задача генерирует длинные ответы, а не читает документы, выгоднее Thinking Machines: Inkling Small.

Контекст Google: Gemini 3.8 Flash — 1.0M против 524K: примерно 1613 страниц текста за один запрос против 807. Для анализа больших документов и кодовых баз это решающее отличие.

Возможности расходятся — только Google: Gemini 3.8 Flash умеет: JSON-режим.

Порог доступа разный: Google: Gemini 3.8 Flash — от тарифа «Pro», Thinking Machines: Inkling Small — от «Go».

Когда какую выбирать

Thinking Machines: Inkling Small дешевле за 1 млн токенов — выгоднее на массовых задачах.

Google: Gemini 3.8 Flash длиннее контекст — большие документы и кодовые базы целиком.

Google: Gemini 3.8 Flash поддерживает «JSON-режим» — агентные и структурированные сценарии.

Google: Gemini 3.8 Flash в рекомендуемых каталога — проверенный выбор для старта.

Подключение

меняется только параметр модели
from openai import OpenAI

client = OpenAI(
    base_url="https://ai-gatewey.ru/v1",
    api_key="sk-aigate-ваш_ключ",
)

resp = client.chat.completions.create(
    model="google/gemini-3.8-flash",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

Другие сравнения этих моделей

Попробуйте обе в деле

Один ключ и один OpenAI-совместимый API: Google: Gemini 3.8 Flash и Thinking Machines: Inkling Small — переключение одним параметром model.