Inception: Mercury 2
Mercury 2 — очень быстрая LLM с рассуждениями и первая диффузионная LLM (dLLM) с рассуждениями.
- вход / 1 млн
- 44 ₽
- 30 % типичного запроса
- выход / 1 млн
- 131 ₽
- 70 % типичного запроса
- контекст
- 128K
- токенов за запрос
- доступ
- От Go
- в квоте тарифа Go и выше
цена выхода среди моделей категории «рассуждения»
131 ₽
11 ₽медиана 166 ₽1 073 ₽
Дешевле 57 % категории
сравнение с 63 моделями категории «рассуждения» по заглавной цене
сколько будет стоить
2 091 ₽ / мес
при 20 млн токенов в месяц (30 % вход / 70 % выход)
входные токены
262 ₽
выходные токены
1 830 ₽
в квоту входит
от тарифа Go
quickstart.py
from openai import OpenAI
client = OpenAI(
base_url="https://ai-gatewey.ru/v1",
api_key="sk-aigate-ваш_ключ",
)
resp = client.chat.completions.create(
model="inception/mercury-2",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)Ключу можно разрешить только нужные модели — лишние запросы не спишут баланс.
Возможности
Стримингда
Инструментыда
JSON-режимда
Работа с изображенияминет
Пошаговые рассуждениянет
Тарифы и лимиты
От Go
тариф₽ / месэта модельзапросов / мин
Оплата по факту
0
по балансу
60
Go
560
в квоте
60
Pro
2 800
в квоте
300
Max
11 200
в квоте
1000
Альтернативы
категория: рассуждения
дешевле
NVIDIA: Nemotron 3 Super
nvidia/nemotron-3-super-120b-a12bВыход / 1 млн105 ₽
Контекст262K
На 20 млн / мес−495 ₽ / мес
Открыть страницу →сильнее и дороже
Arcee AI: Trinity Large Thinking
arcee-ai/trinity-large-thinkingВыход / 1 млн139 ₽
Контекст262K
На 20 млн / мес+122 ₽ / мес
Открыть страницу →у того же вендора
Inception: Mercury 2.5 Preview
inception/mercury-2.5-previewВыход / 1 млн26 ₽
Контекст260K
На 20 млн / мес−1 683 ₽ / мес
Открыть страницу →Другие модели Inception
Близкие по цене
Модели других провайдеров в том же ценовом диапазоне — прямые альтернативы.
Одна модель — не выбор на всю жизнь
Переключение стоит одной строки: держите дешёвую модель на черновиках и сильную — на финальных ответах, оплата идёт по факту.