Inception: Mercury 2.5 Preview
Mercury 2.5 — самая быстрая LLM с рассуждениями и последняя diffusion LLM (dLLM) от Inception.
- вход / 1 млн
- 7 ₽
- 30 % типичного запроса
- выход / 1 млн
- 26 ₽
- 70 % типичного запроса
- контекст
- 260K
- токенов за запрос
- доступ
- От Go
- в квоте тарифа Go и выше
цена выхода среди моделей категории «рассуждения»
26 ₽
11 ₽медиана 166 ₽1 073 ₽
Дешевле 95 % категории
сравнение с 63 моделями категории «рассуждения» по заглавной цене
сколько будет стоить
409 ₽ / мес
при 20 млн токенов в месяц (30 % вход / 70 % выход)
входные токены
42 ₽
выходные токены
367 ₽
в квоту входит
от тарифа Go
quickstart.py
from openai import OpenAI
client = OpenAI(
base_url="https://ai-gatewey.ru/v1",
api_key="sk-aigate-ваш_ключ",
)
resp = client.chat.completions.create(
model="inception/mercury-2.5-preview",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)Ключу можно разрешить только нужные модели — лишние запросы не спишут баланс.
Возможности
Стримингда
Инструментыда
JSON-режимда
Работа с изображенияминет
Пошаговые рассуждениянет
Тарифы и лимиты
От Go
тариф₽ / месэта модельзапросов / мин
Оплата по факту
0
по балансу
60
Go
560
в квоте
60
Pro
2 800
в квоте
300
Max
11 200
в квоте
1000
Альтернативы
категория: рассуждения
дешевле
OpenAI: gpt-oss-20b
openai/gpt-oss-20bВыход / 1 млн23 ₽
Контекст131K
На 20 млн / мес−59 ₽ / мес
Открыть страницу →сильнее и дороже
OpenAI: gpt-oss-120b
openai/gpt-oss-120bВыход / 1 млн30 ₽
Контекст131K
На 20 млн / мес+45 ₽ / мес
Открыть страницу →у того же вендора
Inception: Mercury 2
inception/mercury-2Выход / 1 млн131 ₽
Контекст128K
На 20 млн / мес+1 683 ₽ / мес
Открыть страницу →Другие модели Inception
Близкие по цене
Модели других провайдеров в том же ценовом диапазоне — прямые альтернативы.
Одна модель — не выбор на всю жизнь
Переключение стоит одной строки: держите дешёвую модель на черновиках и сильную — на финальных ответах, оплата идёт по факту.