К содержимому
Сравнение моделей

NVIDIA: Nemotron 3 UltraOpenAI: gpt-oss-120b

Живое сравнение из каталога AI Gateway: цены в рублях, контекст и возможности. Обе модели доступны через один OpenAI-совместимый API — переключение одним параметром model.

ПараметрNVIDIA: Nemotron 3 UltraOpenAI: gpt-oss-120b
Цена, ₽/1М токенов36624
Ввод, ₽/1М835
Вывод, ₽/1М36624
Контекст262K131K
КатегорияРассужденияРассуждения
МодальностьТекстТекст
ВозможностиИнструменты, JSON-режимИнструменты, JSON-режим
ДоступОт тарифа ProОт тарифа Go

Зелёным — лучшее значение. Цены каталога обновляются автоматически.

Чем NVIDIA: Nemotron 3 Ultra отличается от OpenAI: gpt-oss-120b

OpenAI: gpt-oss-120b дешевле: 24 ₽ за 1 млн токенов против 366 ₽ у NVIDIA: Nemotron 3 Ultra — разница в 15,6 раза. На объёме 10 млн токенов в месяц это 3 423 ₽ разницы в счёте.

Вывод у OpenAI: gpt-oss-120b дороже ввода в 5 раз, у NVIDIA: Nemotron 3 Ultra — в 4,4 раза. Если задача генерирует длинные ответы, а не читает документы, выгоднее NVIDIA: Nemotron 3 Ultra.

Контекст NVIDIA: Nemotron 3 Ultra — 262K против 131K: примерно 403 страниц текста за один запрос против 202. Для анализа больших документов и кодовых баз это решающее отличие.

Порог доступа разный: NVIDIA: Nemotron 3 Ultra — от тарифа «Pro», OpenAI: gpt-oss-120b — от «Go».

Когда какую выбирать

OpenAI: gpt-oss-120b дешевле за 1 млн токенов — выгоднее на массовых задачах.

NVIDIA: Nemotron 3 Ultra длиннее контекст — большие документы и кодовые базы целиком.

Подключение

Один и тот же код — меняется только параметр модели:

from openai import OpenAI

client = OpenAI(
    base_url="https://ai-gatewey.ru/v1",
    api_key="sk-aigate-ваш_ключ",
)

resp = client.chat.completions.create(
    model="nvidia/nemotron-3-ultra-550b-a55b",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

Другие сравнения этих моделей

Попробуйте обе в деле

Один ключ и один OpenAI-совместимый API: NVIDIA: Nemotron 3 Ultra и OpenAI: gpt-oss-120b — переключение одним параметром model.