NVIDIA: Nemotron 3 UltraTencent: Hy4 preview
Живое сравнение из каталога AI Gateway: цены в рублях, контекст и возможности. Обе модели доступны через один OpenAI-совместимый API — переключение одним параметром model.
| Параметр | NVIDIA: Nemotron 3 Ultra | Tencent: Hy4 preview |
|---|---|---|
| Цена, ₽/1М токенов | 544 | 436 |
| Ввод, ₽/1М | 109 | 145 |
| Вывод, ₽/1М | 544 | 436 |
| Контекст | 262K | 1.0M |
| Категория | Рассуждения | Рассуждения |
| Модальность | Текст | Текст |
| Возможности | Инструменты, JSON-режим, Стриминг | Инструменты, JSON-режим, Стриминг |
| Доступ | От тарифа Pro | От тарифа Pro |
Зелёным — лучшее значение. Цены каталога обновляются автоматически.
Чем NVIDIA: Nemotron 3 Ultra отличается от Tencent: Hy4 preview
Tencent: Hy4 preview дешевле: 436 ₽ за 1 млн токенов против 544 ₽ у NVIDIA: Nemotron 3 Ultra — разница в 1,2 раза. На объёме 10 млн токенов в месяц это 1 087 ₽ разницы в счёте.
Вывод у NVIDIA: Nemotron 3 Ultra дороже ввода в 5 раз, у Tencent: Hy4 preview — в 3 раза. Если задача генерирует длинные ответы, а не читает документы, выгоднее Tencent: Hy4 preview.
Контекст Tencent: Hy4 preview — 1.0M против 262K: примерно 1613 страниц текста за один запрос против 403. Для анализа больших документов и кодовых баз это решающее отличие.
Когда какую выбирать
Tencent: Hy4 preview — дешевле за 1 млн токенов — выгоднее на массовых задачах.
Tencent: Hy4 preview — длиннее контекст — большие документы и кодовые базы целиком.
Подключение
from openai import OpenAI
client = OpenAI(
base_url="https://ai-gatewey.ru/v1",
api_key="sk-aigate-ваш_ключ",
)
resp = client.chat.completions.create(
model="nvidia/nemotron-3-ultra-550b-a55b",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)Другие сравнения этих моделей
Попробуйте обе в деле
Один ключ и один OpenAI-совместимый API: NVIDIA: Nemotron 3 Ultra и Tencent: Hy4 preview — переключение одним параметром model.