К содержимому
Сравнение моделей

Qwen: Qwen2.5 72B InstructQwen: Qwen3 30B A3B Instruct 2507

Живое сравнение из каталога AI Gateway: цены в рублях, контекст и возможности. Обе модели доступны через один OpenAI-совместимый API — переключение одним параметром model.

ПараметрQwen: Qwen2.5 72B InstructQwen: Qwen3 30B A3B Instruct 2507
Цена, ₽/1М токенов6630
Ввод, ₽/1М608
Вывод, ₽/1М6630
Контекст33K128K
КатегорияЧатЧат
МодальностьТекстТекст
ВозможностиИнструменты, JSON-режимИнструменты, JSON-режим
ДоступОт тарифа GoОт тарифа Go

Зелёным — лучшее значение. Цены каталога обновляются автоматически.

Чем Qwen: Qwen2.5 72B Instruct отличается от Qwen: Qwen3 30B A3B Instruct 2507

Qwen: Qwen3 30B A3B Instruct 2507 дешевле: 30 ₽ за 1 млн токенов против 66 ₽ у Qwen: Qwen2.5 72B Instruct — разница в 2,2 раза. На объёме 10 млн токенов в месяц это 359 ₽ разницы в счёте.

Вывод у Qwen: Qwen3 30B A3B Instruct 2507 дороже ввода в 4 раза, у Qwen: Qwen2.5 72B Instruct — в 1,1 раза. Если задача генерирует длинные ответы, а не читает документы, выгоднее Qwen: Qwen2.5 72B Instruct.

Контекст Qwen: Qwen3 30B A3B Instruct 2507 — 128K против 33K: примерно 197 страниц текста за один запрос против 50. Для анализа больших документов и кодовых баз это решающее отличие.

Когда какую выбирать

Qwen: Qwen3 30B A3B Instruct 2507 дешевле за 1 млн токенов — выгоднее на массовых задачах.

Qwen: Qwen3 30B A3B Instruct 2507 длиннее контекст — большие документы и кодовые базы целиком.

Подключение

Один и тот же код — меняется только параметр модели:

from openai import OpenAI

client = OpenAI(
    base_url="https://ai-gatewey.ru/v1",
    api_key="sk-aigate-ваш_ключ",
)

resp = client.chat.completions.create(
    model="qwen/qwen-2.5-72b-instruct",
    messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)

Попробуйте обе в деле

Один ключ и один OpenAI-совместимый API: Qwen: Qwen2.5 72B Instruct и Qwen: Qwen3 30B A3B Instruct 2507 — переключение одним параметром model.