inclusionAI: Ling 3.0 Flash
**Ling-3.0-flash** — это модель **Mixture-of-Experts (MoE) с 124 млрд параметров**, из которых на каждый токен активируется примерно **5,1 млрд параметров**.
- вход / 1 млн
- 4 ₽
- 30 % типичного запроса
- выход / 1 млн
- 11 ₽
- 70 % типичного запроса
- контекст
- 262K
- токенов за запрос
- доступ
- От Go
- в квоте тарифа Go и выше
цена выхода среди моделей категории «рассуждения»
11 ₽
11 ₽медиана 166 ₽1 073 ₽
Самая дешёвая в категории
сравнение с 63 моделями категории «рассуждения» по заглавной цене
сколько будет стоить
176 ₽ / мес
при 20 млн токенов в месяц (30 % вход / 70 % выход)
входные токены
22 ₽
выходные токены
154 ₽
в квоту входит
от тарифа Go
quickstart.py
from openai import OpenAI
client = OpenAI(
base_url="https://ai-gatewey.ru/v1",
api_key="sk-aigate-ваш_ключ",
)
resp = client.chat.completions.create(
model="inclusionai/ling-3.0-flash",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)Ключу можно разрешить только нужные модели — лишние запросы не спишут баланс.
Возможности
Стримингда
Инструментыда
JSON-режимда
Работа с изображенияминет
Пошаговые рассуждениянет
Тарифы и лимиты
От Go
тариф₽ / месэта модельзапросов / мин
Оплата по факту
0
по балансу
60
Go
560
в квоте
60
Pro
2 800
в квоте
300
Max
11 200
в квоте
1000
Альтернативы
категория: рассуждения
Другие модели inclusionAI
Близкие по цене
Модели других провайдеров в том же ценовом диапазоне — прямые альтернативы.
Одна модель — не выбор на всю жизнь
Переключение стоит одной строки: держите дешёвую модель на черновиках и сильную — на финальных ответах, оплата идёт по факту.