Z.ai: GLM 5.3 Flash
GLM-5.3-Flash — нативная мультимодальная модель от Z.ai. Она подходит для эффективной разработки и продолжительных агентных задач.
- вход / 1 млн
- 26 ₽
- 30 % типичного запроса
- выход / 1 млн
- 87 ₽
- 70 % типичного запроса
- контекст
- 1.0M
- токенов за запрос
- доступ
- От Go
- в квоте тарифа Go и выше
цена выхода среди моделей категории «рассуждения»
87 ₽
18 ₽медиана 697 ₽104 500 ₽
Дешевле 89 % категории
сравнение с 99 моделями категории «рассуждения» по заглавной цене
сколько будет стоить
1 377 ₽ / мес
при 20 млн токенов в месяц (30 % вход / 70 % выход)
входные токены
157 ₽
выходные токены
1 219 ₽
в квоту входит
от тарифа Go
quickstart.py
from openai import OpenAI
client = OpenAI(
base_url="https://ai-gatewey.ru/v1",
api_key="sk-aigate-ваш_ключ",
)
resp = client.chat.completions.create(
model="z-ai/glm-5.3-flash",
messages=[{"role": "user", "content": "Привет!"}],
)
print(resp.choices[0].message.content)Ключу можно разрешить только нужные модели — лишние запросы не спишут баланс.
Возможности
Стримингда
Инструментыда
JSON-режимда
Работа с изображенияминет
Пошаговые рассуждениянет
Тарифы и лимиты
От Go
тариф₽ / месэта модельзапросов / мин
Оплата по факту
0
по балансу
60
Go
560
в квоте
60
Pro
2 800
в квоте
300
Max
11 200
в квоте
1000
Альтернативы
категория: рассуждения
дешевле
Qwen: Qwen3.8 Flash
qwen/qwen3.8-flashВыход / 1 млн82 ₽
Контекст1M
На 20 млн / мес−73 ₽ / мес
Открыть страницу →сильнее и дороже
Mistral: Mistral Small 4
mistralai/mistral-small-2603Выход / 1 млн105 ₽
Контекст262K
На 20 млн / мес+244 ₽ / мес
Открыть страницу →у того же вендора
Z.ai: GLM 4.6V
z-ai/glm-4.6vВыход / 1 млн157 ₽
Контекст131K
На 20 млн / мес+1 132 ₽ / мес
Открыть страницу →Другие модели Z.ai
Близкие по цене
Модели других провайдеров в том же ценовом диапазоне — прямые альтернативы.
Одна модель — не выбор на всю жизнь
Переключение стоит одной строки: держите дешёвую модель на черновиках и сильную — на финальных ответах, оплата идёт по факту.