Глоссарий

Термины AI простыми словами

Короткие определения без академизма: что такое токен, почему модель «галлюцинирует» и чем эмбеддинг отличается от промпта.

Агент
Программа на основе LLM, которая не просто отвечает, а решает задачу по шагам: планирует, вызывает инструменты и функции, анализирует результат и продолжает, пока не достигнет цели. Основа агентов — вызов функций.
Подробнее →
Галлюцинация
Ситуация, когда модель уверенно выдаёт правдоподобный, но неверный или выдуманный ответ: несуществующий факт, ссылку или цитату. Модель генерирует текст, а не сверяется с источником, поэтому такие ошибки возможны у всех LLM.
Подробнее →
Дообучение (fine-tuning)
Дополнительное обучение готовой модели на своих данных, чтобы она лучше решала узкую задачу или следовала нужному стилю. Требует подготовленного датасета и обычно нужно реже, чем кажется: часто хватает хорошего промпта или RAG.
Подробнее →
ИИ (искусственный интеллект)
Общее название технологий, которые позволяют программам решать задачи, обычно требующие человеческого мышления: понимать текст, распознавать изображения, отвечать на вопросы. Языковые модели — один из видов ИИ.
Подробнее →
Контекстное окно
Максимальный объём текста в токенах, который модель способна учитывать за один запрос: и ваш промпт, и её ответ. Всё, что выходит за пределы окна, модель «не видит» — история диалога обрезается.
Подробнее →
Мультимодальность
Способность модели работать не только с текстом, но и с другими типами данных — прежде всего изображениями. Мультимодальной модели можно отправить картинку вместе с вопросом и получить осмысленный ответ.
Подробнее →
Промпт (запрос)
Текст, который вы отправляете модели: вопрос, инструкция или задача. От того, насколько ясно сформулирован промпт, напрямую зависит качество ответа. В API промпт передаётся как массив сообщений с ролями.
Подробнее →
Промпт-инжиниринг
Практика составления запросов так, чтобы модель давала точные и предсказуемые ответы: чёткие инструкции, примеры, указание формата и роли. Часто это дешевле и быстрее, чем дообучение модели.
Подробнее →
Системный промпт
Отдельное сообщение с ролью «system», которое задаёт модели правила поведения, стиль и контекст на весь диалог: кто она, что можно и нельзя, в каком формате отвечать. Пользователь его обычно не видит.
Подробнее →
Стриминг (потоковый ответ)
Режим, при котором модель отдаёт ответ по частям, по мере генерации, а не целиком в конце. Пользователь видит текст, появляющийся слово за словом — как в чат-интерфейсах. Включается параметром stream: true.
Подробнее →
Температура
Параметр запроса, который управляет разнообразием ответа. Низкая температура делает ответы предсказуемыми и стабильными, высокая — более креативными и непредсказуемыми. Обычно значение задаётся от 0 до 2.
Подробнее →
Токен
Минимальная единица текста, которой оперирует языковая модель: примерно часть слова. И запрос, и ответ модель считает в токенах — от их количества зависит и объём контекста, и стоимость запроса.
Подробнее →
Эмбеддинг (векторное представление)
Числовой вектор, в который модель превращает текст так, что близкие по смыслу фразы оказываются рядом в пространстве. Эмбеддинги — основа семантического поиска и систем RAG.
Подробнее →
API
Интерфейс, через который ваша программа обращается к модели по сети: отправляет запрос и получает ответ в формате JSON. AI Gateway предоставляет OpenAI-совместимый API, поэтому подойдут привычные библиотеки и инструменты.
Подробнее →
API-ключ
Секретная строка, которой запрос удостоверяет ваш доступ к API. Ключи AI Gateway начинаются с sk-aigate-…, передаются в заголовке авторизации и не должны попадать в код клиента или публичные репозитории. Неверный ключ даёт ошибку 401.
Подробнее →
Base URL (базовый адрес API)
Адрес сервера, на который клиентская библиотека отправляет запросы. Чтобы использовать AI Gateway через привычные OpenAI-совместимые инструменты, достаточно указать base URL https://ai-gatewey.ru/v1 и свой ключ.
Подробнее →
ChatGPT
Чат-приложение от OpenAI для общения с моделями GPT через веб-интерфейс. Это готовый продукт для человека, а не API: для встраивания моделей в свои программы нужен именно доступ к API, а не аккаунт ChatGPT.
Подробнее →
Claude
Семейство языковых моделей от Anthropic, известное сильной работой с длинным текстом, кодом и рассуждениями. Доступно в каталоге под кодами вида anthropic/…, в том числе через Anthropic-совместимый маршрут.
Подробнее →
Completion (ответ модели)
Текст, который модель генерирует в ответ на промпт. В OpenAI-совместимом API запрос идёт на эндпоинт /v1/chat/completions, а сгенерированный ответ возвращается в поле сообщения вместе со статистикой по токенам.
Подробнее →
Few-shot (обучение на примерах)
Приём, при котором в промпт добавляют несколько примеров «запрос — правильный ответ», чтобы модель поняла нужный формат и стиль. В отличие от дообучения, примеры передаются прямо в запросе и ничего не меняют в самой модели.
Подробнее →
Function calling (вызов функций)
Возможность модели вернуть в структурированном виде запрос на вызов вашей функции с нужными аргументами: узнать погоду, найти запись в базе, посчитать. Модель не выполняет функцию сама, а сообщает, какую и с чем вызвать.
Подробнее →
Gemini
Семейство мультимодальных языковых моделей от Google, умеющих работать не только с текстом, но и с изображениями. Доступно в каталоге под кодами вида google/….
Подробнее →
GPT
Семейство языковых моделей от OpenAI (Generative Pre-trained Transformer). Одни из самых распространённых LLM, доступны в каталоге под кодами вида openai/…. На основе GPT работает и сервис ChatGPT.
Подробнее →
JSON-режим
Режим, в котором модель гарантированно возвращает ответ как корректный JSON, а не свободный текст. Удобно, когда результат сразу нужно разобрать в программе: извлечь поля, сохранить в базу, передать дальше.
Подробнее →
LLM (большая языковая модель)
Large Language Model — нейросеть, обученная на огромных объёмах текста и умеющая продолжать, писать и анализировать его. GPT, Claude и Gemini — это LLM. Через API вы отправляете модели запрос и получаете сгенерированный ответ.
Подробнее →
RAG (поиск с генерацией)
Retrieval-Augmented Generation — подход, при котором перед ответом система находит нужные фрагменты в вашей базе знаний и добавляет их в промпт. Так модель отвечает по вашим данным, не будучи на них обученной.
Подробнее →
Rate limit (ограничение частоты)
Ограничение на число запросов за интервал времени, чаще всего в минуту (RPM). Защищает сервис от перегрузки и распределяет нагрузку. При превышении API возвращает ошибку 429 — запрос стоит повторить чуть позже.
Подробнее →
Vision (распознавание изображений)
Способность модели принимать на вход изображение и рассуждать о нём: описать содержимое, прочитать текст с картинки, разобрать схему или таблицу. Изображение передаётся в запрос вместе с текстовым вопросом.
Подробнее →