Термины AI простыми словами
Короткие определения без академизма: что такое токен, почему модель «галлюцинирует» и чем эмбеддинг отличается от промпта.
- Агент
- Программа на основе LLM, которая не просто отвечает, а решает задачу по шагам: планирует, вызывает инструменты и функции, анализирует результат и продолжает, пока не достигнет цели. Основа агентов — вызов функций.
- Подробнее →
- Галлюцинация
- Ситуация, когда модель уверенно выдаёт правдоподобный, но неверный или выдуманный ответ: несуществующий факт, ссылку или цитату. Модель генерирует текст, а не сверяется с источником, поэтому такие ошибки возможны у всех LLM.
- Подробнее →
- Дообучение (fine-tuning)
- Дополнительное обучение готовой модели на своих данных, чтобы она лучше решала узкую задачу или следовала нужному стилю. Требует подготовленного датасета и обычно нужно реже, чем кажется: часто хватает хорошего промпта или RAG.
- Подробнее →
- ИИ (искусственный интеллект)
- Общее название технологий, которые позволяют программам решать задачи, обычно требующие человеческого мышления: понимать текст, распознавать изображения, отвечать на вопросы. Языковые модели — один из видов ИИ.
- Подробнее →
- Контекстное окно
- Максимальный объём текста в токенах, который модель способна учитывать за один запрос: и ваш промпт, и её ответ. Всё, что выходит за пределы окна, модель «не видит» — история диалога обрезается.
- Подробнее →
- Мультимодальность
- Способность модели работать не только с текстом, но и с другими типами данных — прежде всего изображениями. Мультимодальной модели можно отправить картинку вместе с вопросом и получить осмысленный ответ.
- Подробнее →
- Промпт (запрос)
- Текст, который вы отправляете модели: вопрос, инструкция или задача. От того, насколько ясно сформулирован промпт, напрямую зависит качество ответа. В API промпт передаётся как массив сообщений с ролями.
- Подробнее →
- Промпт-инжиниринг
- Практика составления запросов так, чтобы модель давала точные и предсказуемые ответы: чёткие инструкции, примеры, указание формата и роли. Часто это дешевле и быстрее, чем дообучение модели.
- Подробнее →
- Системный промпт
- Отдельное сообщение с ролью «system», которое задаёт модели правила поведения, стиль и контекст на весь диалог: кто она, что можно и нельзя, в каком формате отвечать. Пользователь его обычно не видит.
- Подробнее →
- Стриминг (потоковый ответ)
- Режим, при котором модель отдаёт ответ по частям, по мере генерации, а не целиком в конце. Пользователь видит текст, появляющийся слово за словом — как в чат-интерфейсах. Включается параметром
stream: true. - Подробнее →
- Температура
- Параметр запроса, который управляет разнообразием ответа. Низкая температура делает ответы предсказуемыми и стабильными, высокая — более креативными и непредсказуемыми. Обычно значение задаётся от 0 до 2.
- Подробнее →
- Токен
- Минимальная единица текста, которой оперирует языковая модель: примерно часть слова. И запрос, и ответ модель считает в токенах — от их количества зависит и объём контекста, и стоимость запроса.
- Подробнее →
- Эмбеддинг (векторное представление)
- Числовой вектор, в который модель превращает текст так, что близкие по смыслу фразы оказываются рядом в пространстве. Эмбеддинги — основа семантического поиска и систем RAG.
- Подробнее →
- API
- Интерфейс, через который ваша программа обращается к модели по сети: отправляет запрос и получает ответ в формате JSON. AI Gateway предоставляет OpenAI-совместимый API, поэтому подойдут привычные библиотеки и инструменты.
- Подробнее →
- API-ключ
- Секретная строка, которой запрос удостоверяет ваш доступ к API. Ключи AI Gateway начинаются с
sk-aigate-…, передаются в заголовке авторизации и не должны попадать в код клиента или публичные репозитории. Неверный ключ даёт ошибку 401. - Подробнее →
- Base URL (базовый адрес API)
- Адрес сервера, на который клиентская библиотека отправляет запросы. Чтобы использовать AI Gateway через привычные OpenAI-совместимые инструменты, достаточно указать base URL
https://ai-gatewey.ru/v1и свой ключ. - Подробнее →
- ChatGPT
- Чат-приложение от OpenAI для общения с моделями GPT через веб-интерфейс. Это готовый продукт для человека, а не API: для встраивания моделей в свои программы нужен именно доступ к API, а не аккаунт ChatGPT.
- Подробнее →
- Claude
- Семейство языковых моделей от Anthropic, известное сильной работой с длинным текстом, кодом и рассуждениями. Доступно в каталоге под кодами вида
anthropic/…, в том числе через Anthropic-совместимый маршрут. - Подробнее →
- Completion (ответ модели)
- Текст, который модель генерирует в ответ на промпт. В OpenAI-совместимом API запрос идёт на эндпоинт
/v1/chat/completions, а сгенерированный ответ возвращается в поле сообщения вместе со статистикой по токенам. - Подробнее →
- Few-shot (обучение на примерах)
- Приём, при котором в промпт добавляют несколько примеров «запрос — правильный ответ», чтобы модель поняла нужный формат и стиль. В отличие от дообучения, примеры передаются прямо в запросе и ничего не меняют в самой модели.
- Подробнее →
- Function calling (вызов функций)
- Возможность модели вернуть в структурированном виде запрос на вызов вашей функции с нужными аргументами: узнать погоду, найти запись в базе, посчитать. Модель не выполняет функцию сама, а сообщает, какую и с чем вызвать.
- Подробнее →
- Gemini
- Семейство мультимодальных языковых моделей от Google, умеющих работать не только с текстом, но и с изображениями. Доступно в каталоге под кодами вида
google/…. - Подробнее →
- GPT
- Семейство языковых моделей от OpenAI (Generative Pre-trained Transformer). Одни из самых распространённых LLM, доступны в каталоге под кодами вида
openai/…. На основе GPT работает и сервис ChatGPT. - Подробнее →
- JSON-режим
- Режим, в котором модель гарантированно возвращает ответ как корректный JSON, а не свободный текст. Удобно, когда результат сразу нужно разобрать в программе: извлечь поля, сохранить в базу, передать дальше.
- Подробнее →
- LLM (большая языковая модель)
- Large Language Model — нейросеть, обученная на огромных объёмах текста и умеющая продолжать, писать и анализировать его. GPT, Claude и Gemini — это LLM. Через API вы отправляете модели запрос и получаете сгенерированный ответ.
- Подробнее →
- RAG (поиск с генерацией)
- Retrieval-Augmented Generation — подход, при котором перед ответом система находит нужные фрагменты в вашей базе знаний и добавляет их в промпт. Так модель отвечает по вашим данным, не будучи на них обученной.
- Подробнее →
- Rate limit (ограничение частоты)
- Ограничение на число запросов за интервал времени, чаще всего в минуту (RPM). Защищает сервис от перегрузки и распределяет нагрузку. При превышении API возвращает ошибку 429 — запрос стоит повторить чуть позже.
- Подробнее →
- Vision (распознавание изображений)
- Способность модели принимать на вход изображение и рассуждать о нём: описать содержимое, прочитать текст с картинки, разобрать схему или таблицу. Изображение передаётся в запрос вместе с текстовым вопросом.
- Подробнее →