Короткие определения без академизма: ровно столько, чтобы понимать остальные
страницы вики. Термины идут не по алфавиту, а от общего к частному — так
читается подряд.
Модель (LLM) — большая языковая модель. Предсказывает продолжение текста;
всё остальное, включая код и рассуждения, — следствие этого. Не база знаний и
не калькулятор: она не «вспоминает», а порождает правдоподобное.
Токен — кусок текста, которым модель оперирует. Примерно 2–3 символа для
русского, 3–4 для английского и кода. В токенах считаются и длина контекста,
и цена.
Контекстное окно — сколько токенов модель видит за раз: ваш запрос,
история, файлы, вывод команд. Всё, чего в окне нет, для модели не существует.
Промпт — то, что вы отправили. Для кода это техническое
задание, а не заклинание.
Системный промпт — инструкции, которые задают поведение и подставляются
раньше вашего сообщения. Именно там живут правила инструмента, а не в вашем
чате.
Температура — насколько модель склонна выбирать менее вероятное
продолжение. Ниже — предсказуемее и суше, выше — разнообразнее и рискованнее.
Для кода обычно низкая.
Галлюцинация — уверенно выданная неправда: несуществующий метод,
выдуманный флаг, ссылка в никуда. Не сбой, а прямое следствие того, как
модель устроена. Лечится проверкой, а не уговорами.
Вайбкодинг — подход, при котором вы описываете
результат, а код пишет модель, и вы читаете не диф, а поведение.
Автодополнение — подсказки прямо в редакторе по ходу набора. Самый
неглубокий и самый безопасный способ: каждая строка проходит через ваши глаза.
Агент — модель с инструментами, работающая в цикле, пока
задача не сделана. Отличие от чата: вносит изменения сам.
Инструмент (tool) — функция, которую модель может вызвать: прочитать
файл, выполнить команду, сходить в сеть. Модель не «умеет» работать с файлами
— ей дали такой инструмент.
Вызов инструмента (tool call) — один шаг цикла: модель просит выполнить
действие и получает результат обратно в контекст.
Подагент — отдельная копия агента со своим чистым контекстом, которой
отдают кусок работы. Полезно, когда подзадача требует прочитать много
лишнего: мусор осядет в её окне, а не в вашем.
MCP — Model Context Protocol,
стандартный способ подключать модели свои инструменты и данные. Написали один
раз — работает во всех совместимых клиентах.
RAG — приём, при котором перед ответом в контекст подкладывают найденные
по запросу куски документов. Так модель отвечает по вашим данным, не будучи
на них обучена.
Эмбеддинг — представление текста числовым вектором; близкие по смыслу
тексты дают близкие векторы. На этом стоит семантический поиск и RAG.
Файл контекста проекта — CLAUDE.md, AGENTS.md, .cursorrules и
подобные: постоянные инструкции, которые инструмент
подхватывает сам в каждой сессии.
Компактизация — сжатие истории, когда контекст переполнился: старое
заменяется пересказом. Всегда что-то теряется.
Технический долг — код, который работает, но мешает менять систему
дальше. Вайбкодинг умеет производить его быстрее, чем вы успеваете читать.
Ревью — вычитывание изменений человеком. После появления агентов это
узкое место процесса, а не формальность.
Prompt injection — атака, при которой инструкции для модели прячут в
данных: в тексте страницы, в issue, в комментарии к коду. Агент читает их и
исполняет как ваши. Подробно — в
Безопасности.
Границы прав (sandbox) — что агенту разрешено трогать: каталог, сеть,
доступы. Единственная защита, которая работает без вашего внимания.
Детерминированность — свойство «одинаковый вход даёт одинаковый выход».
У моделей его нет. Поэтому «у меня получилось» не значит «получится ещё раз».