Key terms explained in plain language and in the context of practice.
Программа, которая в цикле спрашивает у модели следующий шаг, сама вызывает инструменты и складывает результаты обратно в контекст, пока задача не закрыта.
Схема, при которой перед ответом система ищет подходящие куски документов и подкладывает их в промпт, чтобы модель отвечала по вашим данным.
Максимальный объём текста в токенах, который модель удерживает за один запрос: системный промпт, история диалога, подтянутые файлы и место под ответ.
Кусок текста, которым модель меряет вход и выход: обычно часть слова. В токенах считают и лимит контекста, и счёт от провайдера.