RAG: когда модель должна знать то, чего не знает
LLM обучена до определённой даты. Она не знает ваши внутренние документы. Она не знает, что случилось вчера. Retrieval-Augmented Generation решает это: перед генерацией система находит релевантные фрагменты из базы знаний и подаёт их в контекст. Модель видит контекст и вопрос — и отвечает, опираясь на конкретные документы, а не только на параметры. Это основной паттерн для production LLM-приложений.