Fine-tuning: как научить LLM новым трюкам без полного переобучения
GPT-4 умеет многое, но не знает ваши внутренние процессы. BERT не понимает медицинскую терминологию вашей клиники. Fine-tuning адаптирует предобученную модель под конкретную задачу или домен. Полное fine-tuning — дорого: для LLaMA-7B нужно несколько A100. LoRA решает это элегантно: заморозить 99% весов и обучать только две маленькие матрицы. Качество почти как у full fine-tuning, память — в 10–50 раз меньше.