Эксперементы с локальными моделями?
Кол-во параметров на модель. 0.1B-1B параметров: Игрушечные модели, плохо понимают контекст
3B-7B: Работают как "умный поисковик", шаблонные ответы, часто ошибаются в логике
13B-20B: Первый прорыв в "понимании", могут рассуждать, качество ~GPT-3.5 в лучших проявлениях
30B-40B: Стабильно хорошие, близко к ранним версиям ChatGPT
70B: Качественный скачок, сравнимо с GPT-4 в некоторых задачах
400B+ (GPT-4, Claude 3 Opus): Качественный скачок в рассуждениях, понимании нюансов