📍Какие LLM модели для чего лучше подходят сейчас?
— такой задали мне вопрос
По моему практическому опыту, вот так:
- Sonnet => лучше всех пишет код, идеально держит контекст. Отлично пишет тексты и шутит. Подходит для создания ИИ-бота.
- Opus => неоправданно дорогой, всего на 20% лучше Sonnet. Контекст — до 200 тыс. токенов.
- Pro => вторая по силе написания кода. Хорошо подходит для архитектуры приложений, может быть тебе “другом”. Слабо пишет тексты.
- Flash => всё то же, но на 40% хуже, зато одна из самых быстрых моделей. Подходит для ИИ-звонаря. Контекст — до 1 млн токенов.
- 4.5 => очень хорошо пишет тексты, креативен, но шутит хуже Claude. Очень человечный и эмпатичный.
- 4.1 => отлично структурирует посты, очень логичен, неплохо пишет код. Идеально держит промпт — хорошо подходит для ИИ-ботов.
- 4.1 mini / nano => если нужна оптимизация цены общения для ИИ-бота или простые задачи (например, определение темы диалога, саммари и др.). Работают заметно быстрее обычного 4.1.
- 4o => хорош тем, что видит/создаёт картинки. Контекст — до 1 млн токенов.
- o3 => подходит для сложных логических задач, планирования архитектуры приложений (хотя мне Gemini нравится больше), отлично для аналитики.
- o4-mini => если нужно быстро что-то посчитать математически.
- o4-mini-high => подходит для написания кода, но уступает Gemini и Claude. Зато лучше чем gpt-4o работает с картинками. Контекст — до 200 тыс. токенов.
- R1 => устарел, но по-прежнему самая дешёвая “размышляющая” модель. Хорош для аналитики, например звонков. Можно развернуть на своём сервере.
- V3 => на уровне 4.1 mini, только дешевле. Также можно использовать для ИИ-ботов, разворачивать у себя на сервере/облаке. Контекст — до 64 тыс. токенов.
- 3 => создавался для кода, но сейчас устарел, уступает вышеперечисленным. Есть режим fast — ускорение примерно в 2 раза. Бесплатный в x.ai и на grok.com
- 3-mini => также размышляющий, уступает многим моделям выше, но дешёвый и есть режим fast. Контекст — до 131 тыс. токенов.
- max => примерно на уровне 4.1 mini, но лучше работает с русским языком. Ребята активно развиваются: за 3 года снизили цену в 9 раз, но всё ещё в 2 раза дороже, чем на Западе. Однако молодцы — в условиях санкций это круто. Также умеет распознавать изображения, генерировать их, распознавать голос без дополнительных затрат.
- pro/lite => примерно на 30%/60% слабее max. Контекст — до 128 тыс. токенов.
- Pro => умеет рассуждать, но по ощущениям не лучше 4.1 mini или o4-mini, зато заточена под конкретные бизнес-области РФ.
- Lite => слабенькая, но зато open-source и её можно дообучить под себя. Контекст — до 32 тыс. токенов.
Ещё есть Qwen 2.5 (примерно как Deepseek, но не open-source), LLaMA 4 (open-source, можно дообучать), Mistral (примерно на уровне Deepseek, иногда использую его), Cohere (ориентирована на B2B, есть спец. модели типа реранкеров), Perplexity (заточена на поиск) и многие другие, в основном open-source.
Если у вас тоже наблюдения, поделитесь, будет ценно 🙏🏻
мой канал: https://t.me/oh_my_zen