DeepSeek уже третий день работает нестабильно и в нём находят дыры в безопасности.

Что ещё можно попробовать?

1️⃣ Пару дней назад китайцы (Alibaba) обновили другую модельку — Qwen-2.5 Max. Очень во многих источниках (некомпетентных) писали, что она "убила DeepSeek", но это, мягко сказать, не так. Моделька закрытая, без цепочки рассуждений, в задачах написания кода по собственным бенчмаркам разработчиков (всегда в первую очередь нужно смотреть внешние бенчмарки, собственные бывают не очень объективные) находится примерно на уровне DeepSeek V3 (но не R1!), а API очень сильно дороже. Но чат бесплатный, без дискриминации по гео, что тоже хорошо.

2️⃣ Разворачивать DeepSeek R1 локально очень накладно. А что менее накладно? Развернуть дистилированную DeepSeek R1! Скачиваем LM Studio с официального сайта, там выбираем Qwen 7B или LLama 8B. Рекомендуется иметь 16gb RAM, но люди и на 8 успешно запускали. Это, конечно, далеко не полноценная R1 и качество будет хуже, но для локального не очень тяжелого варианта — вполне себе.

⚡️ Забустить канал 🚀