DeepSeek уже третий день работает нестабильно и в нём находят дыры в безопасности.
Что ещё можно попробовать?
1️⃣ Пару дней назад китайцы (Alibaba) обновили другую модельку — Qwen-2.5 Max. Очень во многих источниках (некомпетентных) писали, что она "убила DeepSeek", но это, мягко сказать, не так. Моделька закрытая, без цепочки рассуждений, в задачах написания кода по собственным бенчмаркам разработчиков (всегда в первую очередь нужно смотреть внешние бенчмарки, собственные бывают не очень объективные) находится примерно на уровне DeepSeek V3 (но не R1!), а API очень сильно дороже. Но чат бесплатный, без дискриминации по гео, что тоже хорошо.
2️⃣ Разворачивать DeepSeek R1 локально очень накладно. А что менее накладно? Развернуть дистилированную DeepSeek R1! Скачиваем LM Studio с официального сайта, там выбираем Qwen 7B или LLama 8B. Рекомендуется иметь 16gb RAM, но люди и на 8 успешно запускали. Это, конечно, далеко не полноценная R1 и качество будет хуже, но для локального не очень тяжелого варианта — вполне себе.