🤯 НУЗ ИЗ НУЗ Tencent выложили Hy3 — флагмана на 295 млрд параметров, который уделывает модели в 2-5 раз крупнее 🥊 ▌ В чём магия? • Архитектура MoE: из 295 млрд параметров одновременно пашут только 21 млрд 🧠 • 192 эксперта, но на каждый запрос зовут только восьмерых — как в элитном клубе, где VIP-зона всегда открыта 🎟 • Контекст 256к токенов: модель помнит больше, чем ты деталей после вчерашней пьянки 🍻

▌ Факты без галлюциноза • Галлюцинации упали с 12.5% до 5.4%: ИИ больше не выдумывает факты с пеной у рта 🤥 • Бытовые ошибки сократились вдвое (с 25.4% до 12.7%) — наконец-то адекватный собеседник 🗣 • На тестах длинных диалогов (MRCR) результат взлетел с 42.9% до 75.1% — память как у слона 🐘

▌ Слепой тест на выживание → 270 экспертов сравнивали Hy3 с GLM-5.1 на реальных задачах 🥊 → Hy3 оторвалась на 2.67 балла против 2.51 у конкурента 🏆 → Топ-скиллы: фронтенд, CI/CD и обработка данных. На SWE-Bench разброс точности всего 4% — стабильность швейцарских часов ⌚️ 💥 ПОЧЕМУ ЭТО КРУТО? ▸ MoE — это новый чёрный Держишь в голове 295 млрд параметров, но тратишь ресурсы только на 21 млрд. Это как иметь штат из тысячи гениев, но платить зарплату только тем, кто реально работает прямо сейчас 💼⚡️

▸ Конец эпохи «ИИ-болтуна» Галлюцинации на уровне 5.4% — это статистическая погрешность. Модель больше не советует клеить обои на мокрую стену или пить отбеливатель 🧼🚫

▸ Контекст, который не течёт 256к токенов — это не просто цифра. Это значит, что на длинных многоходовых задачах модель не теряет нить разговора и не начинает спрашивать «а о чём мы вообще?» 🧵🧠

▸ Open-source без оговорок Apache 2.0 означает полную свободу. Никаких «только для некоммерческого использования» или скрытых пейволлов. Чистый бизнес без бюрократии 📜🤝 💼 КАК ИСПОЛЬЗОВАТЬ В БИЗНЕСЕ? ▸ Фронтенд-конвейер на стероидах Модель топит в вёрстке и компонентах. Скармливай ей макеты из Figma — она выдаст чистый код, а не набор тегов, от которого плачет браузер 🎨💻

▸ Автоматизация CI/CD Настройка пайплайнов, написание скриптов деплоя и поиск багов в логах. Hy3 разбирается в инфраструктуре лучше, чем сеньор-разработ в понедельник утром ⚙️🔧

▸ Обработка гигантских датасетов Контекст 256к позволяет закидывать в модель целые базы знаний, финансовые отчёты или логи за год. Она найдёт аномалии и свяжет факты без потери контекста 📊🔍

▸ Экономия на железе Благодаря MoE ты запускаешь гиганта на железе, которое обычно тянет только середнячков. Меньше GPU-ферм — больше чистой прибыли на счету 💰📉

▸ Агентные оркестрации Низкий уровень галлюцинаций делает Hy3 идеальным мозгом для автономных агентов. Она не придумывает несуществующие API и не ломает продакшен своими «креативными» решениями 🤖🛡

▸ Масштабирование без боли Бери open-source ядро, дообучай под свои узкие задачи и разворачивай на своих серверах. Полная независимость от чужих API и их внезапных ценников 🏗🚀 → Бонус: бесплатный API на OpenRouter целых две недели. Успей нажраться, пока не отключили 🍷 → Hy3 на HuggingFace ⏳⏳⏳⏳⏳⏳⏳⏳ 👩‍🍼 Это наш ИИ-Продавец 🫢 Маркетплейс ИИ-Менеджеров ▶️ Это наш Ютубчик #llm


В этом посте были ссылки, но мы их удалили по правилам Сетки

🤯 НУЗ ИЗ НУЗ
Tencent выложили Hy3 — флагмана на 295 млрд параметров, который уделывает модели в 2-5 раз крупнее 🥊
▌ В чём магия?
• Архитектура MoE: из 295 млрд параметров одновременно пашут только 21 ... | Сетка — социальная сеть от hh.ru