Генеративное моделирование вознаграждений (GRM)
🔥 Китайская компания DeepSeek совместно с учёными из Университета Цинхуа разработала новую методику улучшения способности больших языковых моделей рассуждать подобно человеку 🌐
Подход объединяет два метода — генеративное моделирование вознаграждений (GRM) и самонастраивающуюся критику. Новая методика позволяет языковой модели быстрее и точнее отвечать на общие запросы пользователей, приближаясь к предпочтениям человека. Тесты показали значительное улучшение производительности моделей, достигнув уровня лучших открытых аналогов. Компания планирует сделать свою разработку открытой, хотя пока конкретных сроков не называла.
Почему это важно?
- Уже в апреле ожидается релиз новой версии популярной модели DeepSeek-R2, обещающей революционные изменения в области обработки естественного языка (Reuters).
- Новость вызвала значительный интерес среди экспертов отрасли и разработчиков, поскольку китайская индустрия стремительно догоняет мировых лидеров в сфере искусственного интеллекта.
Следите за новостями! 😉 #ИскусственныйИнтеллект #ИИ #BigData