Генеративное моделирование вознаграждений (GRM)

🔥 Китайская компания DeepSeek совместно с учёными из Университета Цинхуа разработала новую методику улучшения способности больших языковых моделей рассуждать подобно человеку 🌐

Подход объединяет два метода — генеративное моделирование вознаграждений (GRM) и самонастраивающуюся критику. Новая методика позволяет языковой модели быстрее и точнее отвечать на общие запросы пользователей, приближаясь к предпочтениям человека. Тесты показали значительное улучшение производительности моделей, достигнув уровня лучших открытых аналогов. Компания планирует сделать свою разработку открытой, хотя пока конкретных сроков не называла.

Почему это важно?

  • Уже в апреле ожидается релиз новой версии популярной модели DeepSeek-R2, обещающей революционные изменения в области обработки естественного языка (Reuters).
  • Новость вызвала значительный интерес среди экспертов отрасли и разработчиков, поскольку китайская индустрия стремительно догоняет мировых лидеров в сфере искусственного интеллекта.

Следите за новостями! 😉 #ИскусственныйИнтеллект #ИИ #BigData

https://t.me/semasci

Генеративное моделирование вознаграждений (GRM)
🔥 Китайская компания DeepSeek совместно с учёными из Университета Цинхуа разработала новую методику улучшения способности больших языковых моделей рассу... | Сетка — социальная сеть от hh.ru