😈Нейросети могут сжимать текст с помощью мата

Учёные из нашего вуза, Института AIRI и НИУ ВШЭ выяснили, что большие языковые модели могут сокращать русскоязычные тексты, используя нецензурную лексику как инструмент сжатия, — и почти без потери смысла.

В основе — лингвистический феномен: в живой речи одно такое слово часто заменяет целую фразу, выступая «сверхплотной упаковкой» смысла. Исследователи применили этот эффект для семантического сжатия текстов.

Главная цель — не научить ИИ ругаться, а улучшить алгоритмы сжатия. Рабочая модель не использует нецензурную лексику при обработке обычных текстов.

Исследование представлено на конференции AAAI в Сингапуре (А*).


В этом посте были ссылки, но мы их удалили по правилам Сетки

😈Нейросети могут сжимать текст с помощью мата
Учёные из нашего вуза, Института AIRI и НИУ ВШЭ выяснили, что большие языковые модели могут сокращать русскоязычные тексты, используя нецензурную лексику ... | Сетка — социальная сеть от hh.ru