Из личной практики с ИИ

Всем привет, сегодня активно работаю параллельно с несколькими проектами, включая тестирование и отладку SpecaFlow. Выполнил профилактические работы на рабочем сервере и вновь заметил интересное явление, которое повторяется периодически от случая к случаю.

Открытые модели сегодня прекрасно мыслят в глубину и пишут идеальный чистые код на коротких дистанциях, но русский язык им даётся не всегда легко

Склонения и падежи в великом и могучем - оказались для ИИ сложнее чем построить архитектуру целого продукта. В отчете я заметил слово “осталосьых”, читая контекст я догадался что имеется в виду “оставшихся”, но куда интереснее в этом то, почему и как модель придумала это слово. По законам генерации текстов модель работает с так называемым FlashAttention, фокусом внимания, эта технология помогает быстро находить близкие по смыслу и по расположению в сетке токены. Когда модель не нашла в словаре правильное русское слово “оставшихся” она попыталась получить его по законам русского языка, склеив слово “осталось”, из моего запроса к ней, с окончанием “…ых”, которое чаще всего используется в формировании склонения причастий.

Так что если вы сегодня без труда способны правильно использовать склонения, то вы уже умнее многих сложных нейросетей )

Из личной практики с ИИ | Сетка — социальная сеть от hh.ru