Вчера вышло видео с Ильей Суцкевером. Кому лень смотреть, вот основные тезисы:

Парадокс ИИ: Бенчмарки – все выше и выше, а в реальной жизни – практически никаких изменений. Модели в эвалах рвут всех, инвестиции огромные, но влияние на экономику пока едва заметно.

Беда с обобщением: RL-тренировка моделей скорее всего делает их узконаправленными, фокусируясь на чем то одном. Похоже на студентов, которые зубрят 10 000 часов для одного экзамена, но не могут применить знания за его пределами. Так же видимо исследователи натаскивают модель на бенчмарках, отсюда результаты лучше, но в реальных задачах сильная модель не может подправить простой баг.

Доказательство необходимости эмоций: Суцкевер рассказал про один широкоизвестный случай из нейробиологии, когда человек получил травму мозга, которая вывела из строя часть мозга, ответственную за эмоции. Он всё еще мог решать головоломки и проходить тесты, но стал чрезвычайно плох в принятии любых решений. Например, ему требовались часы, чтобы решить, какие надеть носки. Это свидетельствует о том, что эмоции действуют как «что-то вроде функции ценности» (value function-like thing), которая сообщает агенту, каким должно быть вознаграждение за любое решение.

Смена эпохи: От скейлинга к ресёрчу. Эпоха "больше данных + больше мощностей = win" (2020–2025) на исходе, данные не бесконечные. Теперь наступает эпоха исследований, где компаниям придется тратить вычисления с умом, а не просто жрать их тоннами в надежде, что что-то получится.

AGI: Скорее всего нас ждёт не "всезнающий компьютер", а модель, способная очень быстро обучаться делать разную работу.

🔛 @kisel_it

#ai@kisel_it #it@kisel_it