Японские ученые выяснили, что роботы учат язык быстрее, если их поощрять за любопытство, а не просто за правильные ответы.
Виртуальные роботы с такой системой справлялись с заданиями вдвое быстрее обычных. Даже выучив команды, роботы продолжали экспериментировать — например, толкали предметы без инструкции. Также они повторили детскую «U-образную» кривую: сначала правильно усваивали исключения, потом ошибались после изучения общих правил, а затем снова исправлялись — хотя этого специально не программировали.
Ключевым условием успеха оказалось разнообразие: при 48 языковых комбинациях роботы понимали новые команды лишь на 25%, а при 180 — уже на 85%. Исследователи подчеркивают, что их модель прозрачна и позволяет наблюдать, как именно робот принимает решения.