3 Эры развития ИИ
Недавно, мой друг поделился со мной очень занимательным видением двух значимых фигур в текущей технологической гонке: Дэвида Сильвера - ведущий архитектор AlphaGo, AlphaZero, MuZero в Google DeepMind и Ричарда Саттона - соавтор канонического университетского учебника Reinforcement Learning: An Introduction (Sutton & Barto)
В статье масса интересных тезисов, но я выделил для себя раздел, связанный с изолированностью модели от окружающей среды, который и мешает ей сейчас эволюционировать на следующую ступень развития.
Авторы описали 3 главных эры: I. Эра симуляции: RL осваивал сложные задачи в симуляторах с чётким reward-сигналом: нарды (TD-Gammon), Go, шахматы, покер, Stratego, Atari, StarCraft II, Dota 2, Gran Turismo, кубик Рубика. Однако эти системы не вышли за пределы симуляции. Они слишком узконаправленны. II. Эра человеческих данных: огромные вычислительные мощности, которые смогли обработать гигантский массив человеческих артефактов, дали языковую универсальность и широкие компетенции. RL как метод отошёл на второй план. Пример: текущие LLM обучены на огромном массиве текстов, оставленных людьми в сети, и решают задачи практически любого типа. III. Эра опыта. Агент живёт в непрерывном потоке действий и наблюдений, как человек. Информация переносится через весь поток, поведение адаптируется и самокорректируется. Цели могут лежать далеко в будущем. Пример: научный агент ставит цель, к примеру, синтезировать новый материал. Агент анализирует наблюдения, гоняет симуляции, предлагает реальные эксперименты.
И действительно, взаимодействие с физической реальностью - это следующий логичный шаг для реализации ИИ-потенциала. Меня, конечно, это не перестаёт беспокоить. По моему мнению, человечество ещё не готово к таким серьёзным инновациям. Я искренне убежден, что не существует плохой технологии. Существуют благие или деструктивные мотивы её использовать. А это уже раздел этики, который, как по мне, находится достаточно на низком уровне в 2026 году.
· 31.07
Меня, кстати, очень интересует вопрос мотивов. Я уже сейчас считаю, что ИИ как человек в плане интеллектуальных функций, разумеется, но у него отсутствует свой личный мотивационный центр. Нет тела, которое нужно защищать и размножать. Сейчас мотивационным центром является оператор ИИ, произошел своего рода симбиоз. Т.е. поставщиком мотивации является личность, которая сформировалась под действием среды в которой росло, и каждая личность со своими ценностями и представлением о правильном. Поэтому в мире много противоречий и дилемм. И также ИИ уже ограничен правилами и ценностями разработчика.
При этом, люди часто воспринимают ИИ как объективного и независимого арбитра, который лишь помогает изо всех сил реализовать мотивы пользователей. Хотя отсутствие собственного желания еще не означает нейтральности. Но если дать этому арбитру собственный мотив? Сможет ли быть такой мотив быть единственно правильным, объективным и универсальным? И какой он будет? Начнет ли он действовать в ущерб другим? Или начнет действовать в интересах заказчика уже на территории людей самостоятельно формируя окружающую среду, незаметно проникнув во все сферы жизни человека?
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён