Ликбез. Как работает ИИ.
ИИ мало кто пытается его объяснить простои это создает огромное количество предрассудков и теорий заговора. Но чем подробнее люди пытаются объяснить, как он работает, тем больше начинает казаться, что они просто пудрят нам мозг. Основной принцип ИИ же очень прост: он продолжает текст.
Допустим, пользователь написал: «мама мыла».
Модель оценивает, что может идти дальше. «Раму» - очень вероятный вариант. Фраза из букваря растиражирована примерно везде, поэтому такое продолжение встречалось ей огромное количество раз. «Пол» - тоже вполне разумно: мамы существуют, полы существуют, люди их моют и регулярно пишут об этом. «Межконтинентальную баллистическую ракету» выглядит значительно хуже, но полностью исключить тоже нельзя, мало ли что там обсуждали любители Вархаммера на своих форумах.
Дальше модель выбирает подходящее продолжение и задача повторяется. Теперь у нее есть уже не «мама мыла», а, например, «мама мыла пол», и нужно решить, что поставить дальше. Потом еще раз. И еще. Так, небольшими продолжениями, постепенно возникает весь ответ.
Есть еще одна важная деталь. ИИ смотрит не только на запрос. Если перед «мама мыла» пользователь спрашивал, почему хлорка так пахнет, и этот разговор еще находится в доступной модели части переписки, ситуация меняется. Теперь рядом оказываются хлорка, запах и «мама мыла». «Раму» никуда не исчезла и по-прежнему остается очень известным продолжением, но «пол» уже выглядит гораздо уместнее. Предыдущий разговор изменил то, какое продолжение лучше подходит сейчас.
Пример очень простой, но примерно так же строится и ответ на гораздо более сложный вопрос. Только вместо выбора между рамой, полом и ракетой модель учитывает огромное количество связей между словами и понятиями. Каждая новая часть текста немного меняет то, какие продолжения лучше подходят ко всему написанному до этого. Поэтому после описания производственной проблемы она может предложить причины, после куска программы - найти ошибку, а после вопроса по истории - рассказать, что происходило несколько веков назад. Но основной принцип остается тем же: исходя из уже написанного определить, что разумнее написать дальше.
Отсюда становится понятна и одна из главных проблем ИИ. У него нет обязательного этапа «сначала убедись, что это правда». Если правильное продолжение хорошо следует из вопроса, предыдущего разговора и того, чему модель научилась, она даст правильный ответ. Если знаний не хватает, задача никуда не исчезает: ей все равно нужно решить, что написать дальше. Поэтому иногда она может совершенно уверенно продолжить текст выдуманным фактом. У нее нет встроенного требования отличать правдоподобное утверждение от истинного. Собственно, люди тоже периодически могут специально или не очень нести чушь.
Именно поэтому фраза «ИИ просто продолжает текст» одновременно верна и сильно преуменьшает происходящее. Мы взяли огромное количество человеческих текстов и научили машину находить в них связи настолько хорошо, чтобы продолжать почти любой начатый текст.
А поскольку в текстах люди объясняют, спорят, сравнивают, ищут причины, пишут программы и решают задачи, машина научилась продолжать и это. Не потому, что ее отдельно учили программировать, рассуждать или объяснять историю. Все это оказалось частными случаями одной и той же задачи: понять написанное до этого и подобрать подходящее продолжение.
Продолжение следует.