Кажется, мы неправильно представляли себе будущее ИИ-агентов.
Не одна огромная модель будет думать над каждым чихом. Скорее наоборот: дорогую LLM будут звать только туда, где действительно нужно думать, а сотни мелких решений отдадут быстрым специализированным моделям.
И Jev уже начинают проверять именно в таких сценариях.
Например, ему дали Minecraft. Каждые ~600 мс модель получает состояние мира: здоровье, голод, врагов рядом, позицию и текущую цель — и решает, что делать дальше: драться, убегать, есть или продолжать задачу. Причём несколько таких решений она принимает параллельно за один вызов.
Есть похожие эксперименты с Doom: вместо длинных рассуждений модель несколько раз в секунду выбирает буквально одно действие - влево, вправо, стрелять, искать аптечку. Это уже гораздо ближе к реальному управлению системой, где ответ нужен сейчас, а не через 10 секунд после красивого chain-of-thought.
Появились и браузерные агенты, Minecraft-моды, шахматы, 2048, NPC и даже футбольный матч, где каждый из 22 игроков управляется отдельным Jev.
И вот тут идея становится понятнее.
Большая LLM может сказать: «Нужно добыть ресурсы, построить укрытие и пережить ночь».
А дальше Jev сотни раз решает: бежать или драться? есть сейчас или потом? куда повернуть? продолжать цель или реагировать на угрозу?
То есть архитектура постепенно становится такой: LLM планирует → Jev принимает быстрые локальные решения → обычный код исполняет.
И мне кажется, именно это сейчас самое интересное в Jev. Своего рода попытка сделать рефлексы для ИИ-агентов.