Хорошая статья про computer-use агентов на базе LLM от @wrapper228 тут
• Формально LLM уже можно использовать как инструмент управления компьютером — не просто как чат, а для выполнения задач end-to-end: открыть браузер, найти данные, изменить файл и т.д. (это уже не просто генератор текста) • Как итог - guardrails и ограничения среды становятся критичнее, чем очередное дообучение моделей. Из-за сложности задачи, наверное, снова проявляется забытый reward hacking - агент может формально выполнить цель
Очень интересно, но ждем что смогут сделать в будущем: пока дорого и не дорабатывает