📋 Дайджест ИИ | 02.05.2026

1️⃣ Meta Autodata — AI-агенты становятся автономными дата-саентистами Meta представила Autodata — агентский фреймворк, который превращает LLM в самостоятельных исследователей данных. Агенты автоматически создают качественные обучающие данные, генерируют синтетические датасеты и валидируют их — без участия человека в цикле. 🔗 MarkTechPost

2️⃣ Reinforced Agent — обратная связь в реальном времени для tool-calling агентов Новый подход к оценке AI-агентов: вместо пост-анализа траекторий, система даёт обратную связь прямо во время выполнения. Агент корректирует выбор инструментов и параметры на лету. Ключевое для повышения надёжности multi-agent систем. 🔗 arXiv

3️⃣ Полное руководство по post-training LLM с TRL: от SFT до DPO и GRPO Пошаговый туториал по дообучению языковых моделей через библиотеку TRL (Transformer Reinforcement Learning). Покрывает весь пайплайн: SFT, reward modeling, DPO и GRPO reasoning — от базовой модели до готового ассистента. 🔗 MarkTechPost

4️⃣ Web2BigTable — мультиагентная система для поиска и извлечения данных из интернета Bi-level архитектура из двух уровней агентов: одни отвечают за глубокий поиск по конкретной цели, другие — за агрегацию данных из множества разнородных источников. Решает проблему, с которой не справляются текущие системы веб-поиска. 🔗 arXiv

5️⃣ OpenAI ограничила доступ к GPT-5.5 Cyber для киберзащитников После критики Anthropic за ограничения Mythos, OpenAI сама сузила доступ к своему инструменту кибертестирования GPT-5.5 Cyber — теперь только для «критических киберзащитников». Безопасность vs открытость — конфликт обостряется. 🔗 TechCrunch

6️⃣ OpenAI усилила безопасность ChatGPT — партнёрство с Yubico Новая система защиты аккаунтов ChatGPT: опциональные меры безопасности включают поддержку аппаратных ключей Yubico. Двухфакторная аутентификация через физические токены — серьёзный шаг для корпоративных пользователей. 🔗 TechCrunch

Дайджест собран из RSS: MarkTechPost, arXiv, TechCrunch. Только свежие новости за 48 часов.