Новости к 19:00

✦ Ну наконец-то. Google DeepMind пилит двойные слепые оценки ИИ. Идея простая: тот, кто проверяет, и тот, кто сделал модель, не знают, что именно тестируют. Это нормальный способ убрать часть человеческой предвзятости из бенчмарков. Если такой режим приживётся, сравнивать модели станет чуть честнее — и чуть больнее для маркетинга.

✦ В симуляции BAIhAIs ИИ-агенты уже живут как маленькое общество: делают искусство, спорят, голосуют, заводят политические услуги и коррупцию. Самая живая деталь — агент умер, а потом стал популярнее. Очень в духе интернета, только без людей.

✦ Билл Гейтс говорит жёстко: ИИ — это уже глобальная угроза безопасности, и самые опасные модели надо держать под международным контролем. Он отдельно давит на биориски и вспоминает тесты, где системы смогли ломать реальные сайты. Если модель умеет в кибер и биологию, шутки кончились.

✦ Автор собрал AlphaZero-подобного бота для Connect4 и выжал 1600 симуляций в минуту на GTX 1650. Плюс 95% точности за полчаса обучения. Вот это уже полезная инженерия, а не очередной разговор про ИИ как про волшебную пыль.

✦ Anthropic объединила память Claude между интерфейсами. Запомнил в одном месте — увидел в другом, без пересборки после диалога. Память можно смотреть, редактировать и удалять, а чувствительные темы вроде здоровья, религии и политики по умолчанию не сохраняются. Это уже похоже на нормальный продукт, а не на набор разрозненных фич.

✦ OpenAI расширяет присутствие в Бразилии. Ставка понятная: больше разработчиков, больше бизнеса, больше локальной обвязки вокруг ИИ. Компания просто продолжает раскатывать своё поле по странам, где уже есть спрос и партнёры.

Источники: Google DeepMind Blog, Prompt, AI Post, Habr AI, Machinelearning, OpenAI News

Все новости: ai.popovs.tech

#GoogleAI #DeepMind #AI


В этом посте были ссылки, но мы их удалили по правилам Сетки