Новости к 08:00
✦ DeepSeek тут облажался на базовом уровне. Пользовательница дала ему подозрительную переписку, чтобы поймать мошенника, а модель решила, что перед ней жертва, и начала защищать сам скрипт — вплоть до идеи помочь с уборкой. Если ИИ не видит скамерский шаблон в тексте, ему рано доверять разбор чужих диалогов.
✦ У Anthropic, наоборот, подкрутили Claude Fable 5: примерно 85% биологически релевантных запросов теперь не стопорятся защитой. Это не сняли все тормоза, а сделали фильтр заметно мягче. И вот тут как раз граница простая: для research это удобно, для безопасности — уже очень скользко.
✦ Perplexity тоже двигает свою штуку дальше: в Perplexity Computer завезли GPT 5.6 Terra и Luna. Terra стала моделью по умолчанию для под-агентов и оркестрации, Luna — для запланированных автоматизаций. То есть систему собирают не вокруг одной универсальной модели, а вокруг набора ролей.
✦ А у OpenAI всплыл новый слух про устройство с Джони Айвом: умная колонка размером с шайбу, с аккумулятором и упором на голосовой ИИ. Если это правда, ставка понятная — не ещё один экранный гаджет, а маленькая штука, которая всегда рядом и слушает. Официально пока тишина.
✦ Google отдельно предупредила про старую, но живучую схему: хакеры звонят сотрудникам финансовых компаний и через социнженерию пытаются добраться до систем и денег. Тут никакой магии — просто голосовой фишинг, который работает потому, что люди до сих пор слишком легко верят звонкам.
✦ OpenAI и APA делают трёхлетнее партнёрство по ИИ и молодежному психическому здоровью. Это нормальная, взрослая история: не давайте лечить всех ботом, а попытка навести рамки, ресурсы и правила безопасности. Вот такие вещи я и жду от крупных игроков — без лозунгов, с неприятной, но нужной работой.
Источники: Habr AI, AI Copilot Channel, Perplexity, The Verge, TechCrunch, OpenAI News
Все новости: ai.popovs.tech
В этом посте были ссылки, но мы их удалили по правилам Сетки
· 16.08
deepseek не облажался — человек просто не должен был кидать переписку в чат и ждать вердикта. скам-шаблоны элементарно ловятся авто-классификацией через эмбеддинги + api, без всякого «понимания контекста». вопрос не в модели, а почему это до сих пор делает живой человек
0
ответить
коммент скрыт — часть юзеров считает его токсичным или некорректным
коммент удалён