Новости к 08:00

✦ Nvidia выложила Nemotron-3. И тут всё приземлённо: это не ещё одна большая модель, а эмбеддинги для поиска и RAG. Старшая 8B-версия держит 34 языка и контекст до 32k токенов, младшая 1B — дешевле и компактнее. Есть и NVFP4-версия под Blackwell, где Nvidia обещает почти BF16-качество при большей пропускной способности.

✦ Пять мозговых имплантов вернули парализованному мужчине движение и осязание. Самое интересное — часть эффекта сохранилась даже после извлечения устройств. Если это подтвердится на больших группах, у таких схем появляется шанс быть не просто временным костылём, а способом заново научить нервную систему работать.

✦ Hugging Face попал в неприятную историю: компания разбирала инцидент безопасности и для анализа взяла китайскую GLM 5.2 от Zhipu AI. Американские модели, по их словам, упрёмшись в защитные ограничения, не смогли сделать нужную работу. Это нормальный сигнал для всей отрасли: если модель не умеет помогать в инцидентах, когда надо быстро и без лишней театральности, значит в ней слишком много тормозов.

✦ Google снова вывалила пачку Gemini. Две модели уже в API: 3.6 Flash и 3.5 Flash-Lite. Первая — для кода, документов и агентных сценариев, вторая — дешёвая рабочая лошадка для поиска и извлечения данных. Отдельно есть Flash Cyber, но она не для всех, а для правительств и доверенных партнёров. Ещё компания сказала, что 3.5 Pro уже тестируется, а Gemini 4 ушла в обучение.

✦ Google представила две новые модели: Gemini 3.6 Flash и Gemini 3.5 Flash-Lite. Обе уже доступны в Gemini API как стабильные модели с контекстом до 1 млн входных токенов и поддержкой текста, изображений, видео, аудио и PDF.

Gemini 3.6 Flash ориентирована на код, анализ документов и агентные сценарии. Google сообщает, что модель расходует на 17% меньше выходных токенов, чем Gemini 3.5 Flash, делает меньше шагов рассуждения и вызовов инструментов. На официальных тестах DeepSWE результат вырос с 37% до 49%, MLE Bench — с 49,7% до 63,9%, а OSWorld-Verified — с 78,4% до 83%. Цена API составляет $1,50 за миллион входных и $7,50 за миллион выходных токенов.

Gemini 3.5 Flash-Lite рассчитана на массовые дешёвые задачи: поиск, извлечение данных, обработку документов и работу субагентов. По данным Artificial Analysis, которые приводит Google, модель выдаёт около 350 токенов в секунду. Цена — $0,30 за миллион входных и $2,50 за миллион выходных токенов. В тестах Google она заметно обгоняет Gemini 3.1 Flash-Lite, а на SWE-Bench Pro и OSWorld-Verified — даже обычную Gemini 3 Flash.

Z.ai, бывшая Zhipu AI, достроила ИИ-дата-центр на китайских чипах и уже частично его запустила. Это не история про победу над Nvidia. Это история про то, что в Китае уже строят свою тяжёлую инфраструктуру под обучение GLM, и игнорировать этот слой рынка просто глупо.

Источники: Нейроканал, AI Post, Futuris, Machinelearning, Нейроканал, Machinelearning

Все новости: ai.popovs.tech

#HuggingFace #NVIDIA #embeddings


В этом посте были ссылки, но мы их удалили по правилам Сетки