🤖 Три нейросети, на которые стоит взглянуть
Пару недель назад интернет гудел: китайцы из Qwen в один день выкатили сразу три нейросети. Все поспешили объявить их «новыми лидерами гонки». Я решил не поддаваться ажиотажу, подождать — и посмотреть, что же там на самом деле, а после теста поделиться с вами.
📌 Что получилось: 1️⃣ Qwen3-TTS-Flash — новая модель озвучки. И вот тут действительно впечатляет: голос звучит естественно, без механических интонаций, даже в длинных фразах сохраняет темп, ударения и дыхание. Важно, что теперь доступен русский язык, и по стабильности озвучка обгоняет ElevenLabs. Да, пока немного не хватает эмоциональности, но ощущение «робота» уже почти исчезло.
2️⃣ Qwen-Image-Edit-2509 — отличная альтернатива DALL·E и Midjourney. Особенно по части редактирования. Она умеет смешивать несколько изображений, корректировать позы и детали, при этом не ломает контекст и не искажает лица. Для коммерческих задач — прямо находка.
3️⃣ Qwen3-Omni — мультимодальный монстр. Который работает сразу с текстом, изображением, аудио и видео. Проглатывает аудио до 30 минут, и делает это с минимальной задержкой. В тестах она уже вошла в топ по большинству бенчмарков, и, что важно, работает стабильно и предсказуемо.
💡 После теста я понял одну вещь: зря я так редко рассказываю про менее известные модели. Пока все обсуждают OpenAI, Gemini и Claude, на периферии появляются действительно рабочие инструменты — не с громкими названиями, зато с отличным результатом.
Так что в ближайшее время хочу поискать для вас побольше таких «незаметных, но мощных» нейросетей. Дайте знать, если такое будет интересно❤️