Российские математики из стартапа Mostik научили ИИ-модели «общаться» друг с другом без текста.
Вместо того чтобы одна нейросеть генерировала ответ, который затем читает другая, технология позволяет передавать информацию через внутренние математические представления моделей.
В эксперименте Mostik объединил огромную GLM-5.2 на 753 млрд параметров с Qwen-3.5 на 4 млрд. Получившаяся система показала результат примерно посередине между двумя моделями, но стоила примерно в 20 раз дешевле использования большой модели.
Разработчики считают, что будущее ИИ может быть не за одной гигантской моделью, а за взаимодействием нескольких специализированных моделей.