NVIDIA, MIT и NTU почти вдвое сократили токеновый трафик кодинг-агента в SoL-Pi. Основную модель оставили прежней. Счёт уменьшился только на треть.
Другой AI искал, что можно выкинуть из обвязки агента: предложил 152 направления, до финала дошли четыре.
Правку и тест объединили в один вызов. Логи больше 10 KiB показывают целиком два запроса, потом оставляют превью и доступ к оригиналу. Дешёвая модель сокращает диагностические логи, а код сверяет цитаты ошибок с исходником. Сжатие истории запускают с оглядкой на цену перезаписи prompt cache.
Здесь и разница между токенами и деньгами: убрали в основном дешёвое чтение кэша. На GPT-5.6 Sol счёт упал с $1339 до $894, но балл EdgeBench тоже снизился: 44,8 → 42,0.
Я бы начал с ObservationPack отдельно: $1271 и 47,2 балла. Без повторных прогонов рост качества ещё нельзя считать доказанным, но ради экономии 5% здесь хотя бы не пришлось принимать измеренное падение балла.
Включать все четыре приёма сразу я бы не стал: за дополнительные $377 экономии в этом замере отдали 5,2 балла.