Проверили 1300 тестовых проектов на GitHub с помощью ИИ

Этим летом мы в talense.io делали ИИ-проверку тестовых заданий для крупной IT-компании. Через систему прошло 1300 репозиториев кандидатов, и несколько выводов оказались неожиданными.

Тестовое с одним правильным ответом больше не работает: нейросеть решит его за пару минут. Поэтому задание пришлось делать полутворческим, без эталонного решения.

Половина проблем была вовсе не в коде. Кандидаты сдавали решения не в ту ветку репозитория, а без лимита на размер работы модель читала сотни файлов и съедала бюджет.

Слабые работы ИИ отсеивал уверенно, это примерно половина всех решений. А вот выбрать лучших среди сильных кандидатов пока не может: оценки похожих работ заметно расходились. Финальное решение всё равно остаётся за людьми.

Если вы тоже пробовали автоматизировать проверку тестовых, расскажите в комментариях, как у вас получилось.

Проверили 1300 тестовых проектов на GitHub с помощью ИИ | Сетка — социальная сеть от hh.ru