🧠 Как мы нашли утечку памяти в vLLM
Команда Mistral AI обнаружила утечку памяти в vLLM при использовании disaggregated serving.
Утечка в 400 МБ/мин возникала только в сложной конфигурации: модель Mist
читать далееможете перейти, но сначала проверьте ссылку и будьте аккуратны: не вводите по ссылке пароли, номера телефонов и банковских карт, и другие личные данные
https://
уверены, что хотите выйти?
придется авторизоваться заново, а заполненные данные будут удалены
пост закреплён — пока закрепить можно только один пост
что-то пошло не так — попробуйте снова чуть попозже