В 03:17 MSK сработал алерт: latency inference для fraud-detection вырос с 87 мс до 620 мс. Причина — автоматический scale-up в облаке после роста трафика, но с новой ценой $3.12/hr за A100 (было $2.56). За 3 года такой TCO = $278k. Тот же workload на bare-metal: 4×H100 (PCIe, 80GB) + dual-socket EPYC 9654 + 1TB RAM = $189k capex. Плюс $18k/год на электричество и обслуживание. Итого 3 года — $243k. Экономия $35k, плюс нулевой egress, локальная PII-санитизация и SLA <100 мс гарантирован ядром. Закон 152-ФЗ требует минимизировать передачу персональных данных за пределы РФ. Облачный inference — юридический риск. Bare-metal — суверенный контур. Подробнее: https://run-as-daemon.dev/?utm_source=telegram&utm_medium=smm&utm_campaign=rad_ru&utm_content=yunit-ekonomika-vladeniya-serverami-s