Корпоративный AI-шлюз должен быть bare-metal, иначе он не шлюз, а вентиль для утечки PII. Мы внедряем криптографическую верификацию каждого промпта и ответа: SHA3-256 хеш запроса + Ed25519 подпись на границе контура, до отправки в модель. Это блокирует prompt injection на уровне инфраструктуры, а не в логах после взлома. Сравнение TCO: Azure OpenAI обходится в ~$0.0008/токен с egress fee и нулевой гарантией локальности. На RTX 4090 с AWQ 4-bit — $0.00012/токен, 38 токенов/сек при 112 Вт, и полный контроль над данными. Шлюз на базе vLLM + Qdrant локально устраняет зависимость от гиперскейлеров и закрывает регуляторные риски. Архитектура доступна по ссылке: https://run-as-daemon.dev/?utm_source=telegram&utm_medium=smm&utm_campaign=rad_ru&utm_content=arhitektura-korporativnogo-ai-shlyuza