Cerebras развертывает системы CS-3 на AWS — достигает 5-кратного увеличения пропускной способности

AWS теперь предлагает через Bedrock самый быстрый AI-инферент благодаря сотрудничеству с Cerebras. Архитектура использует AWS Trainium для prefill-фазы и Cerebras WSE для decode-фазы, достигая 5-кратного увеличения пропускной способности токенов. Это критично для R&D-директоров, ищущих масштабируемые решения инферента с минимальной латентностью для production-приложений.