HPE и NVIDIA представили совместные решения внедрения ИИ
Hewlett Packard Enterprise (HPE) и NVIDIA представили новую платформу NVIDIA AI Computing by HPE, представляющую собой портфель совместных решений для ускорения внедрения генеративного ИИ.
Ключевым элементом этого портфеля является HPE Private Cloud AI. По данным пресс-релиза, это первое в своём роде комплексное решение, которое глубоко интегрирует вычислительные технологии, сетевые решения и ПО NVIDIA с хранилищами данных, вычислительными ресурсами и облачной платформой HPE GreenLake. Оно предоставляет предприятиям любого размера возможность быстрой и эффективной разработки и развертывания приложений генеративного ИИ.
HPE Private Cloud AI с новой функцией OpsRamp AI Copilot, которая повышает эффективность ИТ-операций и обработки рабочих нагрузок, включает облачную среду самообслуживания с полным управлением жизненным циклом. Доступное в четырёх конфигурациях (Small, Medium, Large и Extra Large), оно поддерживает рабочие нагрузки ИИ различной сложности.
HPE Private Cloud AI также поддерживает инференс, точную настройку моделей и их дообучение посредством RAG с использованием собственных данных. Решение сочетает в себе средства контроля конфиденциальности, безопасности, прозрачности и управления данными, а также средства ITOps и AIOps. AIOps использует машинное обучение и анализ данных для автоматизации и улучшения ИТ-операций, а ITOps обеспечивает бесперебойное функционирование ИТ-инфраструктуры организации.
Конфигурация HPE Private Cloud AI Small, предназначенная для инференса, включает от четырёх до восьми ускорителей NVIDIA L40S, до 248 Тбайт дискового пространства и 100GbE-подключение в стойке мощностью 8 кВт. Конфигурация Medium, предназначенная для инференса и RAG, включает до 16 ускорителей NVIDIA L40S, до 390 Тбайт дискового пространства и 200GbE-подключение в стойке мощностью 17,7 кВт.
Конфигурации Large и Extra Large предлагают дополнительные возможности по обработке нагрузок ИИ и ML, а также тонкой настройке ИИ-моделей. Конфигурация Large включает до 32 ускорителей NVIDIA H100 NVL, до 1,1 Пбайта дискового пространства и 400GbE-интерконнект в двух стойках мощностью 25 кВт каждая. Конфигурация Extra Large включает до 24 ускорителей NVIDIA GH200 NVL2, до 1,1 Пбайта дискового пространства и 800GbE-интерконнект в двух стойках мощностью 25 кВт каждая.
Стойки могут управляться клиентом самостоятельно или обслуживаться HPE. Каждая конфигурация может работать как автономное локальное решение ИИ или в составе гибридного облака. Программная платформа NVIDIA AI Enterprise, включающая микросервисы инференса NIM, дополняется ПО HPE AI Essentials.