Dévoilé à l'ISC 2026 à Hambourg, le nouveau dispositif de stockage A1400X3M de DDN offre 160 millions d'IOPS par rack et intègre le logiciel KV Cache alimenté par NVIDIA Dynamo pour permettre une accélération de l'IA à double chemin. La mise à jour apporte également une sécurité, une observabilité et une efficacité d'infrastructure améliorées pour les déploiements d'IA à grande échelle, en ciblant les goulots d'étranglement courants des pipelines de données dans les workflows d'ingestion, de préparation, de formation, d'inférence, de RAG et d'IA agentique.
Alex Bouzari, cofondateur et PDG de DDN, a souligné que le succès de l'IA moderne dépend de l'efficacité opérationnelle des données de bout en bout plutôt que de la simple puissance de calcul. Les dernières innovations de DDN maximisent l'utilisation du GPU, réduisent les coûts d'inférence, accélèrent la génération de jetons et améliorent la rentabilité globale des usines d'IA à grande échelle.
Mise à niveau matérielle A1400X3M
Successeur de l'A1400X2, le nouvel A1400X3M exécute le logiciel EXAScaler Lustre de DDN. Son châssis 2RU 24-SSD passe des processeurs Intel Ice Lake aux processeurs AMD Genoa et PCIe Gen4 aux interfaces PCIe Gen5 double vitesse. Il offre un débit de lecture allant jusqu'à 190 Go/s et des écritures séquentielles de 110 Go/s, ce qui représente une amélioration des performances de lecture de 35 % par rapport à la génération précédente. Un déploiement en rack complet atteint 160 millions d'IOPS, ce qui équivaut à environ 4 millions d'IOPS par châssis.
Accélération du cache KV intégrée à NVIDIA Dynamo
Le cache KV stocke les clés et les valeurs d'activation LLM pendant l'inférence pour éliminer les recalculs redondants et améliorer les performances. Le cadre d'inférence distribuée Dynamo de NVIDIA étend le cache GPU KV au stockage NVMe via une hiérarchie de mémoire à quatre niveaux (HBM, DRAM, SSD local, NVMe externe), transformant le cache résident du stockage en mémoire contextuelle persistante et adressable. En tant que partenaire NVIDIA NVMe qualifié, DDN intègre cette fonctionnalité dans son système de fichiers parallèle EXAScaler et ses plateformes de stockage d'objets Infinia.
L'infrastructure d'IA à double plate-forme de DDN répond à des besoins distincts en matière de charge de travail : Infinia offre des performances de métadonnées à latence ultra faible et une concurrence élevée pour les tâches d'inférence et de récupération, tandis qu'EXAScaler offre une vitesse de système de fichiers parallèle de pointe pour la formation et le point de contrôle de l'IA. Ensemble, ils unifient les flux de données d'IA de bout en bout, éliminent les silos, maintiennent une utilisation élevée du GPU et accélèrent le délai d'obtention du premier jeton.
Le framework KV Cache optimisé offre des avantages clés : mise en cache partagée distribuée pour l'inférence à grande échelle, accès à latence ultra-faible pour les tâches d'IA à contexte long, prise en charge native de l'IA agentique, du RAG et des pipelines de raisonnement en plusieurs étapes, compatibilité approfondie avec Dynamo et vLLM, chargement du cache jusqu'à 55 fois plus rapide, efficacité GPU supérieure et coûts opérationnels réduits par jeton.
Améliorations de la sécurité et de l'efficacité
DDN a déployé des fonctionnalités d'entreprise améliorées pour les environnements d'IA de production. Les mises à jour de sécurité incluent une architecture multi-tenant sans système d'exploitation, une gestion des clés de chiffrement conforme à KMIP et une visibilité opérationnelle compatible VictoriaLogs, ainsi que des CSI multi-tenant et des API standard. Les améliorations d'efficacité couvrent l'épinglage intelligent des fichiers et les Hot Pools accélérés par NAND, qui hiérarchisent les données des supports 100 % Flash coûteux vers les disques durs économiques.
Les déploiements réels valident ses gains de performances : Salesforce a exploité Google Cloud Managed Lustre (optimisé par EXAScaler) pour obtenir une formation de modèle 1,5 fois plus rapide, une latence d'E/S réduite de 75 % et des dépenses de formation réduites de 42 %. L'A1400X3M sera disponible en général d'ici la fin du troisième trimestre 2026, avec des fiches techniques complètes accessibles au public.
Pékin Qianxing Jietong Technology Co., Ltd.
Sandy Yang/Directrice de la stratégie mondiale
WhatsApp/WeChat : +86 13426366826
Courriel : yangyd@qianxingdata.com
Site Web : www.qianxingdata.com/www.storagesserver.com
Objectif commercial :
Distribution de produits TIC/Intégration et services de systèmes/Solutions d'infrastructure
Avec plus de 20 ans d'expérience dans la distribution informatique, nous collaborons avec de grandes marques mondiales pour fournir des produits et des services professionnels fiables.
« Utiliser la technologie pour construire un monde intelligent » Votre fournisseur de services de produits TIC de confiance !