SK Hynix a soutenu Etched, une start-up américaine d'inférence sur l'IA qui construit des systèmes à l'échelle des racks avec des technologies propriétaires d'inférence basse tension (LVI) et de mémoire à échelle de grappe (CSM).
Etched résout un goulot d'étranglement critique de l'industrie: les GPU traditionnels offrent une puissance de calcul excédentaire mais une mémoire insuffisante pour l'inférence d'IA à grande échelle, ce qui conduit à des cadres de mise en cache KV à plusieurs niveaux encombrants.Ses puces d'inférence sur mesure réduisent la consommation d'énergie et surpassent les GPU HBM classiques en bande passante et en capacité de mémoire, atténuant la latence et la complexité de la conception liées à la mise en cache KV.
Cet investissement intervient après que la start-up israélienne Majestic Labs ait quitté le mode furtif, la société construisant également des serveurs d'inférence de processeur personnalisés avec des pools de mémoire partagés à grande échelle.
Fondée en 2023 à San Jose par trois étudiants de Harvard qui ont abandonné, l'équipe principale d'Etched est composée du PDG Gavin Uberti, du président Robert Wachen et de Chris Zhu.000 Thiel Fellowship pour alimenter son développement précoce.
L'équipe a construit un traitement de pré-remplissage LVI personnalisé et une mémoire partagée CSM pour augmenter l'efficacité de l'inférence.permet le déploiement commercial à grande échelle de l'inférence.
Zhu a souligné que les puces d'IA traditionnelles souffrent d'un sérieux throttlement thermique sous une charge élevée: une consommation d'énergie élevée réduit les vitesses d'horloge,réduire le débit d'inférence réel à moins de la moitié de son pic théoriqueLes puces Etched fonctionnent à la moitié de la tension typique de l'industrie, ce qui augmente considérablement la densité de calcul.
Il a également abordé les principaux compromis matériels: les puces d'IA équipées de HBM sont en retard par rapport à la SRAM en termes de vitesse de décodage en raison des limites de mémoire et d'interconnexion,alors que les puces SRAM pures compromettent la densité de calcul et la capacité pour un accès plus rapide, réduisant le débit global.
L'architecture d'Etched® supprime les couches de mémoire redondantes pour résoudre le problème.
L'architecture CSM d'Etched® crée un pool de mémoire partagée à faible latence unifié pour le matériel évolutif, en tirant parti de l'interconnexion haut débit propriétaire pour accélérer l'accès à la mémoire cross-chip.
Sa conception hybride HBM/SRAM équilibre la capacité de mémoire et la latence cross-chip, offrant une inférence interactive à haut débit.défauts thermiques et de performance de la SRAM pure, DRAM 3D et solutions de puces optiques.
Cette innovation découple les piles HBM des contraintes architecturales du GPU, consolide les ressources de mémoire dispersées et offre une vitesse d'accès de niveau SRAM via une technologie d'interconnexion avancée.
Le système de rack d'Etched est doté d'une disposition à haute interconnexion, avec 16 câbles dédiés reliant les ports arrière à huit unités matérielles de base.
Le système prend en charge les LLM traditionnels, les modèles MoE et les architectures non transformatrices comme Mamba, la société se concentrant sur la R & D et les ventes commerciales complets du système.
Historique du financement gravé
2022 Création d'une société
Ronde de démarrage de 5,4 M$ en 2023
2024 120 millions de dollars en série A
2025 500 millions de dollars de série B
2026 300 millions de dollars de la série C
Financement total à ce jour: 925,4 millions de dollars
Sequoia Capital a mené la série C de 2026 d'Etched, avec la participation d'Andreessen Horowitz, Jane Street et SK Hynix..
Le rythme annuel régulier de collecte de fonds reflète l'itération continue des produits, soutenue par une forte demande des clients et une solide confiance des investisseurs.
La société a ouvert un site de production de 10 MW à Milpitas pour améliorer l'efficacité des prototypes et de la fabrication.
L'architecte en chef Saptadeep Pal a révélé qu'Etched compte plus de 400 employés avec des commandes de clients de plus d'un milliard de dollars.optimisation de la coopération avec les fournisseurs et des tests de produits pour soutenir une mise à l'échelle rapide.
Ses principaux clients comprennent les grandes entreprises, les fournisseurs émergents de cloud et les hyperscalers mondiaux proposant des solutions d'inférence en tant que service.
Comment?
Si les nouveaux racks d'inférence d'Etched et Majestic Labs vont au-delà de la mise en cache KV traditionnelle, ils remodelleront le marché du stockage d'entreprise.créer des opportunités de collaboration pour des fournisseurs comme Dell, HPE, NetApp et VAST Data pour associer les tableaux de stockage aux serveurs d'inférence de nouvelle génération pour des performances optimales.
La Commission a examiné les informations fournies par les autorités chinoises.
Sandy Yang, directeur de la stratégie mondiale
WhatsApp ou WeChat: +86 13426366826
Le courrier électronique: yangyd@qianxingdata.com
Le site Web est le suivant: www.qianxingdata.com/www.storagesserver.com
En ce qui concerne les affaires
Distribution de produits TIC/Intégration des systèmes et services/Solutions d'infrastructure
Avec plus de 20 ans d'expérience dans la distribution informatique, nous travaillons en partenariat avec des marques mondiales de premier plan pour fournir des produits fiables et des services professionnels.
Utiliser la technologie pour bâtir un monde intelligentVotre fournisseur de services de produits TIC de confiance!