SK Hynix hat Etched, ein US-amerikanisches KI-Inferenz-Startup, unterstützt, das Rack-Scale-Systeme mit proprietären Low-Voltage-Inferenz- (LVI) und Cluster-Scale-Memory- (CSM) -Technologien baut.
Etched löst einen kritischen Engpass der Branche: Traditionelle GPUs bieten überschüssige Rechenleistung, aber unzureichenden Speicher für groß angelegte KI-Abschlüsse, was zu umständlichen mehrstufigen KV-Caching-Frameworks führt.Seine maßgeschneiderten Inferenzchips reduzieren den Stromverbrauch und übertreffen herkömmliche GPU HBM in Speicherbandbreite und Kapazität, wodurch die mit dem KV-Caching verbundene Latenz und die Konstruktionskomplexität verringert werden.
Diese Investition erfolgte, nachdem das israelische Startup Majestic Labs den Stealth-Modus verlassen hatte, wobei das Unternehmen auch benutzerdefinierte Prozessor-Inferenzserver mit groß angelegten gemeinsamen Speicherpools baute.
Das im Jahr 2023 in San Jose von drei Harvard-Studenten gegründete Kernteam von Etched besteht aus CEO Gavin Uberti, Präsident Robert Wachen und Chris Zhu.000 Thiel Fellowship zur Förderung seiner frühen Entwicklung.
Das Team baute eine maßgeschneiderte LVI-Vorfüllverarbeitung und einen CSM-Gemeinschaftsspeicher, um die Inferenzeffizienz zu steigern.ermöglicht eine groß angelegte kommerzielle Inferenz.
Zhu wies darauf hin, dass konventionelle KI-Chips unter hoher Belastung eine schwere thermische Drosselung erleiden: erhöhter Stromverbrauch senkt die Taktgeschwindigkeit,Wird der tatsächliche Schlußdurchsatz auf unter die Hälfte seines theoretischen Höchststandes reduziert?.Etched's-Chips laufen Arithmetik-Einheiten bei der Hälfte der typischen Industrie-Spannung, erheblich die Rechendichte zu erhöhen.
Er erörterte auch wichtige Hardware-Kompromisse: HBM-ausgestattete KI-Chips liegen aufgrund von Speicher- und Interkonnektionsgrenzen bei der Decodiergeschwindigkeit hinter SRAM zurück.Während reine SRAM-Chips die Rechendichte und Kapazität für einen schnelleren Zugriff beeinträchtigen, wodurch der Gesamtdurchsatz verringert wird.
Dies behindert den Betrieb eines großen MoE-Modells, da die Übertragung von Token über mehrere Speicherschichten die Latenz erhöht.
Die CSM-Architektur von Etched® schafft einen einheitlichen, geringen Latenzzeiten-Gemeinsame-Speicherpool für skalierbare Hardware und nutzt eine proprietäre Hochgeschwindigkeitsverbindung, um den Cross-Chip-Speicherzugang zu beschleunigen.
Das hybride HBM/SRAM-Design balanciert Speicherkapazität und Cross-Chip-Latenz und liefert eine hochleistungsfähige interaktive Inferenz.Wärme- und Leistungsfehler reiner SRAM, 3D-DRAM und optische Chip-Lösungen.
Diese Innovation entkoppelt HBM-Stacks von GPU-Architekturbeschränkungen, konsolidiert verteilte Speicherressourcen und liefert eine Zugriffsgeschwindigkeit auf SRAM-Ebene über eine fortschrittliche Vernetzungstechnologie.
Etched's Rack-System verfügt über ein hochvernetztes Layout mit 16 dedizierten Kabeln, die die hinteren Ports mit acht Kernhardware-Einheiten verbinden.
Das System unterstützt Mainstream-LLMs, MoE-Modelle und nicht-Transformator-Architekturen wie Mamba, wobei sich das Unternehmen auf die Forschung und Entwicklung und den kommerziellen Verkauf eines vollständigen Systems konzentriert.
Eingeätzte Finanzierungsgeschichte
2022 Firmengründung
2023 ¥ 5,4 Millionen US-Dollar
2024 120 Mio. US-Dollar
2025 500 Millionen Dollar Serie B
2026: 300 Millionen US-Dollar in Serie C
Gesamtfinanzierung bis heute: 925,4 Millionen Dollar
Sequoia Capital führte die Serie C-Runde von Etched's 2026 mit Beteiligung von Andreessen Horowitz, Jane Street und SK Hynix..
Das konsequente jährliche Finanzierungs Tempo spiegelt die kontinuierliche Produktwiederholung wider, unterstützt durch eine starke Kundennachfrage und ein solides Vertrauen der Anleger.
Das Unternehmen hat eine 10-MW-Produktionsstätte in Milpitas eröffnet, um die Effizienz der Prototypen- und Fertigungseffizienz zu verbessern.
Der Chefarchitekt Saptadeep Pal enthüllte, dass Etched über 400 Mitarbeiter hat, mit gebuchten Kundenbestellungen von mehr als einer Milliarde Dollar.Optimierung der Lieferantenkooperation und Produktprüfung zur Unterstützung der schnellen Skalierung.
Zu den Kernkunden zählen große Unternehmen, aufstrebende Cloud-Anbieter und globale Hyperscaler, die Inferenz-as-a-Service-Lösungen anbieten.
Kommentar
Wenn Etched und Majestic Labs' neue Inferenz-Racks über das traditionelle KV-Caching hinausgehen, werden sie den Unternehmensspeichermarkt neu gestalten.Schaffung von Kooperationsmöglichkeiten für Anbieter wie Dell, HPE, NetApp und VAST Data, um Speicher-Arrays mit Next-Gen-Inferenz-Servern für eine optimale Leistung zu kombinieren.
Beibei Qianxing Jietong Technology Co., Ltd.
Sandy Yang, Leiterin der globalen Strategie
WhatsApp / WeChat: +86 13426366826
E-Mail: yangyd@qianxingdata.com
Website: www.qianxingdata.com/www.storagesserver.com Die Daten werden auf der Website der chinesischen Regierung gespeichert.
Geschäftsfokus:
Vertrieb von IKT-Produkten/Systemintegration und Dienstleistungen/Infrastrukturlösungen
Mit mehr als 20 Jahren Erfahrung im IT-Vertrieb arbeiten wir mit führenden globalen Marken zusammen, um zuverlässige Produkte und professionelle Dienstleistungen zu liefern.
¢Technologie nutzen, um eine intelligente Welt aufzubauen¡Ihr vertrauenswürdiger Dienstleister für IKT-Produkte!