SK Hynix ha respaldado a Etched, una startup estadounidense de inferencia de IA que está construyendo sistemas a escala de rack con tecnologías propietarias de inferencia de bajo voltaje (LVI) y memoria a escala de clúster (CSM).
Etched resuelve un cuello de botella crítico en la industria: las GPU tradicionales ofrecen una potencia de cálculo excesiva pero una memoria insuficiente para la inferencia de IA a gran escala, lo que lleva a engorrosos marcos de caché KV de varios niveles. Sus chips de inferencia personalizados reducen el consumo de energía y superan a las GPU HBM convencionales en ancho de banda y capacidad de memoria, mitigando la latencia y la complejidad del diseño relacionadas con la caché KV.
Esta inversión se produce después de que la startup israelí Majestic Labs saliera del modo sigiloso, y la empresa también está construyendo servidores de inferencia con procesadores personalizados y grupos de memoria compartida a gran escala.
Fundada en 2023 en San José por tres estudiantes de pregrado de Harvard que abandonaron sus estudios, el equipo principal de Etched está compuesto por el CEO Gavin Uberti, el presidente Robert Wachen y Chris Zhu. El equipo obtuvo una Beca Thiel de $250,000 durante dos años para impulsar su desarrollo inicial.
El equipo construyó procesamiento de prellenado LVI personalizado y memoria compartida CSM para aumentar la eficiencia de la inferencia. Su solución de pila completa, que integra chips internos, empaquetado, PCB y módulos de interconexión, permite el despliegue de inferencia comercial a gran escala.
Zhu señaló que los chips de IA convencionales sufren una severa limitación térmica bajo alta carga: el elevado consumo de energía reduce las velocidades de reloj, lo que reduce el rendimiento de inferencia real a menos de la mitad de su pico teórico. Los chips de Etched ejecutan unidades aritméticas a la mitad del voltaje típico de la industria, lo que aumenta significativamente la densidad de cálculo.
También abordó las compensaciones clave de hardware: los chips de IA equipados con HBM van por detrás de SRAM en velocidad de decodificación debido a los límites de memoria e interconexión, mientras que los chips de SRAM puros comprometen la densidad de cálculo y la capacidad para un acceso más rápido, lo que reduce el rendimiento general.
Esto dificulta la operación de modelos MoE grandes, ya que la transmisión de tokens entre capas a través de múltiples capas de memoria acumula latencia. La arquitectura de Etched elimina capas de memoria redundantes para resolver el problema.
La arquitectura CSM de Etched crea un grupo de memoria compartida unificado de baja latencia para hardware escalable, aprovechando una interconexión propietaria de alta velocidad para acelerar el acceso a la memoria entre chips.
Su diseño híbrido HBM/SRAM equilibra la capacidad de memoria y la latencia entre chips, ofreciendo inferencia interactiva de alto rendimiento. CSM evita los defectos de costo, estabilidad, térmicos y de rendimiento de las soluciones de SRAM pura, DRAM 3D y chips ópticos.
Esta innovación desacopla las pilas HBM de las restricciones arquitectónicas de la GPU, consolida los recursos de memoria dispersos y ofrece una velocidad de acceso a nivel de SRAM a través de tecnología de interconexión avanzada.
El sistema de rack de Etched presenta un diseño de alta interconexión, con 16 cables dedicados que conectan los puertos traseros a ocho unidades de hardware principales.
El sistema admite LLM convencionales, modelos MoE y arquitecturas no transformadoras como Mamba, y la empresa se centra en la I+D de sistemas completos y las ventas comerciales.
Historial de financiación de Etched
2022 - Fundación de la empresa
2023 - Ronda semilla de $5.4M
2024 - Serie A de $120M
2025 - Serie B de $500M
2026 - Serie C de $300M
Financiación total hasta la fecha: $925.4M
Sequoia Capital lideró la ronda Serie C de Etched en 2026, con la participación de Andreessen Horowitz, Jane Street y SK Hynix. La ronda valora la empresa en $10.3 mil millones, el doble de su valoración de la Serie B de 2024.
Su ritmo constante de recaudación de fondos anual refleja la iteración continua del producto, respaldada por una sólida demanda de los clientes y una sólida confianza de los inversores.
Wachen dijo que el nuevo capital acelerará la producción en masa de clústeres de inferencia. La empresa ha abierto un sitio de producción de 10 MW en Milpitas para mejorar la eficiencia de la creación de prototipos y la fabricación.
El arquitecto jefe Saptadeep Pal reveló que Etched tiene más de 400 empleados con pedidos de clientes reservados que superan los $1 mil millones. Su base de I+D y fabricación en Taiwán permite operaciones las 24 horas, optimizando la cooperación con los proveedores y las pruebas de productos para respaldar una rápida escalabilidad.
Sus clientes principales cubren grandes empresas, proveedores de nube emergentes e hiperescaladores globales que ofrecen soluciones de inferencia como servicio.
Comentario
Si los nuevos racks de inferencia de Etched y Majestic Labs van más allá de la caché KV tradicional, remodelarán el mercado de almacenamiento empresarial. Estos sistemas exigen almacenamiento de alta velocidad y baja latencia, lo que crea oportunidades de colaboración para proveedores como Dell, HPE, NetApp y VAST Data para emparejar arrays de almacenamiento con servidores de inferencia de próxima generación para un rendimiento óptimo.
Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang/Director de Estrategia Global
WhatsApp / WeChat: +86 13426366826
Correo electrónico: yangyd@qianxingdata.com
Sitio web: www.qianxingdata.com/www.storagesserver.com
Enfoque de negocio:
Distribución de productos TIC/Integración de sistemas y servicios/Soluciones de infraestructura
Con más de 20 años de experiencia en distribución de TI, nos asociamos con las principales marcas mundiales para ofrecer productos confiables y servicios profesionales.
"Usando la tecnología para construir un mundo inteligente" ¡Su proveedor de servicios de productos TIC de confianza!