VAST Data ha ampliado su asociación con AMD para avanzar en la infraestructura de IA para plataformas en la nube y empresariales que ejecutan entrenamiento de modelos, inferencia, generación aumentada por recuperación (RAG) y cargas de trabajo de IA agentiva. La pila integrada une el Sistema Operativo de IA de VAST con procesadores AMD EPYC de 6ª generación, GPUs AMD Instinct, hardware de red AMD y software ROCm.
Esta colaboración se alinea con un cambio importante en la industria: la infraestructura de IA está evolucionando más allá de los clústeres solo de entrenamiento para admitir contexto persistente, inferencia de alta concurrencia y flujos de trabajo de agentes de múltiples turnos. Las implementaciones modernas de IA priorizan el movimiento eficiente de datos, la gestión optimizada de la caché KV, una mayor utilización de la GPU y el acceso de baja latencia a modelos grandes y conjuntos de datos contextuales.
La arquitectura DASE (Disaggregated Shared Everything) de VAST sirve como la capa de datos compartida unificada para estos entornos de IA modernos. Consolida el almacenamiento de archivos y objetos, bases de datos, transmisión de eventos y servicios de datos centrales bajo un único espacio de nombres global, al tiempo que ofrece multi-inquilino y aislamiento de cargas de trabajo para nubes de IA que ejecutan diversas tareas concurrentes de clientes y aplicaciones.
AMD EPYC 9006 Potencia el Hardware VAST de Próxima Generación
VAST está adoptando procesadores AMD EPYC de la serie 9006 de 6ª generación (Venice) para sus próximos sistemas CBox de 6ª generación y EBox de 3ª generación, que forman la base de hardware del Sistema Operativo de IA de VAST. La plataforma EPYC 9006 introduce la conectividad PCIe Gen6 en la línea de hardware de VAST, duplicando el ancho de banda de E/S por generación.
La actualización aumenta el rendimiento de almacenamiento de archivos y objetos y reduce la latencia para cargas de trabajo de bases de datos, almacenes de datos y transmisión de eventos compatibles con VAST DataBase y DataEngine. Para la infraestructura de IA, el ancho de banda de E/S mejorado alivia los cuellos de botella en el cómputo, la red y el almacenamiento NVMe, beneficiando la carga de modelos, los pipelines de recuperación, el acceso a puntos de control y los flujos de trabajo de caché KV externos que exceden los límites de memoria de la GPU nativa.
Arquitectura de Referencia Tri-Player con AMD y DriveNets
VAST, AMD y DriveNets están construyendo conjuntamente una arquitectura de referencia unificada de infraestructura de IA, combinando la infraestructura de IA Helios a escala de rack de AMD, el Sistema Operativo de IA de VAST y la red AI Fabric de DriveNets. El marco ofrece orientación de implementación estandarizada para cargas de trabajo de entrenamiento, inferencia, aprendizaje por refuerzo y caché KV de IA, proporcionando mejores prácticas de dimensionamiento y disponibilidad para empresas que construyen fábricas de IA con infraestructura de datos compartida y redes de alto rendimiento.
VAST también ha ampliado sus vínculos con el ecosistema con los proveedores de inferencia TensorMesh y EmbeddedLLM, centrándose en arquitecturas de inferencia de grado de producción para casos de uso de IA agentiva, con detalles específicos de integración y lanzamiento aún por revelar.
Descarga Optimizada de Caché KV para Inferencia de Alta Concurrencia
Una pieza central de la colaboración actualizada es la descarga mejorada de la caché KV, aprovechando las GPUs AMD Instinct, AMD Infinity Context, el software ROCm y el Sistema Operativo de IA de VAST. La caché KV almacena datos de estado de atención generados por inferencia para acelerar interacciones de múltiples turnos y cargas de trabajo de IA de contexto largo, sin embargo, los tamaños de caché grandes consumen rápidamente la memoria limitada de la GPU.
Descargar o segmentar la caché KV en almacenamiento compartido de alto rendimiento libera memoria de GPU para tareas activas mientras se conservan los datos contextuales para solicitudes de inferencia posteriores. Las pruebas iniciales en GPUs AMD Instinct MI355X entregaron un tiempo 9 veces más rápido a primer token y un rendimiento de token 9.7 veces mayor para cargas de trabajo de IA agentiva de alta concurrencia a través de la descarga de caché KV impulsada por VAST, con un rendimiento variable según la base de hardware, la carga de trabajo y la configuración de almacenamiento.
Además, las políticas automatizadas de ciclo de vida de VAST se aplican a los datos de la caché KV, lo que permite la expiración y eliminación programada del contenido en caché, una característica crítica para manejar datos de inferencia sensibles, personales o regulados.
Interconexión de GPU-Almacenamiento de Alta Velocidad a través de Pensando Pollara 400
La arquitectura implementa NICs de IA AMD Pensando Pollara 400 para conectar GPUs AMD Instinct a clústeres de almacenamiento VAST. Compatible con NFS sobre TCP y RDMA, la NIC permite transferencias de datos eficientes de GPU a almacenamiento, otorgando acceso de baja latencia al almacenamiento VAST basado en NVMe para caché KV y cargas de trabajo de inferencia generales.
Este diseño desacopla la escalabilidad de la gestión de contexto de los límites de memoria física de la GPU. En lugar de tratar el almacenamiento como persistencia pasiva, VAST posiciona su plataforma como una capa de datos y ejecución unificada para la gestión distribuida de modelos, bases de datos, streaming, activos de archivos y contexto de IA. Para los proveedores de nube de IA, la arquitectura eleva la utilización de la GPU y la eficiencia operativa, apoyando la transición de la industria del entrenamiento por lotes y el alquiler de GPU a la inferencia persistente y los servicios de IA agentiva.
Beijing Qianxing Jietong Technology Co., Ltd.
Sandy Yang/Director de Estrategia Global
WhatsApp / WeChat: +86 13426366826
Correo electrónico: yangyd@qianxingdata.com
Sitio web: www.qianxingdata.com/www.storagesserver.com
Enfoque Empresarial:
Distribución de Productos TIC/Integración de Sistemas y Servicios/Soluciones de Infraestructura
Con más de 20 años de experiencia en distribución de TI, nos asociamos con marcas líderes a nivel mundial para ofrecer productos confiables y servicios profesionales.
¡Construyendo un Mundo Inteligente con Tecnología! Su Proveedor de Servicios de Productos TIC de Confianza.
Sandy Yang/Director de Estrategia Global
WhatsApp / WeChat: +86 13426366826
Correo electrónico: yangyd@qianxingdata.com
Sitio web: www.qianxingdata.com/www.storagesserver.com
Enfoque Empresarial:
Distribución de Productos TIC/Integración de Sistemas y Servicios/Soluciones de Infraestructura
Con más de 20 años de experiencia en distribución de TI, nos asociamos con marcas líderes a nivel mundial para ofrecer productos confiables y servicios profesionales.
¡Construyendo un Mundo Inteligente con Tecnología! Su Proveedor de Servicios de Productos TIC de Confianza.



