NVIDIA ya ha enviado sus primeros sistemas Vera a AWS, Oracle Cloud Infrastructure, Anthropic, OpenAI y SpaceXAI. La Vera CPU de NVIDIA llega como una plataforma diseñada para agentes, y esta CPU para agentes se incorporará a infraestructuras de inteligencia artificial que necesitan ejecutar muchas tareas al mismo tiempo.

El anuncio se produce junto a una ampliación de la colaboración entre AWS y NVIDIA, que contempla 2 millones de GPU NVIDIA adicionales. También incluye el trabajo necesario para llevar a AWS infraestructuras basadas en Vera.

El primer servidor NVIDIA Vera y una GPU Vera Rubin ya están en manos de AWS. Buck los entregara personalmente en Seattle, después de que Ian Buck, vicepresidente de Hyperscale y HPC de NVIDIA, los llevara allí.

Vera es la primera parada de AWS en el recorrido de esta CPU por el sector de la IA. Antes, Buck había entregado sistemas Vera a Oracle Cloud Infrastructure y a tres laboratorios de inteligencia artificial: Anthropic, OpenAI y SpaceXAI.

“La IA agéntica está creando un nuevo momento para las CPU en la fábrica de IA. Además, a medida que los modelos pasan de responder a actuar, Vera está diseñada específicamente para mantener ese trabajo en marcha a escala”, afirmó Buck.

Vera traslada parte de la carga de los agentes a la CPU

La razón de este diseño está en cómo trabajan los agentes. Una persona puede pedir a un sistema que prepare diapositivas, compile y pruebe software, analice datos, busque archivos o ejecute simulaciones.

Si esas tareas se multiplican y deben avanzar casi al mismo tiempo, la infraestructura necesita responder a una presión distinta. Por tanto, se incrementa la demanda de coordinación y control.

Los agentes no dependen únicamente de las GPU. Cada entorno aislado de un agente, cada llamada a una herramienta, las capas de orquestación y las operaciones de recuperación de información con contexto largo implican trabajo de CPU.

En concreto, Vera parte de esa premisa y pretende ocuparse de la parte de coordinación, control y movimiento de datos. Ese objetivo rodea al cálculo acelerado.

El problema afecta especialmente a los diseños centrados en acumular núcleos. La combinación de tareas concurrentes y en tiempo real exige prioridades distintas.

NVIDIA ha equipado Vera con 88 núcleos Olympus de diseño propio. Además, ofrece un ancho de banda de memoria de 1,2 TB/s y hasta 1,8 veces más rendimiento por núcleo en cargas de trabajo de IA agéntica.

Según NVIDIA, mantener el sistema bajo carga constante permite terminar antes cada trabajo. Por tanto, el efecto esperado se extiende a la fábrica de IA completa.

La compañía resume la motivación con una pregunta sencilla: si una persona pudiera trabajar diez veces más rápido, ¿podría su ordenador seguirle el ritmo? De hecho, Vera está pensada para ese tipo de demanda continua.

Vera cpu nvidia: AWS recibe el primer servidor y OCI prepara cientos de miles

La entrega a AWS tuvo lugar en Seattle. Buck trasladó el primer servidor con Vera y la primera GPU Vera Rubin junto a las Spheres.

Luego se los entregó a Willem Visser, vicepresidente de Amazon EC2 en AWS. También participaron Supreeth Sheshardi, vicepresidente de ingeniería de hardware de Amazon EC2, y los equipos que revisaron qué aportarán ambos productos a los clientes de AWS.

Oracle Cloud Infrastructure ha mostrado sus planes desde su AI Customer Excellence Center. Allí, el equipo de OCI, incluido Karan Batta, responsable de la gestión general de producto, y Gary Miller, director de clientes y socios, examinó un sistema Vera ya desembalado.

En segundo plano, un rack de GPU NVIDIA procesaba cargas de clientes de OCI procedentes de distintas partes del mundo. El centro permite a los clientes de Oracle probar diferentes cargas de IA.

Buck explicó que un modelo no siempre encuentra la respuesta preparada cuando recibe una pregunta. En muchos casos necesita generar código Python para llegar al resultado correcto.

“Cuando se plantea una pregunta a los modelos de IA, a menudo la respuesta no está preparada y lista para usar. Los modelos tienen que generar código Python para llegar a la respuesta correcta”, señaló.

Después añadió: “Por eso estamos viendo que la demanda de CPU se dispara”. Además, esa demanda encaja con la propuesta de Vera.

OCI asegura que también está observando ese aumento. Karan Batta afirmó: “OCI tiene previsto desplegar cientos de miles de CPU NVIDIA Vera a partir de 2026 porque la IA agéntica exige un rendimiento sostenido a una escala enorme”.

La arquitectura de Vera está diseñada específicamente para cargas de razonamiento de alto rendimiento. En cambio, ofrece la eficiencia, la densidad y el espacio físico que OCI necesita para impulsar la próxima generación de IA empresarial.

Oracle Cloud Infrastructure es el primer proveedor cloud que desplegará Vera a escala de hiperescala, según la información facilitada. Para sus clientes empresariales, eso se traduce en infraestructura de IA agéntica preparada para producción.

El equipo de OCI también quiere utilizar el sistema para que sus clientes puedan personalizar y validar sus agentes y sus cargas de trabajo. Gary Miller explicó que esperaba conocer la reacción de quienes visiten el centro.

Así, señaló: “Tengo muchas ganas de ver la reacción de las personas que pasen por aquí y de trabajar juntos para sacar el máximo partido a Vera”. Por tanto, el objetivo es extraer el máximo rendimiento del sistema.

SpaceXAI, OpenAI y Anthropic reciben sus propios sistemas

La última entrega del día tuvo lugar en mayo. Fue en las oficinas de SpaceXAI en Palo Alto.

El equipo de NVIDIA mostró a Elon Musk el interior del sistema. Luego, Musk escuchó las explicaciones y formuló preguntas sobre los núcleos, la distribución de la memoria y la refrigeración.

SpaceXAI está evaluando Vera para cargas de trabajo de aprendizaje por refuerzo. Además, la prueba se centra en canalizaciones de simulación basadas en agentes que utiliza su pila de entrenamiento.

En la sede de OpenAI en Mission Bay, la entrega se realizó en el exterior, en un balcón abierto junto a las oficinas. Sachin Katti, responsable de la infraestructura de computación de OpenAI, recibió el servidor de manos de Buck.

Durante la explicación, el vicepresidente de NVIDIA sacó un destornillador del bolsillo. Después retiró la tapa y enseñó el interior del sistema.

Anthropic recibió el primer sistema de mayo en sus oficinas de SoMa, en San Francisco. James Bradbury, responsable de computación de la compañía, aceptó la entrega desde una sala de reuniones cercana a la bahía.

Buck utilizó como apoyo una placa base de NVIDIA Vera sin ensamblar. En concreto, explicó cómo funciona el servidor y qué diferencia a esta CPU.

“Ampliar la capacidad de computación es un acelerador importante para el crecimiento de los modelos. Nos entusiasma ver cómo Vera emerge como una parte prometedora del ecosistema al resolver cargas de trabajo agénticas”, declaró Bradbury.

Vera forma parte del enfoque de diseño conjunto de NVIDIA, junto a la GPU NVIDIA Rubin, la DPU BlueField-4, Spectrum-X y la arquitectura de rack MGX. El procesador también puede funcionar en sistemas independientes.

Sin embargo, ocupa además el papel de procesador anfitrión en Vera Rubin NVL72. Allí se conecta a dos GPU Rubin mediante NVIDIA NVLink-C2C de segunda generación.

En esa configuración, Vera y Rubin comparten una arquitectura de memoria unificada. NVIDIA sostiene que así el cálculo acelerado puede mantenerse más ocupado, mientras los núcleos de la CPU y la interconexión gestionan la orquestación, el control y el movimiento de datos necesarios.

De ese modo, la infraestructura alimenta a las GPU con el doble de eficiencia energética que la infraestructura tradicional. Además, se refuerza el soporte para cargas de IA agéntica.

La compañía presenta Vera como una CPU creada específicamente para la etapa de la IA agéntica. Además, AWS ya ha recibido el primer servidor.

OCI prevé desplegar cientos de miles de unidades desde 2026. Por tanto, tres laboratorios —Anthropic, OpenAI y SpaceXAI— ya han recibido sus sistemas para evaluar cargas concretas.

Puedes seguir a HardwarePremium en Facebook, Twitter (X), Instagram, Threads, BlueSky o Youtube. También puedes consultar nuestro canal de Telegram para estar al día con las últimas noticias de tecnología.

FAQ

¿Qué empresas han recibido ya sistemas NVIDIA Vera?

AWS, Oracle Cloud Infrastructure, Anthropic, OpenAI y SpaceXAI han recibido sistemas Vera. AWS dispone además de una GPU Vera Rubin entregada junto al primer servidor Vera.

¿Cuándo empezará OCI a desplegar las CPU Vera?

OCI ha indicado que comenzará a desplegar cientos de miles de CPU NVIDIA Vera a partir de 2026. La fuente no detalla una fecha concreta ni un calendario por regiones.

¿Qué relación existe entre Vera y Vera Rubin NVL72?

Vera actúa como procesador anfitrión en Vera Rubin NVL72 y se conecta a dos GPU Rubin mediante NVLink-C2C de segunda generación. Ambas partes comparten memoria unificada.

¿Está Vera disponible como procesador para ordenadores personales?

La información facilitada describe servidores, infraestructura cloud y sistemas destinados a laboratorios de IA. No se anuncia disponibilidad para ordenadores personales ni se comunica un precio de venta al público.

🔥 ¿Tienes un minuto? Dale al play, te van a engancharSuscríbete al canal
🔴 NUEVOASUS ROG Spatha X 65K: ¡12 BOTONES y 65.000 DPI! 🔥 #ShortsASUS ROG Spatha X 65K: ¡12 BOTONES y 65.000 DPI! 🔥 #Shorts
🔴 NUEVOASUS ROG celebra 20 AÑOS con esta ROG ALLY X20 🔥 | Gamescom 2026 #ShortsASUS ROG celebra 20 AÑOS con esta ROG ALLY X20 🔥 | Gamescom 2026 #Shorts
🔴 NUEVOASUS ROG presenta su BRUTAL DOCK de 260W 🔥 | Gamescom 2026 #ShortsASUS ROG presenta su BRUTAL DOCK de 260W 🔥 | Gamescom 2026 #Shorts
🔴 NUEVOASUS ROG desata sus nuevos MONITORES OLED para ESPORTS 🔥 | Gamescom 2026 #ShortsASUS ROG desata sus nuevos MONITORES OLED para ESPORTS 🔥 | Gamescom 2026 #Shorts
🔴 NUEVO25 de agosto de 202625 de agosto de 2026

Comentarios

Cargando comentarios…
QIDI Plus5