Hoje, no Consumer Electronics Show, o CEO da Nvidia, Jensen Huang, anunciou oficialmente a nova arquitetura de computação Rubin da empresa, descrevendo-a como a vanguarda em hardware de IA. A nova arquitetura está atualmente em produção e será aprimorada no segundo semestre deste ano.

“Vera Rubin foi projetado para enfrentar um desafio fundamental que temos: a quantidade cada vez maior de computação necessária para a IA”, disse Huang ao público. “Hoje posso afirmar que o Vera Rubin está em pleno funcionamento.”

Arquitetura Rubin anunciada pela primeira vez em 2024é o mais recente no ciclo contínuo de desenvolvimento de hardware da Nvidia que a transformou na empresa mais valiosa do mundo. A arquitetura Rubin substitui a arquitetura Blackwell, que substitui as arquiteturas Hopper e Lovelace.

Os chips Rubin já estão programados para uso com quase todos os principais provedores de nuvem, incluindo uma parceria de alto nível com a Nvidia. humano, OpenAIe Amazon Web Services. O sistema Rubin também é usado nas seguintes áreas: Supercomputador Blue Lion da HPE e Próximo supercomputador Doudna No Laboratório Nacional Lawrence Berkeley

Origem do nome Astrônoma Vera Florence Cooper RubinA arquitetura Rubin consiste em seis chips separados projetados para funcionarem juntos. Embora as GPUs Rubin estejam no centro, a arquitetura também aborda gargalos crescentes no armazenamento e na interconexão com novas melhorias nos sistemas Bluefield e NVLink, respectivamente. A arquitetura também inclui uma nova CPU Vera projetada para inferência de agentes.

Dion Harris, diretor sênior de soluções de infraestrutura de IA da Nvidia, explicou os benefícios do novo armazenamento enquanto apontava para o aumento da demanda de memória relacionada ao cache dos sistemas modernos de IA.

“À medida que começamos a habilitar novos tipos de fluxos de trabalho, como IA de agente e tarefas de longa duração, isso coloca muito estresse e requisitos no cache KV”, disse Harris a repórteres em uma teleconferência. Sistema de armazenamento usado por modelos de IA para compactar entradas. “Portanto, introduzimos uma nova camada de armazenamento que se conecta fora do dispositivo de computação, permitindo-nos dimensionar nosso pool de armazenamento com mais eficiência.”

evento de crise tecnológica

São Francisco
|
13 a 15 de outubro de 2026

Como esperado, a nova arquitetura também apresenta avanços significativos em velocidade e eficiência energética. De acordo com os testes da Nvidia, a arquitetura Rubin roda 3,5x mais rápido que a arquitetura Blackwell anterior para tarefas de treinamento de modelo e 5x mais rápido para tarefas de inferência, atingindo até 50 petaflops. A nova plataforma também suporta 8x mais computação de inferência por watt.

As novas capacidades do Rubin surgem em meio a uma corrida acirrada para construir infraestrutura de IA. Nesta corrida, tanto os laboratórios de IA quanto os provedores de nuvem competem pelos chips Nvidia e pelos equipamentos necessários para alimentá-los. Na conferência de resultados de outubro de 2025, o Sr. Huang fez as seguintes previsões: Entre US$ 3 trilhões e US$ 4 trilhões Os próximos cinco anos serão gastos em infraestrutura de IA.

Source link