A NVIDIA apresentou uma nova tecnologia para executar modelos de IA em múltiplos GPUs. A funcionalidade, chamada TensorRT multi-device inference, será suportada a partir da versão 11.0 do TensorRT. A empresa também destacou o Portable Computer, uma versão local do Perplexity Computer para PCs com GeForce RTX e RTX PRO com 24GB de VRAM.

A NVIDIA apresentou a tecnologia TensorRT multi-device inference, que permite que um modelo de IA execute em múltiplos GPUs. A funcionalidade, suportada a partir da versão 11.0 do TensorRT, facilita a distribuição de carga de processamento entre unidades gráficas. A NVIDIA menciona modelos como GLM 5.3 Flash e DeepSeek-v4.1 Flash para eficiência em IA local.

Mas a próxima geração de GPUs NVIDIA, possivelmente chamada RTX 60, teria sido adiada para 2028, segundo o insider Kopite7Kimi. A priorização do segmento de servidores afeta o lançamento de produtos para gaming. A AMD, por sua vez, pode incluir sua versão de neural lighting em sua próxima geração de hardware gráfico, respondendo à DLSS 5 da NVIDIA.

A empresa anunciou o suporte a programação nativa de GPU em Rust com CUDA Rust em setembro de 2026. A tecnologia neural lighting da AMD pode alimentar próximos consoles de Sony e Microsoft, com suporte limitado a RDNA 5.

A versão 11.0 do TensorRT suporta essa funcionalidade, facilitando a distribuição de carga de trabalho entre GPUs. Isso pode acelerar processos de inferência, especialmente em servidores com múltiplas unidades. Isso pode atrair desenvolvedores que buscam flexibilidade e desempenho. A AMD, por sua vez, pode incluir neural lighting em RDNA 5, que pode atingir desempenho semelhante ao RTX 5080.

A empresa já domina o mercado com soluções como DLSS e CUDA, mas agora quer se alinhar a uma nova tendência: programação em Rust. A AMD, por sua vez, desenvolve uma tecnologia de renderização neural para competir com a DLSS 5, possivelmente em RDNA 5.

Rumores apontam que a próxima geração de GPUs da NVIDIA, a RTX 60, pode chegar só em 2028, adiada novamente. A nova tecnologia da NVIDIA pode acelerar o processamento de modelos de IA em ambientes distribuídos, mas ainda falta saber como ela se compara a soluções de terceiros. A NVIDIA também está trabalhando em uma versão local do Perplexity Computer, chamada Portable Computer, que permite que agentes de IA executem tarefas em PCs com GPUs RTX. A versão do Perplexity Computer é acelerada por GPUs NVIDIA e usa modelos locais para analisar dados e organizar informações sem depender de servidores externos.

A NVIDIA amplia a capacidade de processamento de IA ao permitir que modelos rodem em múltiplos GPUs, aumentando a eficiência de distribuição de carga. A tecnologia TensorRT multi-device inference, integrada na versão 11.0, escala naturalmente sistemas distribuídos, reduzindo gargalos de processamento. Isso pode acelerar tarefas complexas, como análise de dados em tempo real.

A NVIDIA introduz suporte a programação em Rust com CUDA Rust, facilitando o desenvolvimento de kernels GPU em linguagem mais moderna e segura.

A nova funcionalidade será lançada em setembro de 2026, permitindo maior flexibilidade para programadores.

Ficha técnica

Ficha técnica
ItemEspecificação
DisponibilidadeWindows PCs com NVIDIA GeForce RTX e RTX PRO com 24GB de VRAM
Modelos suportadosGLM 5.3 Flash, DeepSeek-v4.1 Flash
Próxima geração de GPUs NVIDIARTX 60

Preço e data no Brasil não informados

  • Preço e data no Brasil não informados
  • Não há confirmação sobre o desempenho da tecnologia em GPUs integradas

Fontes

  1. Simplifying model serving across multiple gpus with nvidia tensorrt multi device integration in nvidia dynamo tritondeveloper.nvidia.com
  2. Introducing cuda rust two tracks for writing gpu kernelsdeveloper.nvidia.com
  3. Local ai perplexity windows pcsblogs.nvidia.com
  4. Placas nvidia rtx 60 chegam apenas em 2028 diz insideradrenaline.com.br
  5. Amd next gpus could bring neural rendering ps6techspot.com
  6. Amd next gpus could bring neural rendering ps6techspot.com