A NVIDIA apresentou uma nova tecnologia para executar modelos de IA em múltiplos GPUs. A funcionalidade, chamada TensorRT multi-device inference, será suportada a partir da versão 11.0 do TensorRT. A empresa também destacou o Portable Computer, uma versão local do Perplexity Computer para PCs com GeForce RTX e RTX PRO com 24GB de VRAM.
A NVIDIA apresentou a tecnologia TensorRT multi-device inference, que permite que um modelo de IA execute em múltiplos GPUs. A funcionalidade, suportada a partir da versão 11.0 do TensorRT, facilita a distribuição de carga de processamento entre unidades gráficas. A NVIDIA menciona modelos como GLM 5.3 Flash e DeepSeek-v4.1 Flash para eficiência em IA local.
Mas a próxima geração de GPUs NVIDIA, possivelmente chamada RTX 60, teria sido adiada para 2028, segundo o insider Kopite7Kimi. A priorização do segmento de servidores afeta o lançamento de produtos para gaming. A AMD, por sua vez, pode incluir sua versão de neural lighting em sua próxima geração de hardware gráfico, respondendo à DLSS 5 da NVIDIA.
A empresa anunciou o suporte a programação nativa de GPU em Rust com CUDA Rust em setembro de 2026. A tecnologia neural lighting da AMD pode alimentar próximos consoles de Sony e Microsoft, com suporte limitado a RDNA 5.
A versão 11.0 do TensorRT suporta essa funcionalidade, facilitando a distribuição de carga de trabalho entre GPUs. Isso pode acelerar processos de inferência, especialmente em servidores com múltiplas unidades. Isso pode atrair desenvolvedores que buscam flexibilidade e desempenho. A AMD, por sua vez, pode incluir neural lighting em RDNA 5, que pode atingir desempenho semelhante ao RTX 5080.
A empresa já domina o mercado com soluções como DLSS e CUDA, mas agora quer se alinhar a uma nova tendência: programação em Rust. A AMD, por sua vez, desenvolve uma tecnologia de renderização neural para competir com a DLSS 5, possivelmente em RDNA 5.
Rumores apontam que a próxima geração de GPUs da NVIDIA, a RTX 60, pode chegar só em 2028, adiada novamente. A nova tecnologia da NVIDIA pode acelerar o processamento de modelos de IA em ambientes distribuídos, mas ainda falta saber como ela se compara a soluções de terceiros. A NVIDIA também está trabalhando em uma versão local do Perplexity Computer, chamada Portable Computer, que permite que agentes de IA executem tarefas em PCs com GPUs RTX. A versão do Perplexity Computer é acelerada por GPUs NVIDIA e usa modelos locais para analisar dados e organizar informações sem depender de servidores externos.
A NVIDIA amplia a capacidade de processamento de IA ao permitir que modelos rodem em múltiplos GPUs, aumentando a eficiência de distribuição de carga. A tecnologia TensorRT multi-device inference, integrada na versão 11.0, escala naturalmente sistemas distribuídos, reduzindo gargalos de processamento. Isso pode acelerar tarefas complexas, como análise de dados em tempo real.
A NVIDIA introduz suporte a programação em Rust com CUDA Rust, facilitando o desenvolvimento de kernels GPU em linguagem mais moderna e segura.
A nova funcionalidade será lançada em setembro de 2026, permitindo maior flexibilidade para programadores.
Ficha técnica
| Item | Especificação |
|---|---|
| Disponibilidade | Windows PCs com NVIDIA GeForce RTX e RTX PRO com 24GB de VRAM |
| Modelos suportados | GLM 5.3 Flash, DeepSeek-v4.1 Flash |
| Próxima geração de GPUs NVIDIA | RTX 60 |
Preço e data no Brasil não informados
- Preço e data no Brasil não informados
- Não há confirmação sobre o desempenho da tecnologia em GPUs integradas
Fontes
- Simplifying model serving across multiple gpus with nvidia tensorrt multi device integration in nvidia dynamo tritondeveloper.nvidia.com
- Introducing cuda rust two tracks for writing gpu kernelsdeveloper.nvidia.com
- Local ai perplexity windows pcsblogs.nvidia.com
- Placas nvidia rtx 60 chegam apenas em 2028 diz insideradrenaline.com.br
- Amd next gpus could bring neural rendering ps6techspot.com
- Amd next gpus could bring neural rendering ps6techspot.com



