A NVIDIA lança AIPerf para medir e otimizar inferência de modelos de linguagem. A ferramenta é usada em grandes centros de processamento de IA. A NVIDIA também apresenta outras tecnologias para melhorar eficiência energética.
A ferramenta é usada em grandes centros de processamento de IA, chamados de AI factories. A NVIDIA também apresenta a plataforma Vera Rubin, parte de sua estratégia para otimizar infraestrutura de IA. A DSX MaxLPS, outra tecnologia da empresa, pode aumentar a capacidade de processamento em até 40% dentro do mesmo orçamento energético.
A DSX MaxLPS foi validada por Lambda, que relatou um aumento de 23% na eficiência energética. A NVIDIA mostrou resultados com Vera Rubin e DSX MaxLPS, com aumento de até 24% na taxa de processamento de tokens. A AIPerf é integrada à estratégia de infraestrutura de IA da empresa, que inclui também a Groq 3 LPX e a DSX Flex.
A NVIDIA também revelou um programa de flexibilidade de carga para centros de processamento de IA, que permite ajustes dinâmicos de consumo energético. A DSX Flex, solução de gerenciamento de energia, ajusta o consumo com base em sinais da rede elétrica. A Groq 3 LPX oferece inferência de baixa latência e alta interatividade em ambientes de processamento de IA.
Ficha técnica
| Item | Especificação |
|---|---|
| Eficiência energética | Aumento de 23% em centros de processamento de IA |
| Taxa de processamento de tokens | Aumento de até 24% |
| Capacidade de processamento | Aumento de até 40% dentro do mesmo orçamento energético |
| Conectividade | NVLink |
Eficiência e velocidade ganham com novas tecnologias
AIPerf ajuda centros de processamento de IA a usar energia melhor. A NVIDIA DSX MaxLPS aumenta eficiência em 23% em centros de IA, segundo Lambda. Isso significa mais trabalho com menos eletricidade.
A ferramenta também pode elevar a taxa de processamento de tokens em 24%, melhorando a velocidade de respostas. Isso permite mais operações sem aumentar o consumo.
Essas tecnologias ajudam centros de IA a serem mais eficientes e flexíveis. A NVIDIA DSX MaxLPS foi validada em ambientes reais, mostrando ganhos concretos. A NVIDIA DSX Flex permite ajustar o consumo de energia de centros de IA conforme a rede elétrica, otimizando custos e reduzindo desperdícios.
Essas inovações combinam eficiência e desempenho, reforçando a capacidade dos centros de processamento de IA.
A ferramenta é parte de uma estratégia mais ampla que inclui plataformas como Vera Rubin, DSX MaxLPS e Groq 3 LPX. Essas tecnologias visam aumentar eficiência energética e capacidade de processamento em centros de IA (AI factories). A NVIDIA já trabalha com plataformas como Groq 3 LPX, que prioriza desempenho por watt.
A eficiência energética é um foco central em centros de processamento de IA, onde cada componente deve maximizar output dentro do orçamento de energia. AIPerf ajuda a medir e ajustar esses processos para garantir produtividade contínua.
AIPerf é usada para medir e ajustar a inferência de modelos de linguagem, garantindo que cada operação contribua para a produtividade contínua. A eficiência por watt é a métrica-chave para avaliar o valor das plataformas de IA.
AIPerf muda a forma de medir inferência de modelos de linguagem, permitindo ajustes dinâmicos em centros de processamento de IA. Isso ganha eficiência energética e aumenta a capacidade de processamento.
A plataforma Vera Rubin também ganhou melhorias com DSX MaxLPS, que eleva a taxa de processamento de tokens em 24%. Isso permite que as instalações operem de forma mais eficiente, adaptando-se às condições da rede.
Preço da AIPerf no Brasil não informado pela NVIDIA
- Preço da ferramenta AIPerf no Brasil não informado.
Fontes
- Benchmarking llm inference at scale with aiperfdeveloper.nvidia.com
- How nvidia nvlink 6 delivers multi layer resiliency for ai factoriesdeveloper.nvidia.com
- Ai infra summit vera rubin dsx energy efficiencies tokens per watt ai factoriesblogs.nvidia.com
- How nvidia groq 3 lpx deterministic execution drives power efficient high interactivity inference on nvidia vera rubindeveloper.nvidia.com
- Apple nvidia enterprise server ai inference marketdigitimes.com



