A NVIDIA está dando um passo importante no mercado de hardware com novas atualizações para suas plataformas DGX e RTX. As melhorias visam otimizar o suporte para novos modelos de Inteligência Artificial de código aberto, prometendo um desempenho robusto e eficiência no uso da memória.
Otimizações e Novos Recursos
No campo da geração de mídia, a NVIDIA trouxe suporte aprimorado para o modelo de vídeo LTX-2.5, permitindo funcionalidades como criação em múltiplos planos e edição generativa. Isso resulta em um aumento de desempenho de até 2x e uma redução de 40% no uso da memória de vídeo (VRAM) ao operar com GPUs RTX, DGX Spark e DGX Station.
Além disso, a plataforma agora suporta o Muse Glimmer, um modelo avançado da Meta que possui 30 bilhões de parâmetros. Este modelo é otimizado para operações contínuas, podendo realizar mais de 200 tokens por segundo com uma única RTX 5090.
Novas Funcionalidades para o DGX Spark
Focando na expansão, a NVIDIA introduziu o NVIDIA Sync Cluster Assistant, uma ferramenta que simplifica a conexão de múltiplos sistemas em um cluster unificado, otimizando o gerenciamento de cargas de trabalho e dados. Isso permite uma expansão significativa da memória e da capacidade de inferência sem complicações na configuração da rede.
A plataforma também conta com o NVIDIA Sync Resource Monitor, que fornece uma visão detalhada do consumo de CPU e GPU, tanto em tempo real quanto históricamente. Para completar, o Google Chrome ganhou uma versão otimizada para Linux ARM64, facilitando o uso do navegador diretamente do DGX OS.
Integração e Desempenho Aumentado
A NVIDIA também anunciou a integração com o Unsloth Desktop, um aplicativo de código aberto que oferece uma interface gráfica robusta para PCs. Esta ferramenta é ideal para a inferência de modelos locais, sintonia fina e pesquisa web, entre outras funções.
Com essas atualizações, a plataforma passou a suportar uma série de novos modelos de código aberto, incluindo:
- Cosmos 3 Edge (4 bilhões de parâmetros)
- MiniMax-H3 (33 bilhões)
- Laguna S 2.1 (118 bilhões)
- Inkling-Small (276 bilhões)
- DeepSeek V4-Flash (284 bilhões)
- Wan-Animate-2 (14 bilhões)
Testes realizados com o modelo Wan-Animate-2 demonstraram que a arquitetura da NVIDIA proporciona um desempenho significativamente superior, atingindo ganhos de até 26x em comparação com o chip M3 Ultra da Apple.
Essas novidades evidenciam o compromisso da NVIDIA em avançar no campo da Inteligência Artificial e nas demandas do mercado, oferecendo soluções eficazes e de alto desempenho para criadores de conteúdo e empresas que buscam excelência em processamento.

