NVIDIA na IFA: A IA Local vai explodir?

Esqueça a Nuvem! A IA MAIS PODEROSA Chega Direto no Seu PC: NVIDIA e Microsoft Anunciam a Revolução Local!

Olá, pessoal! Aqui é o Lucas Tech, e se preparem porque o mundo da inteligência artificial está prestes a mudar de vez – e para muito melhor! A NVIDIA e a Microsoft, junto com vários parceiros incríveis, estão unindo forças para trazer a IA de ponta para DENTRO do seu PC. Sim, você leu certo: a IA mais avançada, rodando localmente, mais rápida e com ferramentas que facilitam a vida de todo mundo!

Imagina ter agentes de IA superpoderosos agindo direto na sua máquina, sem depender da nuvem? Isso não é ficção científica, é a realidade que chega em breve, com os novos PCs NVIDIA RTX Spark e muitas outras novidades. Vamos mergulhar nessa!

A IA de Fronteira Fica Local!

A inteligência de ponta está chegando mais perto de você! Na IFA 2026 (anota aí!), a NVIDIA, Microsoft e seus parceiros estão unindo forças para turbinar a inferência local e liberar ferramentas que vão facilitar demais a configuração e execução de agentes de IA direto no hardware da NVIDIA. E tem mais: novos PCs NVIDIA RTX Spark compactos chegam em outubro para dar aos entusiastas de IA, desenvolvedores e criadores novas formas de rodar agentes super capazes, localmente e com total segurança.

As Grandes Novidades do Anúncio:

  • Suporte simplificado para IA local em GPUs NVIDIA: Chegando no Hermes Agent, OpenClaw e Perplexity Portable Computer. Preparem-se para usar IA sem dor de cabeça!
  • Inferência local até 1.9x mais rápida: Novas otimizações do llama.cpp e vLLM já estão disponíveis, inclusive via LM Studio e Ollama. É velocidade pura!
  • NVIDIA PAIR: Essa é demais! Um "Roteador de IA Pessoal" que distribui inteligentemente a inferência de IA entre os PCs da sua rede local. Adeus, PCs ociosos!
  • NVIDIA RTX Spark chega em outubro: Com PCs novinhos da Lenovo e Acer. Grandes nomes como Electronic Arts, Embark e Ubisoft já estão trazendo seus jogos mais esperados para a plataforma. Preparem-se!

Agosto Bombou: Novidades em IA Local!

Agosto foi um mês de tirar o fôlego para a IA local. Vários modelos incríveis foram lançados, e a maioria deles roda nas suas máquinas NVIDIA!

  • Nemotron 3.5 Lightning: Um modelo gigante de 30 bilhões de parâmetros que roda em PCs NVIDIA RTX, Workstations RTX PRO, DGX Spark e Jetson. Já dá pra começar a usar o Nemotron 3.5 Lightning hoje mesmo!
  • GLM-5.3-Flash da Z.ai: Um modelo multimodal MoE (Mixture-of-Experts) que traz a IA "agente" para a DGX Station.
  • Qwen3.8-Flash-Next e Qwen3.8-27B: Modelos abertos da Qwen, multimodais e otimizados para tarefas de agente e codificação em GPUs NVIDIA. Rodam localmente na DGX Spark e DGX Station, incluindo o Qwen3.8-Flash-Next e o Qwen3.8-27B.
  • LTX 2.5 da LTX: Um modelo de geração de vídeo otimizado para GPUs NVIDIA RTX, DGX Spark e DGX Station, com melhorias NVFP4, FastVideo e ComfyUI para uma geração local mais rápida e eficiente em memória. Confira o LTX 2.5.
  • MiniMax-H3: Outro modelo de geração de vídeo com áudio sincronizado, rodando localmente em GPUs NVIDIA via ComfyUI. A FastVideo se juntou aos pesquisadores da NVIDIA e lançou o FastH3, uma versão que melhora a performance em até 7x! Receitas otimizadas para GPUs NVIDIA RTX e DGX Spark vêm aí. Veja o MiniMax-H3.
  • Muse Glimmer da Meta: Um modelo de 30 bilhões de parâmetros para codificação e agentes, rodando localmente em PCs GeForce RTX, DGX Spark, DGX Station e Jetson. A NVIDIA também lançou a quantização NVFP4 com suporte para DGX Spark, para um uso de memória ainda mais eficiente. Saiba mais sobre o Muse Glimmer.
  • DeepSeek v4 Flash: Um modelo MoE gigantesco (284 bilhões de parâmetros, com 13 bilhões ativos!) que pode rodar localmente em clusters de 2x DGX Spark e DGX Station. Veja o DeepSeek v4 Flash.

Agentes Locais, Instalação Simplificada!

Antigamente, fazer um agente de IA rodar localmente era quase uma saga: escolher modelo, servidor de inferência compatível, ajustar configurações… ufa! Mas essa dificuldade está com os dias contados nos sistemas RTX e DGX.

Três dos apps de agentes mais usados vão oferecer uma configuração de modelo local super simplificada no Windows, todos construídos em cima do llama.cpp e incorporando as últimas otimizações de inferência da NVIDIA. A ideia é reduzir a configuração manual e facilitar a vida para colocar seus agentes locais em ação.

Perplexity Portable Computer

O Perplexity lançou seu agente Portable Computer no mês passado, que simplifica a execução local em sistemas Linux como o NVIDIA DGX Spark. E o melhor: logo chega para Windows, levando essa configuração otimizada para mais usuários de PC!

Com ele, você faz fluxos de trabalho completos localmente, sem gastar créditos, mas pode escalar seletivamente partes da tarefa para um dos mais de 15 modelos de fronteira na nuvem, se precisar de pesquisa ou raciocínio adicional. O Portable Computer pede permissão antes de enviar conteúdo para a nuvem, ajudando você a manter informações sensíveis no seu dispositivo.

Alguns exemplos de uso que são demais:

  • Engenharia: Revise PRs (pull requests) abertos no GitHub, classificando-os em "pronto", "bloqueado", "parado" ou "precisa de revisão". Ele até identifica e corrige documentações desatualizadas!
  • Finanças: Aponte o agente para dois anos de extratos de corretagem, declarações de imposto e ele rastreia os custos desnecessários e a carga tributária, citando cada valor ao arquivo e página exatos – tudo sem que um documento sequer chegue a um chatbot!
  • Startups: Pergunte por que a ativação de usuários estagnou, e o agente analisa a exportação do funil localmente para encontrar onde novos cadastros estão caindo entre a instalação e a primeira tarefa concluída, depois posta os insights direto no Slack da equipe.

Dá uma conferida no Portable Computer hoje mesmo!

Hermes Agent

O Hermes Agent, desenvolvido pela Nous Research, é um agente de propósito geral usado por milhões, conhecido pela sua confiabilidade e capacidade de autoaperfeiçoamento. Independente de modelo ou provedor, o Hermes é feito para rodar o dia todo em sistemas locais, ou seja, perfeito para PCs RTX, workstations RTX PRO e DGX Spark.

A configuração de modelos locais no Hermes vai oferecer aos usuários uma instalação com apenas um clique em sistemas RTX e DGX no Windows! O agente detectará automaticamente a GPU NVIDIA, selecionará um modelo e configuração apropriados e o executará através do llama.cpp integrado com as otimizações de inferência da NVIDIA já embutidas, eliminando downloads manuais e ajustes. O suporte para Linux está chegando em breve.

Uma vez rodando, o Hermes funciona como em qualquer outro lugar. Ele usa ferramentas, mantém o contexto entre tarefas, lembra informações entre sessões e cria habilidades reutilizáveis com o tempo, permitindo que o agente se torne mais capaz com o uso contínuo. Rodar o modelo localmente na GPU mantém o desempenho rápido enquanto os dados permanecem no sistema.

https://www.youtube.com/watch?v=TaqNUvMCRBs" width="100%" height="auto" style="border:none;

A instalação com um clique para modelos locais já está disponível no Windows, com suporte chegando em breve para Linux. Saiba mais sobre o Hermes Agent.

OpenClaw

O OpenClaw se tornou um dos projetos que definem o movimento de agentes abertos – o maior projeto de IA no GitHub, com mais de 380 mil estrelas e uma comunidade que cresce rápido, criando ferramentas e habilidades em pesquisa, engenharia, gerenciamento de projetos e produtividade do dia a dia.

NVIDIA, Microsoft e OpenClaw têm trabalhado juntos para tornar essa experiência mais fácil de configurar em PCs Windows. Para reduzir a dificuldade inicial, o OpenClaw Windows App simplifica o processo de configuração de um modelo local otimizado em qualquer GPU RTX com pelo menos 24GB de VRAM.

Saiba mais no blog do OpenClaw.

Mais Velocidade para Seus Agentes Locais!

A performance da inferência é crítica para manter os agentes locais responsivos. A NVIDIA continua a colaborar com as comunidades open-source llama.cpp e vLLM para acelerar as cargas de trabalho de agentes em todas as plataformas NVIDIA locais.

Gráfico mostrando ganhos de desempenho da inferência local com otimizações da NVIDIA.

O llama.cpp entrega até 1.9x mais throughput (vazão) através de otimizações de kernel em uma GeForce RTX 5090, técnicas aprimoradas de decodificação especulativa e prefill mais rápido. É muita velocidade!

O vLLM entrega 1.2x mais na RTX PRO 6000 Blackwell Workstation Edition e até 1.4x em dois clusters DGX Spark. Novos kernels de atenção XQA no FlashInfer e otimizações de backend ajudam a acelerar a inferência em ambas as plataformas.

Esses ganhos já estão disponíveis nos backends de inferência llama.cpp e vLLM. E você pode experimentá-los também através dos aplicativos LM Studio e Ollama.

NVIDIA PAIR: Dê Vida aos PCs Ociosos!

Mais da metade dos lares americanos tem dois ou mais PCs, e grande parte desse poder de computação fica parado ao longo do dia. O NVIDIA Personal AI Router (PAIR) é uma ferramenta gratuita e open source que coloca esses sistemas para trabalhar juntos na IA local!

https://www.youtube.com/watch?v=GjGM-ZKQMa0" width="100%" height="auto" style="border:none;

Fluxos de trabalho com agentes geralmente dividem tarefas complexas em jobs menores que podem rodar em paralelo, mas o desempenho pode cair quando cada requisição está competindo pela mesma GPU. O PAIR automaticamente descobre PCs compatíveis em uma rede local e direciona requisições de inferência independentes para o sistema que tiver capacidade. Ele funciona com Ollama e LM Studio e pode se adaptar conforme dispositivos entram ou saem da rede.

Por exemplo, um usuário pode pedir ao Hermes para criar um plano de "Reorganização de Domingo" (Sunday Reset), organizando uma caixa de entrada lotada e priorizando o que precisa de atenção agora, o que pode esperar e o que pode ser ignorado. O Hermes pode dividir esse trabalho entre vários subagentes, enquanto o PAIR distribui esses trabalhos entre os PCs disponíveis, em vez de fazer todos esperarem em uma única GPU.

O resultado? Mais poder de computação para seus agentes locais, com mais tarefas rodando em paralelo e a flexibilidade de mover cargas de trabalho de IA para outro PC enquanto o sistema principal está sendo usado para jogar, criar ou outras atividades.

O beta do NVIDIA PAIR já está disponível para Windows, macOS e Linux através de interfaces gráficas e de terminal, suportando GPUs NVIDIA GeForce RTX Série 20 e mais novas, GPUs NVIDIA RTX PRO (arquitetura Turing e mais novas), NVIDIA DGX Spark e chips Apple M4 ou posteriores.

Confira o blog de tecnologia da NVIDIA para começar com o NVIDIA PAIR!

Edição de Fotos Poderosa com Cyberlink PhotoDirector AI PC Mode no RTX Spark!

Modelos abertos de imagem e vídeo permitem que artistas experimentem com modelos de IA criativa diretamente nos PCs. Isso significa mais liberdade para experimentar, iterar e explorar conceitos e ideias, sem a temida "ansiedade dos tokens" e mantendo o trabalho mais privado e no dispositivo.

O novo PhotoDirector AI PC Mode da CyberLink é uma das primeiras aplicações a integrar esses modelos de difusão diretamente em um software criativo, transformando-os em ferramentas ao alcance dos artistas. Chegando com o PhotoDirector 365 e otimizado para NVIDIA RTX Spark em seu lançamento, o AI PC Mode oferece aos usuários ferramentas de edição com IA para edição generativa, aprimoramento de imagem, remoção de objetos e distrações, remoção e substituição de fundo, refinamento de retratos e a criação de visuais totalmente novos – com a flexibilidade de escolher entre processamento local ou na nuvem, dependendo da tarefa.

Nas GPUs NVIDIA, o PhotoDirector usa TensorRT-RTX e FP8 para acelerar a IA local.

Comece a usar o software de edição de fotos PhotoDirector 365 da Cyberlink e saiba mais sobre o PhotoDirector AI PC Mode, que será lançado com o RTX Spark em outubro.

PCs NVIDIA RTX Spark Windows Chegam em Outubro de 2026!

Os aguardados NVIDIA RTX Spark estão chegando em outubro! E na IFA 2026, os parceiros já estão mostrando o hardware. Novos designs foram anunciados, como o conceito de desktop compacto RTX Spark da Acer, e os Lenovo Yoga Pro 9n e Yoga 9n 2-em-1.

O RTX Spark é um novo começo para PCs Windows. Um PC feito para criadores, gamers e agentes de IA. Com uma poderosa GPU RTX Blackwell de 1 Petaflop, até 128GB de memória unificada e uma eficiente CPU Grace de 20 núcleos, ele entrega performance e eficiência incríveis. Esse "superchip" permite laptops finos com bateria para o dia todo e desktops compactos para rodar agentes sempre ativos. Junto com a nova estrutura Windows Agent, ele permite que agentes funcionem com segurança em segundo plano sob controle do sistema operacional.

Na semana passada, na Gamescom, Electronic Arts, Embark e Ubisoft estavam entre as últimas editoras e desenvolvedoras de jogos a trazer seus títulos de sucesso para os PCs NVIDIA RTX Spark Windows. Elas se juntam a editoras que anunciaram suporte ao RTX Spark na COMPUTEX em maio, incluindo KRAFTON, NetEase, Riot Games e XBOX. Leia mais aqui.

Cadastre-se para ser notificado quando os laptops e desktops RTX Spark estiverem disponíveis!

FicaADica: Mais Atualizações da NVIDIA em IA Local!

Se você perdeu alguma coisa, fica tranquilo, o Lucas Tech te atualiza:

  • 🎮 NVIDIA na Gamescom com Novas Tecnologias RTX e Jogos: A NVIDIA lançou o DLSS 4.5 Ray Reconstruction, que melhora a qualidade de imagem em jogos com Ray Tracing. Além de novos anúncios RTX para 007 First Light, CONTROL Resonant e Gears of War: E-Day, e mais suporte de jogos para o NVIDIA RTX Spark.
  • 🐋 Apresentando DeepSeek Harness: A nova ferramenta open source da DeepSeek, DeepSeek Harness, se une ao DeepSeek-V4-Flash para turbinar fluxos de trabalho de codificação de agentes locais em NVIDIA DGX Station e setups multi-DGX Spark.
  • 📊 MLPerf Client v2.0 Expande Benchmarking de PCs com IA: A MLCommons lançou o MLPerf Client v2.0, desenvolvido com a NVIDIA. Essa atualização traz novos benchmarks para IA de agentes e geração de imagens, além de testes expandidos de LLMs para cargas de trabalho de IA local no mundo real.

Minha Visão

Pensa só: a IA sempre foi algo "lá na nuvem", rodando em servidores gigantes. Mas essa mudança para a IA local, direto no nosso PC, é revolucionária. Para mim, isso significa mais privacidade, mais controle, menos latência e a democratização do poder da inteligência artificial. Como entusiasta, ver essa tecnologia de ponta se tornando acessível para criadores, gamers e desenvolvedores no dia a dia é algo que me empolga demais. É o futuro da computação pessoal, onde seu PC não é só uma máquina, mas um parceiro inteligente, sempre pronto para ajudar, sem mandar seus dados para longe. É a autonomia que tanto sonhamos!

E aí, pessoal, vocês estão prontos para essa nova era da IA no seu PC? O que vocês fariam com tanto poder local na palma da sua mão? Deixem suas ideias nos comentários!

Referência: Matéria Original

Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *

Rolar para cima
Tutorial Elevenlabs