A Nvidia anunciou nesta terça-feira, 11 de agosto de 2026, o Nemotron 3.5 Lightning, um modelo de inteligência artificial de código aberto projetado para empresas que buscam reduzir custos com processamento de tokens sem renunciar a recursos avançados.
A apresentação foi detalhada pela executiva Kari Briski, vice‑presidente de software de IA generativa para empresas da Nvidia, durante o The Wall Street Journal Leadership Institute.
Nvidia aposta em modelos menores e roteamento para controlar despesas
Além do Nemotron 3.5 Lightning, a companhia lançou o Nemo Switchyard, uma biblioteca de código aberto criada para encaminhar diferentes tarefas de agentes de IA a modelos distintos. A ferramenta visa equilibrar qualidade, velocidade e custo, além de diminuir a exposição de informações proprietárias das empresas.
O Nemotron 3.5 Lightning foi desenvolvido com uma arquitetura mais compacta, mantendo conhecimentos e capacidades presentes em modelos maiores. Segundo a Nvidia, isso permite às organizações utilizar uma alternativa menos dispendiosa em aplicações que não exigem modelos de maior porte.
Briski explicou que a lógica econômica por trás da estratégia é evitar o uso de modelos grandes em tarefas rotineiras. O Nemo Switchyard complementa esse raciocínio ao decidir qual modelo deve responder a cada demanda, ponderando fatores como qualidade da resposta, tempo de processamento e custo por token.
O sistema de roteamento foi criado inicialmente para suprir uma necessidade interna: controlar o volume de tokens consumidos pelas aplicações de IA da própria Nvidia, mantendo ao mesmo tempo proteção sobre propriedade intelectual.
Outro ponto destacado por Briski é a proteção de dados empresariais. Organizações que atuam em áreas especializadas — por exemplo, segurança cibernética e ciência dos materiais — têm receio de compartilhar conhecimento estratégico com fornecedores de IA que possam vir a competir nesses mercados.
Conforme a executiva, modelos abertos oferecem maior possibilidade de adaptação, inclusive por meio de treinamento com dados proprietários, o que permite mensurar ganhos em eficiência e precisão.
Imagem: Ap
O anúncio ocorre um dia após a Meta Platforms apresentar o Muse Glimmer, descrito pela empresa como um modelo aberto pequeno o suficiente para rodar em um Mac ou PC com apenas uma GPU de consumo.
Paralelamente, a Nvidia tem firmado acordos com Apollo, Blackstone, Goldman Sachs e KKR para criar plataformas de financiamento de capacidade computacional, com a meta de disponibilizar mais de US$ 500 bilhões em capital para clientes.
O contexto corporativo abordado na divulgação inclui a Anthropic, que busca investidores antes de uma possível abertura de capital avaliada em US$ 965 bilhões, além de um contrato de US$ 9,1 bilhões por 20 anos entre a empresa e a Riot Platforms para garantir capacidade de data center no Texas.
No setor de semicondutores, a Intel comunicou intenção de levantar US$ 20 bilhões por meio da oferta pública de 210,5 milhões de ações a US$ 95 cada, afirmando que observa forte demanda de clientes relacionada ao avanço dos investimentos em computação para inteligência artificial.
As iniciativas da Nvidia combinam lançamento de produto, ferramentas de roteamento e parcerias financeiras com o objetivo de oferecer alternativas mais econômicas e controladas para empresas que adotam soluções de IA.
Com informações de Olhardigital

Gudyê GR6 é editor-chefe e especialista em tendências musicais e entretenimento na GR6, a maior produtora de funk do Brasil. Com anos de experiência no mercado fonográfico, Gudyê lidera a equipe de conteúdo trazendo as últimas notícias sobre música, cultura urbana. Autor do Post: Gudyê GR6