A Nvidia anunciou oficialmente o lançamento do Nemotron 3.5 Lightning, um modelo de inteligência artificial baseado na arquitetura de “mistura de especialistas” (MoE, na sigla em inglês). A nova tecnologia conta com um total de 30 bilhões de parâmetros, operando com três bilhões ativos de forma simultânea durante o processamento das demandas.
O sistema adota uma estrutura híbrida avançada que une tecnologias como Mamba-2, blocos MoE e camadas especializadas de atenção, proporcionando uma ampla janela de contexto de até um milhão de tokens. No entanto, um dos maiores diferenciais da novidade está na política de licenciamento adotada pela companhia.
O modelo é disponibilizado sob a licença OpenMDW-1.1, que autoriza formalmente o uso comercial sem custos. Além disso, a desenvolvedora abriu o acesso tanto aos dados brutos quanto às receitas utilizadas no treinamento, acompanhadas dos respectivos pesos computacionais. Dessa forma, organizações de todos os portes podem baixar, adaptar e implementar a ferramenta de maneira totalmente gratuita, dispensando pagamentos ou autorizações préviassociais ou burocráticas.
Análise de desempenho e métricas operacionais
A fabricante destaca que a nova ferramenta atinge uma velocidade de geração de dados até quatro vezes superior quando comparada a alternativas de porte semelhante em ambiente controlado. Contudo, avaliações práticas voltadas para a execução de tarefas complexas por agentes autônomos revelam um cenário mais equilibrado.
Durante os testes padronizados no benchmark PinchBench, o modelo registrou um índice de precisão de 86%, conseguindo concluir 10.000 tarefas com uma agilidade 30% superior ao Qwen 3.6 35B, desenvolvido pela Alibaba, mantendo patamares equivalentes de exatidão. Especialistas apontam que a discrepância entre a velocidade de laboratório (quatro vezes maior) e o ganho real de produtividade (30%) reforça a importância de analisar criticamente as métricas divulgadas pelo mercado de tecnologia.
Em outras avaliações importantes do setor, o sistema obteve pontuações sólidas, marcando 81,94 pontos no MMLU Pro, 75,44 no GPQA Diamond e 51,56 no SWE-bench Verified, após um processo de pré-treinamento massivo que ultrapassou a marca de 20 trilhões de tokens.
Estratégia de integração e redução de custos

Créditos: NVIDIA.
Junto ao lançamento do modelo principal, a corporação apresentou o NeMo Switchyard, uma biblioteca de código aberto projetada para gerenciar fluxos de trabalho. A ferramenta tem a função de direcionar cada etapa de uma operação para o recurso computacional mais adequado. Enquanto o planejamento estratégico fica a cargo de modelos de ponta mais custosos, a execução rotineira é repassada para o Lightning.
Testes práticos conduzidos pela LangChain com 145 tarefas demonstraram que a divisão inteligente de demandas entre o Lightning e soluções avançadas como o Claude Opus 4.8 pode gerar uma redução de até 74% nos custos operacionais, sacrificando apenas cerca de seis pontos percentuais na precisão global.
A proposta central da companhia não é fornecer o modelo mais isolado e absoluto do mercado, mas sim assumir a maior parte do volume de trabalho diário, estimada em 93% das chamadas corporativas, que não exigem processamento de ponta.
Perspectivas futuras e expansão do ecossistema de hardware
A decisão de disponibilizar tecnologia de ponta de forma gratuita está diretamente ligada ao modelo de negócios da empresa. Sistemas mais acessíveis incentivam o aumento no volume de inferências, processo que depende diretamente do uso de unidades de processamento gráfico. Ao democratizar o software, a organização fomenta a demanda global pelo seu próprio ecossistema de hardware.
Seguindo essa estratégia de expansão, a corporação já estaria mobilizada no desenvolvimento do futuro Nemotron 4, projeto que deve ultrapassar a marca de um trilhão de parâmetros. A expectativa do mercado é de que essa nova versão chegue ao público até o final do ano, acirrando a competição com outros grandes modelos abertos internacionais.
Apesar da imensa escala projetada, a futura versão ainda se manterá abaixo de concorrentes de peso no cenário asiático, a exemplo do Kimi K3, desenvolvido pela Moonshot, que atualmente ostenta o recorde de maior modelo de inteligência artificial de código aberto já lançado.
Fonte:: adrenaline.com.br




