Modelo NVIDIA Nemotron 3.5 Lightning já está disponível no Amazon SageMaker JumpStart

O que foi anunciado

A AWS anunciou que o modelo NVIDIA Nemotron 3.5 Lightning está agora disponível no Amazon SageMaker JumpStart. Com isso, os clientes AWS passam a ter acesso ao modelo aberto mais rápido de sua categoria, projetado especificamente para cargas de trabalho com agentes persistentes e execução ágil de tarefas.

Para que serve o Nemotron 3.5 Lightning

O modelo foi desenvolvido com foco em automação empresarial de alto volume em diferentes domínios. Entre os casos de uso destacados pela NVIDIA estão:

  • Assistentes pessoais inteligentes
  • Processamento de documentos financeiros
  • Triagem em cibersegurança
  • Operações em telecomunicações

A proposta central é atender cenários onde agentes de IA precisam operar de forma contínua e com alta demanda de processamento.

Arquitetura técnica

O Nemotron 3.5 Lightning é construído sobre uma arquitetura híbrida de Mistura de Especialistas (MoE — Mixture-of-Experts), com 30 bilhões de parâmetros totais, mas apenas 3 bilhões de parâmetros ativos por passagem. Essa abordagem permite um desempenho expressivo sem o custo computacional de ativar toda a rede a cada inferência.

Os números de desempenho são relevantes: o modelo alcança até 4x mais throughput (aproximadamente 410 tokens por segundo) e 30% mais velocidade na conclusão de tarefas em comparação com modelos similares. Ele também suporta até 1 milhão de tokens de contexto, viabilizado pela técnica de decodificação especulativa DFlash.

O modelo foi destilado a partir do Nemotron 3 Ultra e possui integração nativa com os principais frameworks de agentes do mercado.

Abertura e flexibilidade para empresas

Um diferencial importante é que o Nemotron 3.5 Lightning foi treinado integralmente em conjuntos de dados abertos. Isso significa que empresas podem realizar pós-treinamento do modelo para adaptá-lo às suas próprias ferramentas, fluxos de trabalho e políticas internas — e fazer o deploy com total propriedade sobre a infraestrutura, seja em edge, on-premises ou nuvem.

Como acessar pelo SageMaker JumpStart

Com o SageMaker JumpStart, o deploy do modelo pode ser feito em poucos cliques, sem a necessidade de configurações complexas. Para começar, basta acessar o catálogo de modelos do SageMaker JumpStart pelo console do SageMaker, ou utilizar o SageMaker Python SDK para realizar o deploy diretamente na conta AWS.

Para mais detalhes sobre como fazer o deploy e utilizar modelos de fundação no SageMaker JumpStart, a AWS disponibiliza a documentação oficial do Amazon SageMaker JumpStart.

Fonte

NVIDIA Nemotron 3.5 Lightning model is now available on Amazon SageMaker JumpStart (https://aws.amazon.com/about-aws/whats-new/2026/01/nvidia-nemotron-3.5-lightning-on-sagemaker-jumpstart/)

Comments

Leave a Reply

Your email address will not be published. Required fields are marked *