GLM-5.2 FP8, NVIDIA Nemotron-Nano-12B-v2 e GLM-OCR chegam ao Amazon SageMaker JumpStart

Novos modelos de fundação disponíveis no SageMaker JumpStart

A AWS anunciou a disponibilidade de três novos modelos de fundação no Amazon SageMaker JumpStart: o GLM-5.2 FP8 e o GLM-OCR, ambos da Z.ai, e o NVIDIA-Nemotron-Nano-12B-v2, da NVIDIA. A chegada desses modelos amplia o portfólio de opções disponíveis para clientes que desenvolvem soluções de inteligência artificial na infraestrutura da AWS.

Cada um dos três modelos traz um conjunto de capacidades especializadas, cobrindo desde tarefas agênticas de longo horizonte até compreensão avançada de documentos. Veja o que cada um oferece.

GLM-5.2 FP8: foco em engenharia agêntica e contexto de longo horizonte

O GLM-5.2 FP8 foi desenvolvido para tarefas de longo horizonte e fluxos de trabalho de engenharia agêntica — incluindo o ciclo completo de desenvolvimento de software, desde a definição de requisitos até o deploy. Em relação ao seu antecessor, o GLM-5.1, o modelo representa um salto significativo nesse tipo de tarefa.

Um dos destaques é a janela de contexto de 1 milhão de tokens, disponível pela primeira vez de forma realmente utilizável. Isso permite que o modelo processe contextos de nível de projeto, execute tarefas de longa duração com consistência, siga padrões de engenharia e conclua fluxos de desenvolvimento completos em uma única execução.

NVIDIA-Nemotron-Nano-12B-v2: eficiência e raciocínio em um modelo compacto

O NVIDIA-Nemotron-Nano-12B-v2 se destaca pela combinação entre raciocínio unificado e alto throughput de inferência — características que o tornam adequado para aplicações empresariais que exigem tanto precisão quanto eficiência operacional.

O modelo utiliza uma arquitetura híbrida que combina Mamba-2 e Transformer, com janela de contexto de 128 mil tokens. Antes de apresentar a resposta final, ele gera traços de raciocínio intermediários. Com apenas 12 bilhões de parâmetros, o Nemotron-Nano-12B-v2 entrega acurácia comparável ou superior à de modelos abertos de referência, com throughput de inferência até 6 vezes maior.

GLM-OCR: compreensão de documentos complexos em tempo real

O GLM-OCR foi projetado para entender documentos do mundo real com alta precisão e baixa latência. O modelo lida com uma variedade ampla de materiais: PDFs digitalizados, anotações manuscritas, artigos acadêmicos com fórmulas, tabelas multicolunares, documentação de código e textos multilíngues.

Com apenas 0,9 bilhão de parâmetros, esse modelo multimodal reconstrói estruturas, tabelas e fórmulas em formatos limpos como Markdown, JSON ou LaTeX. Sua latência é baixa o suficiente para uso em serviços em tempo real e dispositivos de borda — o que o torna especialmente útil em pipelines de processamento em larga escala e extração de notas fiscais.

Como começar a usar no SageMaker JumpStart

Com o SageMaker JumpStart, qualquer um desses modelos pode ser implantado com poucos cliques, diretamente pelo catálogo de modelos no console do SageMaker ou via SDK Python do SageMaker. Para mais detalhes sobre como implantar e utilizar modelos de fundação no SageMaker JumpStart, consulte a documentação oficial do Amazon SageMaker JumpStart.

Fonte

GLM-5.2 FP8, NVIDIA-Nemotron-Nano-12B-v2 and GLM-OCR models now available on Amazon SageMaker JumpStart (https://aws.amazon.com/about-aws/whats-new/2026/01/glm-5.2-fp8-nemotron-nano-12b-v2-glm-ocr-on-sagemaker-jumpstart/)

Comments

Leave a Reply

Your email address will not be published. Required fields are marked *