GPT-5.6 Sol, Terra e Luna da OpenAI já estão disponíveis no Amazon Bedrock

A família GPT-5.6 chega ao Amazon Bedrock

A AWS anunciou a disponibilidade geral dos modelos GPT-5.6 Sol, Terra e Luna da OpenAI no Amazon Bedrock. A novidade traz a família de modelos mais avançada da OpenAI até hoje para o motor de inferência de nova geração da plataforma, projetado para alto desempenho, segurança e confiabilidade.

O contexto é relevante: organizações que escalam agentes autônomos e produtos com IA precisam de inteligência de fronteira que funcione de forma confiável ao longo de centenas de etapas — de agentes de código que entregam software em produção a pesquisas de segurança cibernética que exploram novas superfícies de ataque, passando por fluxos de trabalho de genômica que analisam sequências genéticas inteiras de ponta a ponta. Essas cargas de trabalho rodam sobre dados sensíveis, exigem throughput consistente sob demanda imprevisível e operam em ambientes onde residência de dados e segurança não são negociáveis.

Os preços do GPT-5.6 no Bedrock seguem as tarifas de primeira parte da OpenAI, e o uso conta para os compromissos existentes com a AWS.

Um novo sistema de nomenclatura e três camadas de capacidade

O GPT-5.6 inaugura um novo sistema de nomenclatura da OpenAI: o número identifica a geração, enquanto Sol, Terra e Luna identificam camadas de capacidade duráveis que podem evoluir em seu próprio ritmo.

GPT-5.6 Sol — raciocínio avançado

O Sol é o modelo de raciocínio principal e o mais poderoso da OpenAI até o momento. Segundo a própria OpenAI, o Sol estabelece um novo estado da arte no Artificial Analysis Coding Agent Index com 80 pontos — 2,8 acima do próximo melhor modelo — usando menos da metade dos tokens de saída, em menos da metade do tempo e custando cerca de um terço a menos.

No ExploitBench, benchmark de pesquisa em segurança cibernética, o Sol alcança 73,5% contra 47,9% do GPT-5.5 com um orçamento comparável de tokens de saída. No Agents’ Last Exam — avaliação de fluxos de trabalho profissionais de longa duração em 55 áreas —, o Sol atinge 53,6 pontos, superando o próximo melhor modelo em 13,1 pontos. Com esforço de raciocínio médio, ainda lidera por 11,4 pontos a aproximadamente um quarto do custo estimado.

O Sol também introduz o max reasoning effort (esforço máximo de raciocínio), que permite aumentar o poder computacional para trabalhos mais complexos. Os casos de uso indicados incluem agentes de codificação autônoma, pesquisa de vulnerabilidades, fluxos de trabalho de descoberta de medicamentos e tarefas que exigem raciocínio profundo em múltiplas etapas.

GPT-5.6 Terra — equilíbrio para produção

O Terra é o modelo balanceado para o trabalho cotidiano em produção. Ele entrega desempenho superior ao GPT-5.5 com custo menor. É indicado para geração de código, fluxos de trabalho de conteúdo, extração de dados estruturados e tarefas agênticas de propósito geral que precisam de raciocínio sólido sem o preço do modelo principal.

GPT-5.6 Luna — velocidade e economia

O Luna é o modelo rápido e acessível. É indicado para tarefas de inferência em alto volume, como classificação, sumarização, roteamento e aplicações em tempo real onde latência e custo por token são prioritários.

Com as três camadas, é possível calibrar capacidade e custo ao modelo certo para cada carga de trabalho. Os modelos GPT-5.6 concluem tarefas com menos tokens de saída do que seus predecessores, entregando melhor desempenho por dólar gasto.

Motor de inferência construído para escala

O tráfego de agentes tende a ser irregular: uma única requisição de usuário pode disparar centenas de chamadas ao modelo, e a demanda pode mudar rapidamente conforme o uso cresce. O motor de inferência de nova geração do Amazon Bedrock agrupa capacidade para absorver picos de demanda enquanto isola o throughput de cada cliente. Isso reduz a necessidade de escolher entre capacidade compartilhada e desempenho previsível de aplicação.

A inferência dentro da região (In-Region) mantém as requisições dentro da Região AWS especificada, ajudando equipes a cumprir requisitos rígidos de residência de dados.

Cache de prompts com pontos de quebra explícitos

Cargas de trabalho agênticas e de múltiplas etapas repetem boa parte do contexto entre chamadas. Instruções de sistema, definições de ferramentas e arquivos de referência frequentemente permanecem os mesmos enquanto apenas a entrada mais recente muda.

O GPT-5.6 no Amazon Bedrock introduz o cache de prompts com pontos de quebra explícitos para aproveitar essa repetição. Você marca a parte reutilizável de um prompt com um ponto de quebra de cache, e o Bedrock reutiliza o contexto processado em requisições subsequentes que o compartilhem — cada chamada paga apenas pelo trabalho novo. A entrada em cache é cobrada com 90% de desconto e fica disponível para reutilização por pelo menos 30 minutos. Esse período é suficiente para cobrir o burst de chamadas que uma única execução de agente gera, sem multiplicar o custo conforme as cargas de trabalho crescem.

Segurança robusta com proteção em nível de hardware

Modelos mais capazes exigem salvaguardas mais fortes. O GPT-5.6 conta com a pilha de segurança mais robusta da OpenAI até hoje, moldada pelo período de avaliação mais extenso da empresa, combinando red teaming humano com testes automatizados em larga escala. A pilha de segurança inclui recusas em nível de modelo para atividades proibidas, classificadores de uso indevido em tempo real, monitoramento contínuo e aplicação em nível de conta para padrões persistentes.

No Amazon Bedrock, essas proteções se somam à segurança em nível de hardware. O Bedrock utiliza um modelo de segurança ZOA (Zero-Operator Access — acesso zero ao operador), aplicado no chip, de modo que nenhum operador da AWS pode acessar seus prompts ou respostas. Cada chamada ao modelo roda sob as políticas do seu IAM (Identity and Access Management — Gerenciamento de Identidade e Acesso), dentro da sua VPC (Virtual Private Cloud — Nuvem Privada Virtual), e é registrada no AWS CloudTrail. Políticas de perímetro de dados evitam exfiltração entre fronteiras de conta e rede.

Conforme exigido pelo provedor do modelo, dados de tráfego sinalizados por classificadores serão retidos por até 30 dias para detecção automatizada de abuso.

ChatGPT Work e Codex no contexto do GPT-5.6

Junto ao GPT-5.6, a OpenAI lançou o ChatGPT Work, um agente dentro do ChatGPT para tarefas maiores e de múltiplas etapas. O aplicativo desktop atualizado do ChatGPT para Mac e Windows reúne Chat, Work e Codex em uma única experiência, com dois agentes dedicados:

  • Work: construído para tarefas maiores e de múltiplas etapas. Pode reunir informações em aplicativos e arquivos, usar a web, criar materiais finalizados como planilhas, slides, documentos e sites, e se manter em projetos complexos por horas. Os usuários podem acompanhar o progresso, mudar de direção e aprovar ações importantes.
  • Codex: o poderoso agente de codificação para desenvolvedores e profissionais técnicos. Trabalha com arquivos locais, repositórios, terminais, ferramentas de desenvolvimento e ambientes de desenvolvimento para escrever funcionalidades, corrigir bugs, executar testes e abrir pull requests.

Os usuários podem configurar o aplicativo para usar o GPT-5.6 por meio da Responses API no Amazon Bedrock.

Disponibilidade e como começar

O GPT-5.6 Sol está disponível nas seguintes Regiões AWS: US East (N. Virginia) e US East (Ohio). O GPT-5.6 Terra e Luna estão disponíveis em US East (N. Virginia), US East (Ohio) e US West (Oregon).

Para começar a usar Sol, Terra e Luna, acesse o Console do Amazon Bedrock ou utilize programaticamente a Responses API. Para saber mais, consulte a documentação do Amazon Bedrock ou visite a página do produto Amazon Bedrock.

Fonte

OpenAI GPT-5.6 Sol, Terra, and Luna are now generally available on Amazon Bedrock (https://aws.amazon.com/blogs/machine-learning/openai-gpt-5-6-sol-terra-and-luna-are-now-generally-available-on-amazon-bedrock/)

Comments

Leave a Reply

Your email address will not be published. Required fields are marked *