O que foi anunciado
A AWS anunciou que os modelos OpenAI GPT-5.6 Sol, Terra e Luna passam a suportar janelas de contexto de 1 milhão de tokens no Amazon Bedrock. Isso significa que é possível processar bases de código completas, documentos extensos e históricos de conversas em agentes com múltiplas etapas — tudo em uma única requisição, sem precisar fragmentar o conteúdo.
Com uma janela de contexto tão ampla, os modelos conseguem raciocinar sobre um volume muito maior de informações de uma vez, retornando respostas mais precisas e coerentes. A principal vantagem prática é eliminar a necessidade de técnicas de chunking (divisão do conteúdo em pedaços menores) e reduzir a perda de informações que costuma ocorrer quando o contexto é truncado.
Casos de uso habilitados
A AWS destaca três cenários principais que se beneficiam diretamente dessa capacidade expandida:
- Revisão e migração de código: é possível analisar repositórios inteiros em uma única passagem, sem precisar dividir o projeto em partes menores.
- Documentos jurídicos e regulatórios: contratos longos, normas e regulamentações podem ser processados do início ao fim sem interrupções.
- Fluxos de trabalho agênticos com múltiplas etapas: o histórico completo de uma conversa ou de uma sequência de ações pode ser mantido durante toda a execução do agente.
Prompt caching e desconto de cobrança
Um detalhe importante para quem vai usar esses modelos em produção: o prompt caching com pontos de cache explícitos já se aplica às requisições de contexto longo. Na prática, contextos repetidos são cobrados com desconto de cache, o que pode representar uma economia relevante em aplicações que reutilizam grandes blocos de contexto com frequência.
Disponibilidade por região
A disponibilidade dos modelos varia conforme a região AWS:
- GPT-5.6 Sol: disponível em US East (N. Virginia) e US East (Ohio).
- GPT-5.6 Terra e Luna: disponíveis em US East (N. Virginia), US East (Ohio) e US West (Oregon).
Como começar a usar
Para experimentar os modelos Sol, Terra e Luna com suporte a 1 milhão de tokens, a AWS indica dois caminhos: pelo Console do Amazon Bedrock ou pela Responses API no endpoint bedrock-mantle. Para detalhes técnicos e configurações, a documentação do Amazon Bedrock traz as informações completas. Quem quiser entender o contexto mais amplo do lançamento pode conferir também o post de lançamento oficial.
Fonte
OpenAI GPT-5.6 Sol, Terra, and Luna now support 1 million token context windows on Amazon Bedrock (https://aws.amazon.com/about-aws/whats-new/2026/08/gpt-sol-terra-luna-long-context-bedrock)
Leave a Reply