Comece a usar os modelos OpenAI GPT-5.5, GPT-5.4 e Codex no Amazon Bedrock


Comece a usar os modelos OpenAI GPT-5.5, GPT-5.4 e Codex no Amazon Bedrock

Como nós visualizado em O que vem a seguir com AWS 2026estamos anunciando a disponibilidade geral dos modelos OpenAI GPT-5.5, GPT-5.4 e Codex em Base Amazônicadando acesso a modelos de fronteira e um agente de codificação para desenvolvimento de software program.

De acordo com a OpenAI, os modelos GPT-5.5 e GPT-5.4 são excelentes para codificação, raciocínio, fluxos de trabalho de agente e trabalho profissional complexo. Você pode usar o GPT-5.5 para as cargas de trabalho mais difíceis do cliente e o GPT-5.4 para obter o melhor custo-benefício. Você pode ligar para eles através Responses API no mecanismo de inferência de última geração do Amazon Bedrock desenvolvido para oferecer alto desempenho, confiabilidade e segurança.

Codex é o agente de codificação OpenAI para desenvolvimento de software program baseado em IA. De acordo com a OpenAI, mais de 4 milhões de desenvolvedores usam o Codex todas as semanas para escrever, refatorar, depurar, testar e validar código em grandes bases de código. Com a inferência potencializada pelo GPT-5.5, o Codex apresenta uma nova classe de inteligência otimizada para fluxos de trabalho de desenvolvedor complexos e de longo prazo. Você pode usar o aplicativo Codex, a CLI do Codex e integrações IDE com Visible Studio Code, JetBrains e Xcode, com toda a inferência de modelo roteada por meio do Responses API no Amazon Bedrock.

Para clientes com requisitos de residência de dados, todo o processamento permanece na região Bedrock selecionada. Você paga por token, sem licenças por estação e sem compromissos por desenvolvedor.

Modelos GPT-5.5 e GPT-5.4 em Bedrock em ação

Você pode acessar o modelo programaticamente usando o OpenAI Responses API para chamar o bedrock-mantle endpoints por meio do OpenAI SDK, ferramentas de linha de comando como curl.

Vamos começar com OpenAI SDK para Python. Instale o OpenAI SDK.

pip set up -U openai

Defina as variáveis ​​de ambiente para autenticação.

export OPENAI_BASE_URL="https://bedrock-mantle.us-east-2.api.aws/openai/v1"
export OPENAI_API_KEY=""
export BEDROCK_OPENAI_MODEL_ID="openai.gpt-5.5"

Aqui está um exemplo de código Python para chamar o modelo GPT-5.5 no Bedrock:

import os
from openai import OpenAI
 
consumer = OpenAI(
    base_url=os.environ("OPENAI_BASE_URL"),
    api_key=os.environ("OPENAI_API_KEY"),
)
 
response = consumer.responses.create(
    mannequin=os.environ("BEDROCK_OPENAI_MODEL_ID"),
    enter=(
        {
            "function": "developer",
            "content material": "You're a software program engineer with wonderful AWS cloud information. Be concise and sensible.",
        },
        {
            "function": "person",
            "content material": "Design a distributed structure on AWS in Python that ought to help 100k requests per second throughout a number of geographic areas.",
        },
    ),
    reasoning={"effort": "medium"},
    textual content={"verbosity": "low"},
)
 
print(response.output_text)

Você pode chamar diretamente o endpoint do modelo usando curl.

curl "$OPENAI_BASE_URL/responses" 
  -H "Content material-Sort: utility/json" 
  -H "Authorization: Bearer $OPENAI_API_KEY" 
  -d '{
    "mannequin": "openai.gpt-5.5",
    "enter": (
      {
        "function": "developer",
        "content material": "You're a software program engineer with wonderful AWS cloud information."
      },
      {
        "function": "person",
        "content material": "Design a distributed structure on AWS in Python that ought to help 100k requests per second throughout a number of geographic areas."
      }
    ),
    "reasoning": {"effort": "medium"},
    "textual content": {"verbosity": "low"}
  }'

Você pode usar o Responses API quando você deseja usar o estado multiturno gerenciado por modelo, precisa de ferramentas hospedadas, ferramentas de função ou orquestração de ferramentas mais rica e executa trabalhos em segundo plano ou de longa duração. Para saber mais, visite o Exemplos de respostas do livro de receitas OpenAI e guia de primeiros passos.

Usando OpenAI Codex com GPT-5.5 no Amazon Bedrock

Você pode baixar a extensão Codex CLI, Codex App ou Codex VS Code e começar a usar o Bedrock para inferência de modelo. Codex oferece suporte a dois caminhos de autenticação Bedrock: Chave de API Amazon Bedrock ou cadeia de credenciais do AWS SDK. Se você definir AWS_BEARER_TOKEN_BEDROCKo Codex o usa primeiro; caso contrário, o Codex retornará à cadeia de credenciais do AWS SDK.

Definir AWS_BEARER_TOKEN_BEDROCK no ambiente que o Codex irá ler:

export AWS_BEARER_TOKEN_BEDROCK=

Em seguida, configure sua região preferida e defina o ID do modelo como openai.gpt-5.5 em ~/.codex/config.tomlque é necessário para autenticação de chave de API Bedrock. Você também pode escolher openai.gpt-5.4, openai.gpt-oss-120bou openai.gpt-oss-20b. Para o aplicativo de desktop ou extensão do VS Code, coloque todas as variáveis ​​de ambiente que o aplicativo precisa ~/.codex/.env.

mannequin = "openai.gpt-5.5"
model_provider = "amazon-bedrock"
(model_providers.amazon-bedrock.aws)
area = "us-east-2"

Reinicie o aplicativo de desktop ou extensão do VS Code após alterar ~/.codex/config.toml ou ~/.codex/.env. No Codex CLI, você deverá ver um /standing aba que se parece com isso:

No Codex App, você pode usar o modelo GPT-5.5 por meio da inferência do Amazon Bedrock.

Para saber mais sobre como configurar o Codex para usar modelos OpenAI no Amazon Bedrock, visite Use Codex com Amazon Bedrock.

Coisas para saber

Deixe-me compartilhar alguns detalhes técnicos importantes que acho que serão úteis para você.

  • Latência do modelo: as informações do modelo OpenAI posicionam o GPT-5.5 como rápido e o GPT-5.4 como velocidade média, mas a latência percebida pelo cliente depende do esforço de raciocínio, comprimento da saída, chamadas de ferramenta, modo de segundo plano, região, cotas, limitação, tamanho do immediate e ocorrências de cache. Inicie o GPT-5.5 em medium esforço. Inicie o GPT-5.4 com o esforço definido explicitamente, em vez de depender de seu none padrão.
  • Dimensionamento e capacidade: O novo mecanismo de inferência da Bedrock foi projetado para provisionar e atender rapidamente a capacidade em muitos modelos diferentes. Ao aceitar solicitações, priorizamos manter as cargas de trabalho em estado estável em execução e aumentar o uso e a capacidade rapidamente em resposta às mudanças na demanda. Durante períodos de alta demanda, as solicitações são enfileiradas, em vez de rejeitadas.

Agora disponível

Os modelos OpenAI GPT e Codex no Amazon Bedrock estão disponíveis hoje: modelo GPT-5.5 na região Leste dos EUA (Ohio), modelo GPT-5.4 nas regiões Leste dos EUA (Ohio) e Oeste dos EUA (Oregon). Verifique o lista completa de regiões para atualizações futuras. Para saber mais, visite o OpenAI no Amazon Bedrock página e o Preços do Amazon Bedrock página.

Experimente hoje mesmo os modelos GPT-5.5, GPT-5.4 e Codex no Amazon Bedrock e envie comentários para AWS re:Put up para Amazon Bedrock ou por meio de seus contatos habituais do AWS Help.

Channy

Atualizado em 1º de junho de 2026 – Os modelos GPT agora oferecem suporte à API Responses apenas no Amazon Bedrock, e o suporte ao console estará disponível em breve.



Deixe um comentário

O seu endereço de e-mail não será publicado. Campos obrigatórios são marcados com *