Convide e ganhe

Como funcionam as recompensas

Compartilhe seu link. Quando um amigo se cadastrar por ele e adicionar saldo, você receberá a recompensa exibida nas recargas posteriores.

API do GPT-6 Astra: primeira requisição e migração do GPT-5.6 Sol

Uma primeira requisição copiável ao GPT-6 Astra pela BetterToken, o diff mínimo do GPT-5.6 Sol e verificações de parâmetros, tools e rollback.

Conteúdo
API do GPT-6 Astra: primeira requisição e migração do GPT-5.6 Sol

Para um primeiro smoke test na BetterToken, troque o Model ID para gpt-6-astra e envie uma requisição curta ao endpoint Chat Completions compatível com OpenAI. Migrar uma aplicação exige mais: GPT-6 Astra não aceita reasoning effort none, alguns parâmetros de sampling e logprobs devem ser removidos e tool calling precisa usar Responses API.

O roteiro começa com texto simples e depois aplica o menor diff controlado de gpt-5.6-sol. É um caminho documentado; não fizemos chamada paga com API Key real ao preparar o artigo.

Pré-requisitos e primeira requisição

Em 6 de setembro de 2026, o catálogo público da BetterToken listava gpt-5.6-sol e gpt-6-astra no grupo GPT. Você precisa da própria conta, de uma Key do grupo atual, Base URL https://www.bettertoken.ai/v1 e de um cliente HTTP com Bearer token e JSON.

Crie uma conta BetterToken e uma API Key para GPT-6 Astra

Confira o Model ID no catálogo e no Setup. Não coloque a Key em código, issues, screenshots ou suporte. Exporte-a apenas no ambiente local:

export BETTERTOKEN_API_KEY="YOUR_API_KEY"

Use a referência pública da BetterToken:

curl "https://www.bettertoken.ai/v1/chat/completions" \
  -H "Authorization: Bearer $BETTERTOKEN_API_KEY" \
  -H "Content-Type: application/json" \
  --data '{
    "model": "gpt-6-astra",
    "messages": [
      {
        "role": "user",
        "content": "Reply with exactly: ASTRA_OK"
      }
    ]
  }'

A resposta correta traz texto em choices[0].message.content; o fixture espera ASTRA_OK. Verifique ausência de 401, 403 e model not found, conteúdo não vazio e um registro no Dashboard com gpt-6-astra, status e tokens input/output/cache. Isso confirma Key, endpoint, Model ID e formato básico, não tools, streaming do SDK, qualidade de produção ou equivalência com Sol.

Diff mínimo do GPT-5.6 Sol

 {
-  "model": "gpt-5.6-sol",
+  "model": "gpt-6-astra",
   "messages": [
     {"role": "user", "content": "Summarize this incident report."}
   ]
 }

Se a requisição antiga usava reasoning effort none ou minimal, comece o Astra com low. Em Chat Completions, o campo é reasoning_effort:

{
  "model": "gpt-6-astra",
  "reasoning_effort": "low",
  "messages": [
    {
      "role": "user",
      "content": "Summarize this incident report. Preserve dates and owners."
    }
  ]
}

Se o Sol já usava outro nível efetivo, a recomendação da OpenAI é preservá-lo na primeira comparação. Aumentar effort em tudo muda latência e consumo.

Remova os parâmetros incompatíveis:

 {
   "model": "gpt-6-astra",
   "reasoning_effort": "low",
-  "temperature": 0.2,
-  "top_p": 0.95,
-  "top_logprobs": 5,
-  "logprobs": true,
   "messages": [
     {"role": "user", "content": "Summarize this incident report."}
   ]
 }

A OpenAI lista temperature, top_p e top_logprobs; em Chat Completions remova também logprobs. Confira o JSON serializado se o SDK adiciona defaults.

Chat Completions para texto, Responses para tools

GPT-6 Astra aceita ambos os endpoints, mas a OpenAI exige Responses para tool calling. A referência geral pública da BetterToken documenta Chat Completions; Responses aparece separadamente no setup do Codex.

ObjetivoCaminho
Validar Key, Model ID e textoPOST https://www.bettertoken.ai/v1/chat/completions
Usar tools no Codexcustom provider com wire_api = "responses" segundo o guia Codex
Chamar raw Responses no seu appConfirme antes o contrato do seu canal; ele ainda não está na referência geral

Não mova o schema de tools trocando apenas a URL: input items, chamadas, continuidade de estado e extração de texto são diferentes. Compatibilidade de transporte também não garante o mesmo estilo ou escolha de ferramentas.

Migração controlada e rollback

Monte fixtures reais: resposta exata, structured output validado por JSON Schema, prompt longo, workflow com tools e requisição inválida. Para o Sol, guarde Model ID, endpoint, reasoning efetivo, body serializado e acceptance check. Rode o mesmo conjunto no Astra com o diff mínimo.

Mude tráfego apenas quando todos os fixtures passarem, o monitoring separar gpt-5.6-sol de gpt-6-astra e o rollback restaurar modelo e parâmetros sem novo release. Comece com um fluxo interno ou uma fatia pequena definida pelo risco; não há percentual universal. Preserve a configuração do Sol durante a observação.

Diagnóstico rápido

  • 401 Unauthorized: confira Authorization: Bearer ..., environment do processo e espaços copiados; não registre a Key inteira.
  • 403 ou model not found: confirme o grupo e copie exatamente gpt-6-astra.
  • 400: remova temperature, top_p, top_logprobs e logprobs; troque none ou minimal por low.
  • Texto funciona, tools não: revise o endpoint. O smoke test não prova Responses. Mantenha wire_api = "responses" no Codex.
  • Resposta correta, UI vazia: salve o raw response sem segredos e confira choices[0].message.content, status, finish reason e adapter.

A migração termina quando o Astra passa nos fixtures, pode ser observado separadamente e volta por configuração. O primeiro 200 confirma conectividade, não a migração inteira.

Quer otimizar seu fluxo de trabalho com LLMs?

Conecte modelos por uma única API, gerencie chaves e controle os gastos com IA.

Começar grátis