API do GPT-6 Astra: primeira requisição e migração do GPT-5.6 Sol
Uma primeira requisição copiável ao GPT-6 Astra pela BetterToken, o diff mínimo do GPT-5.6 Sol e verificações de parâmetros, tools e rollback.
Conteúdo

Para um primeiro smoke test na BetterToken, troque o Model ID para gpt-6-astra e envie uma requisição curta ao endpoint Chat Completions compatível com OpenAI. Migrar uma aplicação exige mais: GPT-6 Astra não aceita reasoning effort none, alguns parâmetros de sampling e logprobs devem ser removidos e tool calling precisa usar Responses API.
O roteiro começa com texto simples e depois aplica o menor diff controlado de gpt-5.6-sol. É um caminho documentado; não fizemos chamada paga com API Key real ao preparar o artigo.
Pré-requisitos e primeira requisição
Em 6 de setembro de 2026, o catálogo público da BetterToken listava gpt-5.6-sol e gpt-6-astra no grupo GPT. Você precisa da própria conta, de uma Key do grupo atual, Base URL https://www.bettertoken.ai/v1 e de um cliente HTTP com Bearer token e JSON.
Crie uma conta BetterToken e uma API Key para GPT-6 Astra
Confira o Model ID no catálogo e no Setup. Não coloque a Key em código, issues, screenshots ou suporte. Exporte-a apenas no ambiente local:
export BETTERTOKEN_API_KEY="YOUR_API_KEY"
Use a referência pública da BetterToken:
curl "https://www.bettertoken.ai/v1/chat/completions" \
-H "Authorization: Bearer $BETTERTOKEN_API_KEY" \
-H "Content-Type: application/json" \
--data '{
"model": "gpt-6-astra",
"messages": [
{
"role": "user",
"content": "Reply with exactly: ASTRA_OK"
}
]
}'
A resposta correta traz texto em choices[0].message.content; o fixture espera ASTRA_OK. Verifique ausência de 401, 403 e model not found, conteúdo não vazio e um registro no Dashboard com gpt-6-astra, status e tokens input/output/cache. Isso confirma Key, endpoint, Model ID e formato básico, não tools, streaming do SDK, qualidade de produção ou equivalência com Sol.
Diff mínimo do GPT-5.6 Sol
{
- "model": "gpt-5.6-sol",
+ "model": "gpt-6-astra",
"messages": [
{"role": "user", "content": "Summarize this incident report."}
]
}
Se a requisição antiga usava reasoning effort none ou minimal, comece o Astra com low. Em Chat Completions, o campo é reasoning_effort:
{
"model": "gpt-6-astra",
"reasoning_effort": "low",
"messages": [
{
"role": "user",
"content": "Summarize this incident report. Preserve dates and owners."
}
]
}
Se o Sol já usava outro nível efetivo, a recomendação da OpenAI é preservá-lo na primeira comparação. Aumentar effort em tudo muda latência e consumo.
Remova os parâmetros incompatíveis:
{
"model": "gpt-6-astra",
"reasoning_effort": "low",
- "temperature": 0.2,
- "top_p": 0.95,
- "top_logprobs": 5,
- "logprobs": true,
"messages": [
{"role": "user", "content": "Summarize this incident report."}
]
}
A OpenAI lista temperature, top_p e top_logprobs; em Chat Completions remova também logprobs. Confira o JSON serializado se o SDK adiciona defaults.
Chat Completions para texto, Responses para tools
GPT-6 Astra aceita ambos os endpoints, mas a OpenAI exige Responses para tool calling. A referência geral pública da BetterToken documenta Chat Completions; Responses aparece separadamente no setup do Codex.
| Objetivo | Caminho |
|---|---|
| Validar Key, Model ID e texto | POST https://www.bettertoken.ai/v1/chat/completions |
| Usar tools no Codex | custom provider com wire_api = "responses" segundo o guia Codex |
| Chamar raw Responses no seu app | Confirme antes o contrato do seu canal; ele ainda não está na referência geral |
Não mova o schema de tools trocando apenas a URL: input items, chamadas, continuidade de estado e extração de texto são diferentes. Compatibilidade de transporte também não garante o mesmo estilo ou escolha de ferramentas.
Migração controlada e rollback
Monte fixtures reais: resposta exata, structured output validado por JSON Schema, prompt longo, workflow com tools e requisição inválida. Para o Sol, guarde Model ID, endpoint, reasoning efetivo, body serializado e acceptance check. Rode o mesmo conjunto no Astra com o diff mínimo.
Mude tráfego apenas quando todos os fixtures passarem, o monitoring separar gpt-5.6-sol de gpt-6-astra e o rollback restaurar modelo e parâmetros sem novo release. Comece com um fluxo interno ou uma fatia pequena definida pelo risco; não há percentual universal. Preserve a configuração do Sol durante a observação.
Diagnóstico rápido
401 Unauthorized: confiraAuthorization: Bearer ..., environment do processo e espaços copiados; não registre a Key inteira.403ou model not found: confirme o grupo e copie exatamentegpt-6-astra.400: removatemperature,top_p,top_logprobselogprobs; troquenoneouminimalporlow.- Texto funciona, tools não: revise o endpoint. O smoke test não prova Responses. Mantenha
wire_api = "responses"no Codex. - Resposta correta, UI vazia: salve o raw response sem segredos e confira
choices[0].message.content, status, finish reason e adapter.
A migração termina quando o Astra passa nos fixtures, pode ser observado separadamente e volta por configuração. O primeiro 200 confirma conectividade, não a migração inteira.