Encerramento de AI API: auditoria de migração antes da data

Plano de auditoria com dependências, requests de controle, tool calls, streaming, erros, comparação de rotas, cutover e rollback.

Conteúdo

Trocar model ou Base URL não conclui a migração: streaming, tools, erros, limites e usage podem mudar. É preciso registrar a data primária de shutdown, mapear dependências, comparar contratos e preparar cutover reversível. Em 25-08-2026, OpenAI publica data e substituto em Deprecations; a política geral prevê seis meses para generally available, três para variantes especializadas e menos para preview. Use a entrada concreta.

1. Registre o evento

Antes do código, registre fonte, data de consulta, endpoint/model antigo e novo, shutdown_date e owner. Use apenas a data do aviso; sem ela, escreva unknown, designe nova checagem e não invente urgência.

deprecation_source: https://developers.openai.com/api/docs/deprecations
checked_at: 2026-08-25
old_endpoint: /v1/chat/completions
old_model: OLD_MODEL_ID
replacement_endpoint: /v1/chat/completions
replacement_model: NEW_MODEL_ID
shutdown_date: YYYY-MM-DD
owner: team-name

2. Inventarie dependências

Inclua endpoint, Base URL, protocolo, ID/fallback, payload/mensagens, schema/fields/choice de tools, parser SSE/usage, erros/retry, prompt, serviços, cron, workflows, SDK, CI, serverless, n8n/Dify, secret store e jobs. Guarde nomes e owners de secrets, nunca valores.

3. Prepare controles

Use tarefas reais sanitizadas: texto factual, JSON obrigatório, tool call válido, caso sem tool, stream concluído, 4xx e erro temporário/test double. Compare schema, argumentos, resultado, fatos, término e retry, não a redação; meça custo e latency separadamente.

4. Teste streaming e erros

Registre evento e data, término, chegada de usage, cortes antes/depois do primeiro token e duplicação de ação externa. Preserve HTTP status, código machine-readable e fronteira de retry. Não repita 401, 403 ou schema validation error; para 429/5xx temporário respeite Retry-After, limite tentativas e use idempotency.

5. Faça execução dupla

Em teste, mantenha o caminho antigo como baseline e envie os mesmos fixtures ao novo. Salve:

case_id | old_result | new_result | contract_pass | difference | decision

Mudança em argumentos, fields, término ou erro exige correção ou aceitação explícita.

Para BetterToken use https://www.bettertoken.ai/v1/chat/completions, Bearer Key e Model ID atual. Crie uma test Key, execute a solicitação de controle conforme o contrato atual de Chat Completions e registre o HTTP status e um campo de resposta verificável: valida formato, não equivalência.

Antes do cutover, compare os fields com o contrato atual. Abra o guia Chat Completions

6. Faça cutover reversível

Tenha feature flag/config versionada, owner/janela, métricas, condição exata de rollback e config antiga sem secrets. Implante ambos, comece controlado, compare, amplie só se passar, reverta ao quebrar invariante e remova o antigo após observar e antes de shutdown. Reserve tempo para corrigir e repetir: rollback não restaura API encerrada.

Evidências

Exija fonte/data, inventário com owners, fixtures/resultados versionados, decisão por diferença e runbook mensurável. Sem um item, mantenha migration_in_progress, mesmo com 200.

Fontes: https://developers.openai.com/api/docs/deprecations e https://docs.bettertoken.ai/api-reference/chat-completions.

Quer otimizar seu fluxo de trabalho com LLMs?

Conecte modelos por uma única API, gerencie chaves e controle os gastos com IA.

Começar grátis