Cierre de una AI API: auditoría de migración antes de la fecha

Plan de auditoría: dependencias, consultas de control, tool calls, streaming, errores, comparación de rutas, cutover y rollback.

Índice

Cambiar modelo o Base URL no completa una migración: pueden variar streaming, tool calls, errores, límites y usage. Hace falta fecha de shutdown primaria, inventario total, comparación de contratos y cutover reversible. El 25-08-2026 OpenAI publica fecha y reemplazo en Deprecations; su política general da seis meses a modelos generally available, tres a variantes especializadas y menos a preview. Planifique desde la entrada concreta.

1. Registre el evento

Antes del código, guarde fuente oficial, fecha de consulta, endpoint/modelo antiguo y sustituto, shutdown_date y owner. Use solo la fecha del proveedor; si falta, escriba unknown, asigne revisión y no invente urgencia.

deprecation_source: https://developers.openai.com/api/docs/deprecations
checked_at: 2026-08-25
old_endpoint: /v1/chat/completions
old_model: OLD_MODEL_ID
replacement_endpoint: /v1/chat/completions
replacement_model: NEW_MODEL_ID
shutdown_date: YYYY-MM-DD
owner: team-name

2. Inventaríe dependencias

Incluya endpoint, Base URL, protocolo, ID/fallback, payload y mensajes, schema/fields/choice de tools, parser SSE/usage, errores/retry, versión de prompt, servicios, cron, workflows, SDK, CI, serverless, n8n/Dify, secret store y tareas de fondo. Guarde nombres y owners de secretos, nunca valores.

3. Prepare controles

Use tareas reales saneadas: texto factual, JSON obligatorio, tool call válido, caso sin tool, stream terminado, 4xx y error temporal/test double. Compare schema, nombre/argumentos de tool, resultado, hechos, final de stream y retry, no el texto; mida coste y latency por separado.

4. Revise streaming y errores

Registre tipo de evento y data, fin, llegada de usage, corte antes/después del primer token y riesgo de duplicar acción externa. Conserve HTTP status, código machine-readable y límite de retry. No repita 401, 403 ni schema validation error; para 429/5xx temporal respete Retry-After, limite intentos y use idempotency.

5. Ejecute las dos rutas

En test, la antigua es baseline y la nueva recibe los mismos fixtures. Guarde:

case_id | old_result | new_result | contract_pass | difference | decision

Cambios de argumentos, fields, cierre de stream o error exigen arreglo o aceptación explícita.

Para BetterToken use https://www.bettertoken.ai/v1/chat/completions, Bearer Key y Model ID actual. Cree una test Key, ejecute la solicitud de control según el contrato actual de Chat Completions y registre el HTTP status y un campo de respuesta verificable; valida formato, no equivalencia.

Antes del cutover, contraste los campos con el contrato actual. Abra la guía Chat Completions

6. Haga cutover reversible

Prepare feature flag/config versionada, owner y ventana, métricas, condición exacta de rollback y config antigua sin secretos. Despliegue ambos contratos, empiece con tráfico controlado, compare, amplíe solo si pasa, revierta ante invariante escrito y retire lo antiguo tras observar y antes de shutdown. Deje tiempo para corregir y repetir: rollback no restaura un API cerrado.

Evidencia

Exija enlace/fecha oficiales, inventario con owners, fixtures/resultados versionados, decisión por diferencia material y runbook medible. Sin uno, siga migration_in_progress, aunque haya 200.

Fuentes: https://developers.openai.com/api/docs/deprecations y https://docs.bettertoken.ai/api-reference/chat-completions.

¿Quieres optimizar tu flujo de trabajo con LLM?

Conecta modelos mediante una API, gestiona claves y controla el gasto en IA.

Empezar gratis