Claude Sonnet 4.5, obsoleto
Anthropic anunció la obsolescencia de claude-sonnet-4-5-20250929. Su retirada de Claude API está prevista para 2026-11-30 y Claude Sonnet 5.5 es la alternativa recomendada.
Lanzamientos y retiradas de modelos, versiones de API y SDK, cambios en la especificación MCP y cambios de precios que afectan al código que ya has publicado. Del más reciente al más antiguo; cada entrada enlaza a las notas del propio proveedor.
Anthropic anunció la obsolescencia de claude-sonnet-4-5-20250929. Su retirada de Claude API está prevista para 2026-11-30 y Claude Sonnet 5.5 es la alternativa recomendada.
OpenAI lanzó gpt-6.1-sol para programación y trabajo profesional, a $2 por entrada / $0.10 en caché / $10 por salida (prompts de <=272K tokens), con delegación de subagentes multiagente en fase beta en Responses API.
En DevDay 2026, OpenAI anunció Dots, agentes persistentes, GPT-6.1 Sol, el nivel de velocidad Ultrafast, una vista previa limitada de Decisions API, Amazon Bedrock Managed Agents con tecnología de OpenAI y compatibilidad de ChatGPT con el borrador de la especificación MCP Events.
Los agentes creados con Agents API ya pueden completar tareas en un navegador alojado por OpenAI. La aplicación del desarrollador gestiona las aprobaciones para acceder a sitios web y el inicio de sesión.
gpt-6-astra se puede invocar con service_tier "ultrafast" en la Responses API por $60 de entrada / $300 de salida por 1M de tokens (contexto corto), solo con procesamiento global y residencia de datos en EE. UU.
claude-sonnet-5-5 se lanzó por $2/$10 por MTok, con un contexto de 1M y una salida de 128K. Incluye cinco cambios incompatibles con Sonnet 5, entre ellos que una llamada forzada a tool_choice devuelve 400 y que la Claude API ya no acepta computer_20251124.
Los rechazos que se producen antes de generar cualquier salida vuelven a cobrarse cuando stop_details.category es bio, frontier_llm o reasoning_extraction; los rechazos tempranos de otras categorías siguen siendo gratuitos.
OpenClaw 2026.9.6 incorpora la recuperación de actualizaciones gestionadas, informes de uso de 30 días, Files/Memory/Skills en espacios de trabajo remotos y compatibilidad con Claude Opus 5.5, GPT-6 Sol/Luna y Grok 4.7 como modelos de chat.
OpenAI lanzó los modelos de razonamiento gpt-6-sol ($2/$0.20/$10) y gpt-6-luna ($0.10/$0.01/$0.50) en las APIs Responses y Chat Completions.
claude-opus-5-5 se lanzó por $4/$20 por MTok (más barato que Opus 5), con un contexto de 1M, una salida de 128K y thinking adaptativo siempre activado. No se puede desactivar thinking y el uso del ordenador requiere computer_toolset_20260801.
Con el encabezado beta inline-tools-2026-09-15, se pueden añadir o modificar herramientas (incluidos los conjuntos de herramientas MCP mediante mcp-client-2026-09-15) en un mensaje del sistema a mitad de la conversación, sin invalidar la caché del prompt.
grok-4.7 se lanzó con una ventana de contexto de 500K por $2 de entrada / $0.50 en caché / $6 de salida (el doble para prompts >=200K), llamadas a funciones y salidas estructuradas; no es compatible con la Batch API.
Google limitó el acceso a los modelos Gemini 2.5 a los usuarios que ya los habían utilizado (sin retirarlos) y recomendó a los proyectos nuevos usar Gemini 3.5 Flash-Lite o 3.8 Flash.
OpenClaw 2026.9.5 incorpora Atomic Updates, plugins que se instalan sin reiniciar Gateway, conversaciones que se pueden compartir, GPT Live en reuniones y llamadas, y una configuración guiada para equipos de agentes especializados.
Google lanzó el agente gestionado antigravity-preview-09-2026, con herramientas integradas renombradas en PascalCase y edición de archivos por rangos de líneas; antigravity-preview-05-2026 dejará de funcionar el 2026-10-05.
La Messages API puede compactar una conversación cuando se solicita (con el encabezado beta compact-2026-09-04) y devuelve un bloque de compactación firmado que sustituye los mensajes anteriores en las solicitudes posteriores.
OpenAI lanzó Agents API en beta pública. La API ofrece el harness de Codex de código abierto como servicio gestionado, con sesiones persistentes, MCP/herramientas, subagentes y sandboxes alojados por OpenAI, autogestionados o de socios, sin cargos aparte de los tokens y las herramientas.
Las sesiones de voz full-duplex de gpt-live-1 ya están disponibles de forma general por $0.05 por minuto (facturación por segundo). El razonamiento del modelo o agente en el backend se delega mediante Responses o el cliente.
DeepSeek lanzó la versión multimodal V4.1-Flash con el nombre de modelo deepseek-flash, retiró V4-Flash y redujo los precios (máximo: $0.30 de entrada / $1.20 de salida; fuera de las horas punta, la mitad).
Claude Managed Agents incorporó una política de permisos auto en la que el servidor evalúa cada llamada del agente o a una herramienta MCP y la ejecuta, la deniega o la pausa para solicitar aprobación.
OpenAI lanzó gpt-6-astra ($10/$1/$50), su modelo más capaz. Incorpora llamadas asíncronas a herramientas, ajustes de comportamiento durante el turno a través de WebSockets y cambios en el esfuerzo de razonamiento durante la conversación. Las llamadas a herramientas requieren la Responses API.
Google lanzó gemini-3.8-flash, diseñado para proyectos de ingeniería de software de larga duración y agentes autónomos, con un precio introductorio de $0.75/$3.75 por 1M tokens hasta 2026-12-31.
Meta lanzó Muse Spark 1.3 con razonamiento máximo en Muse Code y la Meta Model API, a $1.25/$4.25 por 1M tokens (nivel para colaboradores: $0.10/$0.20).
claude-fable-5-1 se lanzó a $10/$50 por MTok, con lecturas de caché reducidas a $0.25 (0.025x), contexto de 1M y salida de 128K. También se lanzó Claude Mythos 5.1 para los participantes de Project Glasswing. No se admite el uso de tool_choice forzado.
La autenticación mutua TLS y la federación de identidades de cargas de trabajo X.509 pasaron a estar disponibles de forma general para la API de OpenAI. Se pueden configurar desde la consola de Platform.
Assistants API dejó de funcionar. OpenAI también anunció que whisper-1 y los modelos gpt-4o transcribe dejarán de funcionar el 2027-02-26.
GPT-5.6 Sol bajó a $4 por 1M tokens de entrada y $20 de salida (un 20% menos en la entrada y un 33% menos en la salida). Es un precio promocional disponible, como mínimo, hasta 2026-11-21.
Computer use salió de la beta como computer_toolset_20260801 (acciones por lotes y zoom activado de forma predeterminada), se lanzó el toolset de cliente browser_toolset_20260801 y se retiraron los encabezados beta de Files API y Agent Skills/Skills API.
openai-agents-python v0.22.0 incluye mejoras de robustez en tiempo de ejecución, redacción de las salidas de guardrail, validación de opciones del proveedor y una visualización ampliada del grafo de handoffs. La versión detalla los cambios incompatibles.
Z.ai lanzó GLM-5.3 (con la misma base que GLM-5.2, mejorada mediante postentrenamiento) a $1.40/$4.40 por 1M tokens. Ya no se puede desactivar el razonamiento.
DeepSeek lanzó V4-Pro con disponibilidad general, mejores resultados en benchmarks de agentes, compatibilidad nativa con el formato de OpenAI Responses API (adaptado para Codex) y niveles de esfuerzo low/high/max. También anunció precios para horas punta y valle, vigentes desde 2026-08-16.
Google lanzó gemini-3.7-flash para programación y flujos de trabajo con agentes, con un precio introductorio hasta 2026-12-31.
claude-agent-sdk v0.2.137 añadió ConversationResetMessage, campos de origen del mensaje y las opciones resume_session_at/resume_drops_turn para truncar de forma segura las sesiones reanudadas.
Anthropic canceló la subida prevista para 2026-09-01 a $3/$15 y mantuvo Claude Sonnet 5 en $2/$10 por MTok.
Las sesiones de Claude Managed Agents incorporaron límites de gasto estrictos (con pausa y el estado budget_reached), un modelo asesor que el agente puede consultar durante un turno, inference_geo por agente y la carga automática de skills desde repositorios de GitHub montados.
Las organizaciones de Claude Enterprise pueden dirigir prompts sujetos a políticas a su propio servidor de seguridad de IA para obtener una decisión de permitir o denegar antes de la inferencia. Además, claude-opus-4-1-20250805 se retiró.
Alibaba lanzó Qwen3.8-Max, un MoE de 2.4T parámetros con contexto de 1M, en Model Studio, y anunció que publicaría los pesos abiertos la semana siguiente.
Priority processing pasó a llamarse Fast mode (el doble de precio y hasta 2.5 veces más velocidad para GPT-5.6 Sol). GPT-5.6 Luna pasó a costar un 80% menos y GPT-5.6 Terra, un 20% menos.
La nueva revisión de MCP elimina el intercambio inicial initialize y las sesiones de protocolo, añade la llamada RPC obligatoria server/discover y el patrón Multi Round-Trip Request, traslada las tareas a una extensión y deja obsoletos Roots, Sampling y Logging.
claude-opus-5 se lanzó a $5/$25 por MTok, con contexto de 1M y salida de 128K. También incorporó cambios de herramientas durante la conversación (beta) y un modo alternativo predeterminado en el servidor.
Estaba previsto retirar en esta fecha los nombres de modelo antiguos deepseek-chat y deepseek-reasoner (anunciado el 2026-04-24 con el lanzamiento de V4).
Google declaró gemini-3.6-flash y gemini-3.5-flash-lite disponibles de forma general y marcó como obsoletos los parámetros de muestreo temperature, top_p y top_k.
Moonshot lanzó Kimi K3, un MoE de pesos abiertos con 2.8T parámetros y contexto de 1M, en la API de Kimi a $3/$15 por 1M de tokens. Los pesos se publicarían antes del 2026-07-27.
claude-sonnet-5 se lanzó con contexto de 1M y un nuevo tokenizador (alrededor de un 30% más de tokens); el razonamiento extendido manual y los parámetros de muestreo que no son predeterminados ahora devuelven 400.
Google lanzó una vista previa pública de la herramienta Computer Use en Gemini 3.5 Flash, con entornos de navegador, móviles y de escritorio, políticas de seguridad configurables y detección de inyección de prompts.
claude-sonnet-4-20250514 y claude-opus-4-20250514 se retiraron; las solicitudes ahora devuelven errores.
gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite y gemini-2.0-flash-lite-001 se retiraron. Sus reemplazos son gemini-3.5-flash o gemini-3.1-flash-lite.