Claude Sonnet 4.5 descontinuado
A Anthropic anunciou a descontinuação de claude-sonnet-4-5-20250929. A retirada da Claude API está prevista para 2026-11-30, e o Sonnet 5.5 é o substituto recomendado.
Lançamentos e descontinuações de modelos, versões de APIs e SDKs, mudanças na especificação MCP e alterações de preços que afetam o código que você já colocou em produção. Do mais recente para o mais antigo; cada item tem um link para as notas do próprio fornecedor.
A Anthropic anunciou a descontinuação de claude-sonnet-4-5-20250929. A retirada da Claude API está prevista para 2026-11-30, e o Sonnet 5.5 é o substituto recomendado.
A OpenAI lançou o gpt-6.1-sol para programação e trabalho profissional por $2 por milhão de tokens de entrada / $0.10 por milhão de tokens de entrada em cache / $10 por milhão de tokens de saída (prompts <=272K), com delegação a subagentes em fluxos multiagente em beta na Responses API.
No DevDay 2026, a OpenAI anunciou os agentes persistentes Dots, o GPT-6.1 Sol, o nível de velocidade Ultrafast, uma prévia limitada da Decisions API, o Amazon Bedrock Managed Agents com tecnologia da OpenAI e o suporte do ChatGPT ao rascunho da especificação MCP Events.
Agora, os agentes criados com a Agents API podem concluir tarefas em um navegador hospedado pela OpenAI, enquanto a aplicação do desenvolvedor gerencia as aprovações de acesso a sites e o login.
gpt-6-astra pode ser chamado com service_tier "ultrafast" na Responses API por $60 de entrada / $300 de saída por 1M de tokens (contexto curto), apenas com processamento global e com residência de dados nos EUA.
claude-sonnet-5-5 foi lançado por $2/$10 por MTok, com contexto de 1M e saída de 128K, além de cinco mudanças incompatíveis com versões anteriores em relação ao Sonnet 5. Entre elas, o uso forçado de tool_choice retorna 400, e computer_20251124 não é mais aceito na Claude API.
Recusas recebidas antes de qualquer saída voltam a ser cobradas quando stop_details.category é bio, frontier_llm ou reasoning_extraction; recusas iniciais em outras categorias continuam gratuitas.
O OpenClaw 2026.9.6 adicionou recuperação de atualizações gerenciadas, relatórios de uso de 30 dias, Files/Memory/Skills em workspaces remotos e suporte a modelos de chat Claude Opus 5.5, GPT-6 Sol/Luna e Grok 4.7.
A OpenAI lançou os modelos de raciocínio gpt-6-sol ($2/$0.20/$10) e gpt-6-luna ($0.10/$0.01/$0.50) nas APIs Responses e Chat Completions.
claude-opus-5-5 foi lançado por $4/$20 por MTok (mais barato que Opus 5), com contexto de 1M, saída de 128K e adaptive thinking sempre ativado; não é possível desativar o thinking, e o uso do computador requer computer_toolset_20260801.
Com o cabeçalho beta inline-tools-2026-09-15, é possível adicionar ou alterar ferramentas (incluindo toolsets MCP via mcp-client-2026-09-15) em uma mensagem de sistema no meio da conversa, sem invalidar o cache do prompt.
grok-4.7 foi lançado com janela de contexto de 500K por $2 de entrada / $0.50 em cache / $6 de saída (o dobro para prompts >=200K), chamadas de função e saídas estruturadas; a Batch API não é compatível.
O Google limitou o acesso aos modelos Gemini 2.5 a usuários que já os haviam utilizado (sem descontinuá-los) e orientou novos projetos a usar Gemini 3.5 Flash-Lite ou 3.8 Flash.
O OpenClaw 2026.9.5 introduziu Atomic Updates, plugins que são instalados sem reiniciar o Gateway, conversas compartilháveis, GPT Live em reuniões e chamadas e configuração guiada para equipes de agentes especializados.
O Google lançou o agente gerenciado antigravity-preview-09-2026, com ferramentas integradas renomeadas em PascalCase e edição de arquivos por intervalo de linhas; o antigravity-preview-05-2026 será encerrado em 2026-10-05.
A Messages API pode compactar uma conversa sob solicitação (cabeçalho beta compact-2026-09-04) e retorna um bloco de compactação assinado que substitui as mensagens anteriores em solicitações futuras.
A OpenAI lançou a Agents API em beta público, disponibilizando o harness open source do Codex como serviço gerenciado com sessões persistentes, MCP/ferramentas, subagentes e sandboxes hospedados pela OpenAI, autogerenciados ou de parceiros, sem taxas além das de tokens e ferramentas.
As sessões de voz full-duplex do gpt-live-1 ficaram disponíveis em geral por $0.05 por minuto (cobradas por segundo), com o raciocínio do modelo de backend ou do agente delegado via Responses ou pelo cliente.
A DeepSeek lançou o modelo multimodal V4.1-Flash com o nome deepseek-flash, descontinuou o V4-Flash e reduziu os preços (pico: $0.30 por entrada / $1.20 por saída; fora do pico: metade do preço).
O Claude Managed Agents ganhou uma política de permissões auto, na qual o servidor avalia cada chamada de agente ou ferramenta MCP e a executa, nega ou pausa para aprovação.
A OpenAI lançou o gpt-6-astra ($10/$1/$50) como seu modelo mais capaz, com chamadas assíncronas de ferramentas, direcionamento durante a execução por WebSockets e alterações no nível de esforço de raciocínio durante a conversa; chamadas de ferramentas exigem a Responses API.
A Google lançou o gemini-3.8-flash, voltado para engenharia de software de longo prazo e agentes autônomos, pelo preço promocional de $0.75/$3.75 por 1M de tokens até 2026-12-31.
A Meta lançou o Muse Spark 1.3 com raciocínio máximo no Muse Code e na Meta Model API, por $1.25/$4.25 por 1M de tokens (nível de colaborador: $0.10/$0.20).
O claude-fable-5-1 foi lançado por $10/$50 por MTok, com o preço de leitura do cache reduzido para $0.25 (0.025x), contexto de 1M e saída de 128K, junto com o Claude Mythos 5.1 para participantes do Project Glasswing; forced tool_choice não é compatível.
O TLS mútuo e a federação de identidade de workload X.509 ficaram disponíveis para uso geral na OpenAI API e podem ser configurados no console da Platform.
A Assistants API foi desativada; a OpenAI também anunciou que whisper-1 e os modelos gpt-4o transcribe serão desativados em 2027-02-26.
O GPT-5.6 Sol passou a custar $4 por entrada / $20 por saída a cada 1M de tokens (redução de 20% na entrada e 33% na saída), em uma oferta promocional disponível pelo menos até 2026-11-21.
O uso do computador saiu da versão beta como computer_toolset_20260801 (ações em lote, zoom ativado por padrão), foi lançado o conjunto de ferramentas de cliente browser_toolset_20260801, e a Files API e a Agent Skills/Skills API deixaram de exigir cabeçalhos beta.
O openai-agents-python v0.22.0 trouxe reforços de segurança em runtime, redação de saídas de guardrails, validação de opções do provider e visualização ampliada do grafo de handoffs; as alterações incompatíveis estão listadas no lançamento.
A Z.ai lançou o GLM-5.3 (com a mesma base do GLM-5.2, aprimorada por pós-treinamento) por $1.40/$4.40 a cada 1M de tokens; não é mais possível desativar o modo de raciocínio.
A DeepSeek lançou a versão GA do V4-Pro, com resultados melhores em benchmarks de agentes, formato nativo da OpenAI Responses API (adaptado para Codex) e níveis de esforço low/high/max, e anunciou preços de pico e fora de pico a partir de 2026-08-16.
A Google lançou o gemini-3.7-flash para programação e fluxos de trabalho com agentes, com preço promocional até 2026-12-31.
claude-agent-sdk v0.2.137 adicionou ConversationResetMessage, campos de origem da mensagem e as opções resume_session_at/resume_drops_turn para truncar sessões retomadas com segurança.
A Anthropic cancelou o aumento previsto para 2026-09-01, de $3/$15, mantendo o Claude Sonnet 5 a $2/$10 por MTok.
As sessões do Claude Managed Agents ganharam limites rígidos de gastos (com pausa ao atingir budget_reached), um modelo advisor que o agente pode consultar durante um turno, inference_geo por agente e carregamento automático de skills de repositórios GitHub montados.
As organizações do Claude Enterprise podem encaminhar prompts sujeitos a políticas para seu próprio servidor de segurança de IA e receber decisões de permitir ou bloquear antes da inferência; claude-opus-4-1-20250805 foi descontinuado.
A Alibaba lançou o Qwen3.8-Max, um MoE de 2.4T parâmetros com contexto de 1M, no Model Studio, e prometeu liberar os pesos abertos na semana seguinte.
Priority processing passou a se chamar Fast mode (preço 2x maior e velocidade até 2.5x maior para GPT-5.6 Sol); o GPT-5.6 Luna ficou 80% mais barato e o GPT-5.6 Terra, 20%.
A nova revisão do MCP remove o handshake de inicialização e as sessões de protocolo, adiciona uma RPC obrigatória server/discover e o padrão Multi Round-Trip Request, move as tasks para uma extensão e descontinua Roots, Sampling e Logging.
claude-opus-5 foi lançado a $5/$25 por MTok, com contexto de 1M e saída de 128K, além de mudanças de ferramentas durante a conversa (beta) e um modo padrão de fallback no servidor.
Os nomes antigos dos modelos deepseek-chat e deepseek-reasoner foram programados para ser descontinuados nesta data (anunciado em 2026-04-24, junto com o lançamento do V4).
O Google disponibilizou o gemini-3.6-flash e o gemini-3.5-flash-lite para o público geral e descontinuou os parâmetros de amostragem temperature, top_p e top_k.
A Moonshot lançou o Kimi K3, um MoE de pesos abertos com 2.8T parâmetros e contexto de 1M, na Kimi API, por $3/$15 por 1M de tokens; os pesos foram liberados até 2026-07-27.
claude-sonnet-5 foi lançado com contexto de 1M e um novo tokenizer (cerca de 30% mais tokens); agora, o extended thinking manual e os parâmetros de amostragem que não são padrão retornam 400.
O Google lançou uma prévia pública da ferramenta Computer Use no Gemini 3.5 Flash, com ambientes de navegador, dispositivos móveis e desktop, políticas de segurança configuráveis e detecção de prompt injection.
claude-sonnet-4-20250514 e claude-opus-4-20250514 foram descontinuados; as solicitações agora retornam erros.
gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite e gemini-2.0-flash-lite-001 foram descontinuados. Use gemini-3.5-flash ou gemini-3.1-flash-lite como substitutos.