Claude Sonnet 4.5 déprécié
Anthropic a annoncé la dépréciation de claude-sonnet-4-5-20250929. Le retrait de l’API Claude est prévu pour le 2026-11-30, et Sonnet 5.5 est le remplacement recommandé.
Lancements et retraits de modèles, versions des API et SDK, changements de la spécification MCP et évolutions des tarifs qui affectent le code déjà déployé. Les plus récents d’abord, chaque entrée renvoyant vers les notes de l’éditeur.
Anthropic a annoncé la dépréciation de claude-sonnet-4-5-20250929. Le retrait de l’API Claude est prévu pour le 2026-11-30, et Sonnet 5.5 est le remplacement recommandé.
OpenAI a lancé gpt-6.1-sol pour le développement logiciel et les tâches professionnelles, au tarif de $2 input / $0.10 cached / $10 output (prompts <=272K), avec la délégation à des sous-agents multi-agents en bêta dans la Responses API.
Lors de DevDay 2026, OpenAI a annoncé les agents persistants Dots, GPT-6.1 Sol, le niveau de vitesse Ultrafast, un aperçu limité de Decisions API, Amazon Bedrock Managed Agents propulsé par OpenAI et la prise en charge par ChatGPT du brouillon de la spécification MCP Events.
Les agents basés sur Agents API peuvent désormais accomplir des tâches dans un navigateur hébergé par OpenAI, tandis que l’application du développeur gère les autorisations d’accès aux sites web et la connexion.
gpt-6-astra peut être appelé avec service_tier "ultrafast" dans l’API Responses au tarif de $60 en entrée / $300 en sortie par 1M tokens (contexte court), avec traitement limité aux régions globales et aux États-Unis.
claude-sonnet-5-5 est lancé au tarif de $2/$10 par MTok, avec un contexte de 1M et une sortie de 128K. Il introduit cinq changements incompatibles avec Sonnet 5, notamment le renvoi d’une erreur 400 lorsque tool_choice est forcé et le rejet de computer_20251124 par l’API Claude.
Les refus qui surviennent avant toute sortie sont de nouveau facturés lorsque stop_details.category vaut bio, frontier_llm ou reasoning_extraction ; les refus précoces des autres catégories restent gratuits.
OpenClaw 2026.9.6 ajoute la récupération après une mise à jour gérée, le suivi de l’utilisation sur 30 jours, les fichiers, la mémoire et les skills des espaces de travail distants, ainsi que la prise en charge de Claude Opus 5.5, GPT-6 Sol/Luna et Grok 4.7 comme modèles de chat.
OpenAI a lancé les modèles de raisonnement gpt-6-sol ($2/$0.20/$10) et gpt-6-luna ($0.10/$0.01/$0.50) sur les API Responses et Chat Completions.
claude-opus-5-5 est lancé au tarif de $4/$20 par MTok (moins cher qu’Opus 5), avec un contexte de 1M, une sortie de 128K et une réflexion adaptative toujours active. La réflexion ne peut pas être désactivée et l’utilisation de l’ordinateur nécessite computer_toolset_20260801.
Avec l’en-tête bêta inline-tools-2026-09-15, il est possible d’ajouter ou de modifier des outils (y compris des toolsets MCP via mcp-client-2026-09-15) dans un message système en cours de conversation, sans invalider le cache de prompt.
grok-4.7 est lancé avec une fenêtre de contexte de 500K au tarif de $2 en entrée / $0.50 en cache / $6 en sortie (tarifs doublés pour les prompts >=200K), ainsi que la prise en charge des appels de fonctions et des sorties structurées. L’API Batch n’est pas prise en charge.
Google a réservé l’accès aux modèles Gemini 2.5 aux utilisateurs qui les avaient déjà utilisés (sans les déprécier) et a recommandé aux nouveaux projets d’utiliser Gemini 3.5 Flash-Lite ou 3.8 Flash.
OpenClaw 2026.9.5 introduit les mises à jour atomiques, l’installation de plugins sans redémarrage du Gateway, les conversations partageables, GPT Live dans les réunions et les appels, ainsi qu’une configuration guidée pour les équipes d’agents spécialisés.
Google a lancé l’agent géré antigravity-preview-09-2026, avec des outils intégrés renommés en PascalCase et la modification de fichiers par plages de lignes. antigravity-preview-05-2026 sera arrêté le 2026-10-05.
L’API Messages peut compacter une conversation sur demande (avec l’en-tête bêta compact-2026-09-04) et renvoie un bloc de compaction signé qui remplace les messages antérieurs dans les requêtes suivantes.
OpenAI a lancé l’API Agents en bêta publique. Elle propose le harness open source Codex sous forme de service géré, avec des sessions persistantes, MCP et des outils, des sous-agents, ainsi que des sandboxes hébergés par OpenAI, auto-hébergés ou fournis par des partenaires, sans frais autres que ceux des tokens et des outils.
Les sessions vocales full-duplex gpt-live-1 sont désormais disponibles en version générale au tarif de $0.05 par minute (facturation à la seconde). Le raisonnement du modèle ou de l’agent backend peut être délégué via Responses ou le client.
DeepSeek a lancé le modèle multimodal V4.1-Flash sous le nom deepseek-flash, retiré V4-Flash et baissé ses tarifs (maximum : $0.30 en entrée / $1.20 en sortie, moitié prix hors pointe).
Claude Managed Agents a ajouté une règle d’autorisation automatique : le serveur évalue chaque appel d’agent ou d’outil MCP, puis l’exécute, le refuse ou le met en attente d’approbation.
OpenAI a lancé gpt-6-astra ($10/$1/$50), son modèle le plus performant, avec les appels d’outils asynchrones, le pilotage en cours de tour via WebSockets et la modification de l’effort de raisonnement en cours de conversation. Les appels d’outils nécessitent l’API Responses.
Google a lancé gemini-3.8-flash, conçu pour l’ingénierie logicielle sur de longues périodes et les agents autonomes, à un tarif de lancement de $0.75/$3.75 par 1M tokens jusqu’au 2026-12-31.
Meta a lancé Muse Spark 1.3 avec le raisonnement maximal dans Muse Code et l’API Meta Model, au tarif de $1.25/$4.25 par 1M tokens (offre contributeur : $0.10/$0.20).
claude-fable-5-1 a été lancé au tarif de $10/$50 par MTok, avec les lectures du cache réduites à $0.25 (0.025x), un contexte de 1M et une sortie de 128K. Claude Mythos 5.1 a également été lancé pour les participants à Project Glasswing. La valeur forcée de tool_choice n’est pas prise en charge.
La fédération d’identités de charge de travail avec TLS mutuel et X.509 est désormais disponible pour l’API OpenAI et peut être configurée dans la console Platform.
L’API Assistants a été arrêtée. OpenAI a également annoncé l’arrêt de whisper-1 et des modèles de transcription gpt-4o le 2027-02-26.
Le tarif de GPT-5.6 Sol est passé à $4 en entrée / $20 en sortie par 1M tokens (baisse de 20 % en entrée et de 33 % en sortie). Ce tarif promotionnel est disponible au moins jusqu’au 2026-11-21.
Computer use est sorti de la bêta sous le nom computer_toolset_20260801 (actions par lot, zoom activé par défaut). Un toolset client browser_toolset_20260801 a été lancé, et les en-têtes bêta des API Files et Agent Skills/Skills ont été supprimés.
openai-agents-python v0.22.0 apporte un runtime renforcé, la rédaction des sorties des garde-fous, la validation des options de fournisseur et une visualisation étendue des graphes de transfert. Les changements incompatibles sont répertoriés dans les notes de version.
Z.ai a lancé GLM-5.3 (même base que GLM-5.2, améliorée par post-entraînement) au tarif de $1.40/$4.40 par 1M tokens. Le mode réflexion ne peut plus être désactivé.
DeepSeek a lancé V4-Pro en disponibilité générale, avec de meilleurs résultats aux benchmarks d’agents, la prise en charge native du format de l’API OpenAI Responses (adapté à Codex) et les niveaux d’effort low/high/max. La tarification selon les heures de pointe et les heures creuses entrera en vigueur le 2026-08-16.
Google a lancé gemini-3.7-flash pour le développement logiciel et les workflows agentiques, à un tarif de lancement valable jusqu’au 2026-12-31.
claude-agent-sdk v0.2.137 ajoute ConversationResetMessage, des champs indiquant l’origine des messages et les options resume_session_at/resume_drops_turn pour tronquer en toute sécurité les sessions reprises.
Anthropic a annulé la hausse prévue le 2026-09-01 à $3/$15 et maintient Claude Sonnet 5 à $2/$10 par MTok.
Les sessions Claude Managed Agents prennent désormais en charge des budgets de dépenses stricts (avec suspension à l’atteinte de budget_reached), un modèle conseiller que l’agent peut consulter en cours de tour, inference_geo par agent et le chargement automatique des skills depuis les dépôts GitHub montés.
Les organisations Claude Enterprise peuvent acheminer les prompts soumis à des règles vers leur propre serveur de sécurité IA afin d’obtenir une décision d’autorisation ou de refus avant l’inférence. claude-opus-4-1-20250805 a été retiré.
Alibaba a lancé Qwen3.8-Max sur Model Studio : un MoE de 2.4T de paramètres avec un contexte de 1M. L’entreprise prévoit de publier ses poids ouverts la semaine suivante.
Priority processing a été renommé Fast mode (prix multiplié par 2, vitesse jusqu’à 2.5x supérieure pour GPT-5.6 Sol). GPT-5.6 Luna coûte désormais 80 % moins cher et GPT-5.6 Terra, 20 % moins cher.
La nouvelle révision de MCP supprime la négociation initialize et les sessions de protocole, ajoute un RPC server/discover obligatoire et le modèle Multi Round-Trip Request, déplace les tâches dans une extension et rend obsolètes Roots, Sampling et Logging.
claude-opus-5 est lancé à $5/$25 par MTok, avec un contexte de 1M et une sortie de 128K. Le lancement s’accompagne de la modification des outils en cours de conversation (bêta) et d’un mode de repli côté serveur activé par défaut.
Les anciens noms de modèles deepseek-chat et deepseek-reasoner devaient être abandonnés à cette date. Cette décision avait été annoncée le 2026-04-24 lors du lancement de V4.
Google a rendu gemini-3.6-flash et gemini-3.5-flash-lite disponibles de manière générale et déclaré obsolètes les paramètres d’échantillonnage temperature, top_p et top_k.
Moonshot a lancé Kimi K3 sur l’API Kimi à $3/$15 par 1M de tokens : un MoE à poids ouverts de 2.8T de paramètres, avec un contexte de 1M. Les poids seront publiés d’ici le 2026-07-27.
claude-sonnet-5 est lancé avec un contexte de 1M et un nouveau tokenizer (environ 30 % de tokens en plus). Le mode extended thinking manuel et les paramètres d’échantillonnage autres que ceux par défaut renvoient désormais une erreur 400.
Google a lancé un aperçu public de l’outil Computer Use dans Gemini 3.5 Flash. Il prend en charge des environnements de navigateur, mobiles et de bureau, des règles de sécurité configurables et la détection des prompt injections.
claude-sonnet-4-20250514 et claude-opus-4-20250514 ont été retirés ; les requêtes renvoient désormais des erreurs.
gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite et gemini-2.0-flash-lite-001 ont été arrêtés. gemini-3.5-flash ou gemini-3.1-flash-lite peuvent les remplacer.