Claude Sonnet 4.5 wordt uitgefaseerd
Anthropic heeft aangekondigd dat claude-sonnet-4-5-20250929 wordt uitgefaseerd. De uitfasering van de Claude API staat gepland voor 2026-11-30; Sonnet 5.5 is de aanbevolen vervanger.
Modelintroducties en uitfaseringen, API- en SDK-releases, wijzigingen in de MCP-specificatie en prijswijzigingen die invloed hebben op code die je al hebt gedeployed. Nieuwste eerst, met bij elke vermelding een link naar de officiële toelichting van de leverancier.
Anthropic heeft aangekondigd dat claude-sonnet-4-5-20250929 wordt uitgefaseerd. De uitfasering van de Claude API staat gepland voor 2026-11-30; Sonnet 5.5 is de aanbevolen vervanger.
OpenAI heeft gpt-6.1-sol uitgebracht voor programmeerwerk en professionele taken, voor $2 input / $0.10 cached / $10 output (<=272K prompts). Delegatie aan subagents voor multi-agentgebruik is beschikbaar in de Responses API-bèta.
Tijdens DevDay 2026 kondigde OpenAI Dots persistent agents, GPT-6.1 Sol, de Ultrafast-snelheidsklasse, een beperkte preview van de Decisions API, Amazon Bedrock Managed Agents op basis van OpenAI en ondersteuning in ChatGPT voor de concept-MCP Events-specificatie aan.
Agents die met de Agents API zijn gebouwd, kunnen nu taken uitvoeren in een door OpenAI gehoste browser. De applicatie van de ontwikkelaar regelt de goedkeuring voor website-toegang en het aanmelden.
gpt-6-astra kan in de Responses API worden aangeroepen met service_tier "ultrafast" voor $60 input / $300 output per 1M tokens (korte context), met verwerking die uitsluitend plaatsvindt in de wereldwijde en Amerikaanse dataregio's.
claude-sonnet-5-5 is gelanceerd voor $2/$10 per MTok, met een context van 1M en een output van 128K. De release bevat vijf breaking changes ten opzichte van Sonnet 5, waaronder dat een geforceerde tool_choice een 400-fout oplevert en computer_20251124 niet langer wordt geaccepteerd door de Claude API.
Weigeringen die binnenkomen voordat er output is gegenereerd, worden opnieuw in rekening gebracht wanneer stop_details.category bio, frontier_llm of reasoning_extraction is; vroege weigeringen in andere categorieën blijven gratis.
OpenClaw 2026.9.6 voegde herstel van beheerde updates, gebruiksrapportage over 30 dagen, Files/Memory/Skills voor externe werkruimten en ondersteuning voor de chatmodellen Claude Opus 5.5, GPT-6 Sol/Luna en Grok 4.7 toe.
OpenAI bracht de redeneermodellen gpt-6-sol ($2/$0.20/$10) en gpt-6-luna ($0.10/$0.01/$0.50) uit voor de Responses- en Chat Completions-API's.
claude-opus-5-5 is gelanceerd voor $4/$20 per MTok (goedkoper dan Opus 5), met een context van 1M, een output van 128K en altijd ingeschakeld adaptief denken; denken kan niet worden uitgeschakeld en computergebruik vereist computer_toolset_20260801.
Met de bètaheader inline-tools-2026-09-15 kunnen tools (waaronder MCP-toolsets via mcp-client-2026-09-15) in een systeembericht midden in een gesprek worden toegevoegd of gewijzigd zonder de promptcache ongeldig te maken.
grok-4.7 is uitgebracht met een contextvenster van 500K voor $2 input / $0.50 uit cache / $6 output (het dubbele voor prompts >=200K), function calling en gestructureerde output; de Batch API wordt niet ondersteund.
Google beperkte de toegang tot Gemini 2.5-modellen tot gebruikers die ze al eerder hadden gebruikt (de modellen zijn niet verouderd verklaard) en adviseerde nieuwe projecten Gemini 3.5 Flash-Lite of 3.8 Flash te gebruiken.
OpenClaw 2026.9.5 introduceerde Atomic Updates, plugins die zonder herstart van de Gateway worden geïnstalleerd, deelbare gesprekken, GPT Live in vergaderingen en gesprekken, en begeleide installatie van teams met gespecialiseerde agents.
Google bracht de beheerde agent antigravity-preview-09-2026 uit, met hernoemde ingebouwde tools in PascalCase en bestandsbewerkingen op basis van regelnummers; antigravity-preview-05-2026 wordt op 2026-10-05 buiten gebruik gesteld.
De Messages API kan een gesprek op verzoek compacter maken (met de bètaheader compact-2026-09-04) en retourneert een ondertekend compactieblok dat eerdere berichten in volgende verzoeken vervangt.
OpenAI bracht de Agents API uit als openbare bèta. Deze biedt de open-source Codex-harness aan als beheerde service, met persistente sessies, MCP/tools, subagents en sandboxes die door OpenAI worden gehost, zelf worden gehost of door partners worden aangeboden, zonder extra kosten naast die voor tokens en tools.
gpt-live-1 full-duplex-spraaksessies zijn algemeen beschikbaar geworden voor $0.05 per minuut (afrekening per seconde). De backendmodel- of agentredenering kan via Responses of de client worden gedelegeerd.
DeepSeek bracht de multimodale V4.1-Flash uit onder de modelnaam deepseek-flash, beëindigde V4-Flash en verlaagde de prijzen (piek: $0.30 in / $1.20 uit, buiten piek de helft).
Claude Managed Agents kreeg een automatisch machtigingsbeleid waarbij de server elke agent- of MCP-toolaanroep beoordeelt en uitvoert, weigert of pauzeert voor goedkeuring.
OpenAI bracht gpt-6-astra ($10/$1/$50) uit als zijn meest capabele model, met asynchrone toolaanroepen, bijsturing tijdens een beurt via WebSockets en aanpassingen van de redeneerinspanning tijdens een gesprek; toolaanroepen vereisen de Responses API.
Google bracht gemini-3.8-flash uit, gericht op software-engineeringtaken met een lange looptijd en autonome agents, voor een introductieprijs van $0.75/$3.75 per 1M tokens tot en met 2026-12-31.
Meta bracht Muse Spark 1.3 uit met maximale redeneercapaciteit in Muse Code en de Meta Model API, voor $1.25/$4.25 per 1M tokens (contributorniveau: $0.10/$0.20).
claude-fable-5-1 werd gelanceerd voor $10/$50 per MTok, met cachelezen verlaagd naar $0.25 (0.025x), een contextvenster van 1M en een outputlimiet van 128K, naast Claude Mythos 5.1 voor deelnemers aan Project Glasswing; geforceerde tool_choice wordt niet ondersteund.
Wederzijdse TLS en federatie van X.509-workloadidentiteiten zijn algemeen beschikbaar geworden voor de OpenAI API en kunnen worden geconfigureerd in de Platform-console.
De Assistants API is beëindigd; OpenAI kondigde ook aan dat whisper-1 en de gpt-4o-transcribemodellen op 2027-02-26 worden beëindigd.
GPT-5.6 Sol kost nu $4 input / $20 output per 1M tokens (20% lagere inputprijs, 33% lagere outputprijs); deze actieprijs geldt ten minste tot en met 2026-11-21.
Computer use verliet de bètafase als computer_toolset_20260801 (batchacties, zoomen standaard ingeschakeld), er werd een browser_toolset_20260801-clienttoolset gelanceerd en voor de Files API en Agent Skills/Skills API zijn de bètaheaders verwijderd.
openai-agents-python v0.22.0 bevatte verbeteringen voor de runtime, redactie van guardrail-output, validatie van provideropties en uitgebreidere visualisatie van de handoff-grafiek. De release beschrijft ook de breaking changes.
Z.ai bracht GLM-5.3 uit (dezelfde basis als GLM-5.2, verbeterd met post-training) voor $1.40/$4.40 per 1M tokens; denken kan niet langer worden uitgeschakeld.
DeepSeek bracht V4-Pro algemeen beschikbaar uit, met betere agentbenchmarks, native ondersteuning voor het OpenAI Responses API-formaat (aangepast voor Codex) en de inspanningsniveaus low/high/max. Ook kondigde het piek- en dalprijzen aan, geldig vanaf 2026-08-16.
Google bracht gemini-3.7-flash uit voor programmeerwerk en agentworkflows, met een introductieprijs tot en met 2026-12-31.
claude-agent-sdk v0.2.137 voegde ConversationResetMessage, velden voor de berichtoorsprong en de opties resume_session_at/resume_drops_turn toe om hervatte sessies veilig af te kappen.
Anthropic heeft de geplande prijsverhoging van 2026-09-01 geannuleerd en houdt Claude Sonnet 5 op $2/$10 per MTok.
Claude Managed Agents-sessies kregen harde uitgavenlimieten (met pauzering zodra budget_reached is bereikt), een advisormodel dat de agent halverwege een beurt kan raadplegen, inference_geo per agent en het automatisch laden van skills uit gekoppelde GitHub-repositories.
Organisaties met Claude Enterprise kunnen prompts waarvoor governance geldt naar hun eigen AI-beveiligingsserver routeren voor een toestaan/weigeren-oordeel vóór inference. Ook is claude-opus-4-1-20250805 uitgefaseerd.
Alibaba lanceerde Qwen3.8-Max op Model Studio: een MoE-model met 2.4T parameters en een contextvenster van 1M. Open weights zouden de week erna beschikbaar komen.
Priority processing kreeg de nieuwe naam Fast mode (2x de prijs, tot 2.5x sneller voor GPT-5.6 Sol). GPT-5.6 Luna werd 80% goedkoper en GPT-5.6 Terra 20%.
De nieuwe MCP-versie verwijdert de initialize-handshake en protocolsessies, voegt een verplichte server/discover-RPC en het Multi Round-Trip Request-patroon toe, verplaatst taken naar een extensie en faseert Roots, Sampling en Logging uit.
claude-opus-5 werd gelanceerd voor $5/$25 per MTok, met een contextvenster van 1M en een outputlimiet van 128K. Ook kwamen wijzigingen van tools midden in een gesprek (bèta) en een standaard fallbackmodus aan de serverkant beschikbaar.
De verouderde modelnamen deepseek-chat en deepseek-reasoner zouden op deze datum worden uitgefaseerd (aangekondigd op 2026-04-24 bij de lancering van V4).
Google heeft gemini-3.6-flash en gemini-3.5-flash-lite algemeen beschikbaar gemaakt en de samplingparameters temperature, top_p en top_k uitgefaseerd.
Moonshot lanceerde Kimi K3 via de Kimi API voor $3/$15 per 1M tokens: een MoE-model met 2.8T parameters, open weights en een contextvenster van 1M. De weights zouden uiterlijk op 2026-07-27 beschikbaar komen.
claude-sonnet-5 werd gelanceerd met een contextvenster van 1M en een nieuwe tokenizer (~30% meer tokens); handmatig extended thinking en niet-standaard samplingparameters leveren nu een 400-fout op.
Google bracht een publieke preview uit van de Computer Use-tool in Gemini 3.5 Flash, met browser-, mobiele en desktopomgevingen, configureerbare veiligheidsregels en detectie van prompt injection.
claude-sonnet-4-20250514 en claude-opus-4-20250514 zijn uitgefaseerd; verzoeken leveren nu fouten op.
gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite en gemini-2.0-flash-lite-001 zijn buiten gebruik gesteld. Vervangers zijn gemini-3.5-flash en gemini-3.1-flash-lite.