Claude Sonnet 4.5 wird eingestellt
Anthropic hat die Einstellung von claude-sonnet-4-5-20250929 angekündigt. Die Claude API wird am 2026-11-30 eingestellt; als Ersatz wird Sonnet 5.5 empfohlen.
Neue und eingestellte Modelle, API- und SDK-Releases, Änderungen an der MCP-Spezifikation und Preisänderungen, die sich auf bereits ausgelieferten Code auswirken. Neueste Einträge zuerst, jeweils mit einem Link zu den offiziellen Hinweisen des Anbieters.
Anthropic hat die Einstellung von claude-sonnet-4-5-20250929 angekündigt. Die Claude API wird am 2026-11-30 eingestellt; als Ersatz wird Sonnet 5.5 empfohlen.
OpenAI hat gpt-6.1-sol für Programmieraufgaben und professionelle Arbeit veröffentlicht. Der Preis beträgt $2 für Eingaben, $0.10 für gecachte Eingaben und $10 für Ausgaben (bei Prompts mit <=272K Tokens). Die Delegation an Subagenten in Multi-Agent-Setups ist in der Responses API als Beta verfügbar.
Auf dem DevDay 2026 kündigte OpenAI persistente Dots-Agenten, GPT-6.1 Sol, die Geschwindigkeitsstufe Ultrafast, eine eingeschränkte Vorschau der Decisions API, von OpenAI unterstützte Amazon Bedrock Managed Agents und die Unterstützung des MCP-Events-Spezifikationsentwurfs in ChatGPT an.
Mit der Agents API erstellte Agenten können Aufgaben jetzt in einem von OpenAI gehosteten Browser erledigen. Die Anwendung des Entwicklers verwaltet dabei die Freigabe des Website-Zugriffs und die Anmeldung.
gpt-6-astra kann in der Responses API mit service_tier "ultrafast" aufgerufen werden. Der Preis beträgt $60 für Input und $300 für Output pro 1M Tokens (kurzer Kontext); die Verarbeitung ist nur global und mit US-Datenresidenz verfügbar.
claude-sonnet-5-5 wurde zu $2/$10 pro MTok mit 1M Kontext und 128K Output veröffentlicht. Im Vergleich zu Sonnet 5 gibt es fünf Breaking Changes: Unter anderem führt erzwungenes tool_choice zu 400, und computer_20251124 wird von der Claude API nicht mehr akzeptiert.
Ablehnungen, die vor jeder Ausgabe erfolgen, werden wieder berechnet, wenn stop_details.category den Wert bio, frontier_llm oder reasoning_extraction hat. Frühe Ablehnungen in anderen Kategorien bleiben kostenlos.
OpenClaw 2026.9.6 ergänzt die Wiederherstellung nach verwalteten Updates, Nutzungsberichte für 30 Tage, Files/Memory/Skills für Remote-Workspaces sowie Unterstützung für die Chat-Modelle Claude Opus 5.5, GPT-6 Sol/Luna und Grok 4.7.
OpenAI hat die Reasoning-Modelle gpt-6-sol ($2/$0.20/$10) und gpt-6-luna ($0.10/$0.01/$0.50) für die Responses API und die Chat Completions API veröffentlicht.
claude-opus-5-5 wurde zu $4/$20 pro MTok veröffentlicht (günstiger als Opus 5) und bietet 1M Kontext, 128K Output und dauerhaft aktiviertes adaptives Thinking. Thinking lässt sich nicht deaktivieren; für Computer Use ist computer_toolset_20260801 erforderlich.
Mit dem Beta-Header inline-tools-2026-09-15 lassen sich Tools (einschließlich MCP-Toolsets über mcp-client-2026-09-15) in einer Systemnachricht mitten im Gespräch hinzufügen oder ändern, ohne den Prompt-Cache ungültig zu machen.
grok-4.7 wurde mit einem Kontextfenster von 500K, Preisen von $2 für Input, $0.50 für gecachte Tokens und $6 für Output (doppelte Preise für Prompts >=200K), Function Calling und strukturierten Ausgaben veröffentlicht. Die Batch API wird nicht unterstützt.
Google hat den Zugriff auf Gemini 2.5 auf Nutzer beschränkt, die die Modelle bereits verwendet hatten (sie wurden nicht eingestellt), und empfiehlt neuen Projekten Gemini 3.5 Flash-Lite oder 3.8 Flash.
OpenClaw 2026.9.5 führt Atomic Updates, ohne Neustart des Gateways installierbare Plugins, teilbare Gespräche, GPT Live für Meetings und Anrufe sowie eine geführte Einrichtung für Teams spezialisierter Agents ein.
Google hat den verwalteten Agent antigravity-preview-09-2026 veröffentlicht. Er bietet umbenannte integrierte Tools in PascalCase und Bearbeitungen von Dateien anhand von Zeilenbereichen. antigravity-preview-05-2026 wird am 2026-10-05 eingestellt.
Die Messages API kann Gespräche auf Anfrage komprimieren (Beta-Header compact-2026-09-04) und gibt einen signierten Komprimierungsblock zurück, der frühere Nachrichten in nachfolgenden Requests ersetzt.
OpenAI hat die Agents API als öffentliche Beta gestartet. Sie stellt das Open-Source-Codex-Harness als verwalteten Dienst mit dauerhaften Sessions, MCP/Tools, Subagents und von OpenAI gehosteten, selbst gehosteten oder von Partnern bereitgestellten Sandboxes bereit. Zusätzliche Gebühren über Tokens und Tools hinaus fallen nicht an.
Vollduplex-Sprachsitzungen mit gpt-live-1 sind jetzt allgemein verfügbar. Der Preis beträgt $0.05 pro Minute (sekundengenaue Abrechnung); das Reasoning des Backend-Modells oder Agents kann über Responses oder den Client ausgeführt werden.
DeepSeek veröffentlichte das multimodale Modell V4.1-Flash unter dem Modellnamen deepseek-flash, stellte V4-Flash ein und senkte die Preise (Spitzenzeiten: $0.30 pro Eingabe / $1.20 pro Ausgabe, außerhalb der Spitzenzeiten die Hälfte).
Claude Managed Agents erhielt eine Berechtigungsrichtlinie namens „auto“. Dabei prüft der Server jeden Aufruf eines Agenten oder MCP-Tools und führt ihn aus, lehnt ihn ab oder pausiert ihn zur Genehmigung.
OpenAI veröffentlichte gpt-6-astra ($10/$1/$50) als leistungsfähigstes Modell. Neu sind asynchrones Tool-Calling, die Steuerung während eines Turns über WebSockets und Änderungen des Reasoning-Aufwands mitten im Gespräch. Tool-Calling erfordert die Responses API.
Google veröffentlichte gemini-3.8-flash für langfristig angelegte Softwareentwicklung und autonome Agenten zum Einführungspreis von $0.75/$3.75 pro 1M Tokens bis 2026-12-31.
Meta veröffentlichte Muse Spark 1.3 mit maximalem Reasoning in Muse Code und der Meta Model API zum Preis von $1.25/$4.25 pro 1M Tokens (Contributor-Stufe: $0.10/$0.20).
claude-fable-5-1 startete zum Preis von $10/$50 pro MTok. Cache-Lesezugriffe wurden auf $0.25 (0.025x) gesenkt; das Modell bietet 1M Kontext und 128K Ausgabe. Gleichzeitig wurde Claude Mythos 5.1 für Teilnehmer an Project Glasswing angekündigt. Erzwungenes tool_choice wird nicht unterstützt.
Gegenseitiges TLS und X.509 Workload Identity Federation sind für die OpenAI API allgemein verfügbar und lassen sich in der Platform-Konsole konfigurieren.
Die Assistants API wurde eingestellt. OpenAI kündigte außerdem an, whisper-1 und die gpt-4o-Transkriptionsmodelle am 2027-02-26 einzustellen.
Der Preis für GPT-5.6 Sol sank auf $4 pro 1M Tokens für Eingaben und $20 für Ausgaben (20 % weniger für Eingaben, 33 % weniger für Ausgaben). Der Aktionspreis gilt mindestens bis 2026-11-21.
Computer Use verließ die Beta als computer_toolset_20260801 (Batch-Aktionen, Zoom standardmäßig aktiviert). Außerdem startete das Client-Toolset browser_toolset_20260801. Die Files API und die Agent Skills/Skills API benötigen keine Beta-Header mehr.
openai-agents-python v0.22.0 bietet eine robustere Laufzeit, Redaction von Guardrail-Ausgaben, Validierung von Provider-Optionen und eine erweiterte Visualisierung des Handoff-Graphen. Breaking Changes sind im Release aufgeführt.
Z.ai veröffentlichte GLM-5.3 (gleiche Basis wie GLM-5.2, durch Post-Training verbessert) zum Preis von $1.40/$4.40 pro 1M Tokens. Thinking lässt sich nicht mehr deaktivieren.
DeepSeek veröffentlichte V4-Pro als allgemein verfügbare Version mit besseren Agenten-Benchmarks, nativem OpenAI-Responses-API-Format (für Codex angepasst) sowie den Effort-Stufen low, high und max. Preise für Spitzen- und Nebenzeiten gelten ab 2026-08-16.
Google veröffentlichte gemini-3.7-flash für Coding und agentische Workflows zum Einführungspreis bis 2026-12-31.
claude-agent-sdk v0.2.137 ergänzt ConversationResetMessage, Felder zum Nachrichtenursprung sowie die Optionen resume_session_at/resume_drops_turn zum sicheren Kürzen fortgesetzter Sitzungen.
Anthropic sagte die geplante Preiserhöhung zum 2026-09-01 ab. Claude Sonnet 5 bleibt damit bei $2/$10 pro MTok.
Sitzungen mit Claude Managed Agents unterstützen jetzt feste Ausgabenlimits (mit Pause bei budget_reached), ein Advisor-Modell, das der Agent während eines Turns hinzuziehen kann, inference_geo pro Agent sowie das automatische Laden von Skills aus eingebundenen GitHub-Repositories.
Organisationen mit Claude Enterprise können kontrollierte Prompts vor der Inferenz an ihren eigenen AI-Sicherheitsserver weiterleiten, der sie erlaubt oder ablehnt. Außerdem wurde claude-opus-4-1-20250805 eingestellt.
Alibaba veröffentlichte Qwen3.8-Max auf Model Studio: ein MoE-Modell mit 2.4T Parametern und 1M Kontext. Open Weights sollen in der folgenden Woche verfügbar werden.
Priority Processing wurde in Fast Mode umbenannt (doppelter Preis, bis zu 2.5-mal schneller für GPT-5.6 Sol). GPT-5.6 Luna wurde 80 % und GPT-5.6 Terra 20 % günstiger.
Die neue MCP-Version entfernt den initialize-Handshake und Protokollsitzungen, ergänzt einen verpflichtenden server/discover-RPC und das Multi Round-Trip Request-Muster, verschiebt Tasks in eine Erweiterung und stuft Roots, Sampling und Logging als veraltet ein.
claude-opus-5 wurde mit 1M Kontext und 128K Ausgabe für $5/$25 pro MTok veröffentlicht. Hinzu kommen Änderungen an Tools während einer Unterhaltung (Beta) und ein standardmäßig aktivierter serverseitiger Fallback-Modus.
Die Einstellung der alten Modellnamen deepseek-chat und deepseek-reasoner war für diesen Tag geplant. Angekündigt wurde sie am 2026-04-24 zusammen mit der Veröffentlichung von V4.
Google hat gemini-3.6-flash und gemini-3.5-flash-lite allgemein verfügbar gemacht und die Sampling-Parameter temperature, top_p und top_k als veraltet eingestuft.
Moonshot veröffentlichte Kimi K3 über die Kimi API für $3/$15 pro 1M Tokens: ein MoE-Modell mit 2.8T Parametern, 1M Kontext und Open Weights, die bis zum 2026-07-27 bereitgestellt werden sollten.
claude-sonnet-5 wurde mit 1M Kontext und einem neuen Tokenizer veröffentlicht (etwa 30 % mehr Tokens). Manuelles Extended Thinking und nicht standardmäßige Sampling-Parameter führen jetzt zu einem 400-Fehler.
Google hat eine öffentliche Vorschau des Computer Use Tools in Gemini 3.5 Flash veröffentlicht. Sie umfasst Browser-, Mobil- und Desktop-Umgebungen, konfigurierbare Sicherheitsrichtlinien und die Erkennung von Prompt-Injection.
claude-sonnet-4-20250514 und claude-opus-4-20250514 wurden eingestellt; Anfragen führen jetzt zu Fehlern.
gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite und gemini-2.0-flash-lite-001 wurden eingestellt. Als Ersatz dienen gemini-3.5-flash oder gemini-3.1-flash-lite.