Claude Sonnet 4.5 oznaczony jako przestarzały
Anthropic ogłosiło wycofanie claude-sonnet-4-5-20250929. Model zostanie wycofany z Claude API 2026-11-30, a zalecanym następcą jest Sonnet 5.5.
Premiery i wycofania modeli, wydania API i SDK, zmiany specyfikacji MCP oraz zmiany cen wpływające na już wdrożony kod. Od najnowszych; każdy wpis zawiera odnośnik do informacji od dostawcy.
Anthropic ogłosiło wycofanie claude-sonnet-4-5-20250929. Model zostanie wycofany z Claude API 2026-11-30, a zalecanym następcą jest Sonnet 5.5.
OpenAI udostępniło gpt-6.1-sol do programowania i pracy zawodowej w cenie $2 za input / $0.10 za cache / $10 za output (prompty <=272K). W Responses API dostępne jest w wersji beta delegowanie zadań do subagentów w ramach systemu wieloagentowego.
Podczas DevDay 2026 OpenAI ogłosiło Dots — trwałe agenty, GPT-6.1 Sol, poziom szybkości Ultrafast, ograniczony podgląd Decisions API, Amazon Bedrock Managed Agents oparte na OpenAI oraz obsługę roboczej specyfikacji MCP Events w ChatGPT.
Agenty oparte na Agents API mogą teraz wykonywać zadania w przeglądarce hostowanej przez OpenAI, a aplikacja dewelopera obsługuje zatwierdzanie dostępu do stron i logowanie.
Model gpt-6-astra można wywołać z service_tier "ultrafast" w Responses API w cenie $60 za wejście / $300 za wyjście na 1M tokenów (krótki kontekst); przetwarzanie jest dostępne wyłącznie globalnie i z rezydencją danych w USA.
Model claude-sonnet-5-5 zadebiutował w cenie $2/$10 za MTok, z kontekstem 1M i wyjściem 128K. Wprowadza pięć niekompatybilnych zmian względem Sonnet 5, w tym zwracanie błędu 400 przy wymuszonym tool_choice oraz brak obsługi computer_20251124 w Claude API.
Odmowy zwracane przed wygenerowaniem jakiegokolwiek wyjścia znów są płatne, gdy stop_details.category ma wartość bio, frontier_llm lub reasoning_extraction; wczesne odmowy w pozostałych kategoriach nadal są bezpłatne.
OpenClaw 2026.9.6 wprowadza odzyskiwanie po zarządzanych aktualizacjach, raportowanie użycia z 30 dni, pliki, pamięć i umiejętności w zdalnych workspace’ach oraz obsługę modeli czatu Claude Opus 5.5, GPT-6 Sol/Luna i Grok 4.7.
OpenAI udostępniło modele rozumujące gpt-6-sol ($2/$0.20/$10) i gpt-6-luna ($0.10/$0.01/$0.50) w interfejsach Responses i Chat Completions API.
Model claude-opus-5-5 zadebiutował w cenie $4/$20 za MTok (taniej niż Opus 5), z kontekstem 1M, wyjściem 128K i zawsze aktywnym adaptacyjnym rozumowaniem; nie można go wyłączyć, a korzystanie z komputera wymaga computer_toolset_20260801.
Nagłówek beta inline-tools-2026-09-15 umożliwia dodawanie i modyfikowanie narzędzi — w tym zestawów narzędzi MCP przez mcp-client-2026-09-15 — w wiadomości systemowej w trakcie rozmowy, bez unieważniania cache promptu.
Model grok-4.7 zadebiutował z oknem kontekstu 500K w cenie $2 za wejście / $0.50 za tokeny z cache / $6 za wyjście (ceny podwajają się dla promptów >=200K), a także z obsługą wywoływania funkcji i ustrukturyzowanych danych wyjściowych; Batch API nie jest obsługiwane.
Google ograniczyło dostęp do modeli Gemini 2.5 do użytkowników, którzy już z nich korzystali (modele nie zostały wycofane), i zaleciło nowym projektom korzystanie z Gemini 3.5 Flash-Lite lub 3.8 Flash.
OpenClaw 2026.9.5 wprowadza aktualizacje atomowe, wtyczki instalowane bez ponownego uruchamiania Gateway, rozmowy, które można udostępniać, GPT Live na spotkaniach i podczas rozmów oraz konfigurację zespołów wyspecjalizowanych agentów prowadzoną krok po kroku.
Google udostępniło zarządzanego agenta antigravity-preview-09-2026 z wbudowanymi narzędziami o zmienionych nazwach w formacie PascalCase oraz edycją plików w określonych zakresach wierszy; antigravity-preview-05-2026 zostanie wyłączony 2026-10-05.
Messages API umożliwia kompaktowanie rozmowy na żądanie (nagłówek beta compact-2026-09-04) i zwraca podpisany blok kompaktowania, który zastępuje wcześniejsze wiadomości w kolejnych żądaniach.
OpenAI udostępniło Agents API w publicznej wersji beta. API oferuje open-source’owy harness Codex jako zarządzaną usługę z trwałymi sesjami, obsługą MCP i narzędzi, subagentami oraz sandboxami hostowanymi przez OpenAI, self-hostowanymi lub udostępnianymi przez partnerów; poza kosztami tokenów i narzędzi nie ma dodatkowych opłat.
Pełnodupleksowe sesje głosowe gpt-live-1 są już ogólnie dostępne (GA) w cenie $0.05 za minutę, z rozliczaniem co sekundę. Rozumowanie modelu backendowego lub agenta można delegować przez Responses albo klienta.
DeepSeek udostępnił multimodalny model V4.1-Flash pod nazwą deepseek-flash, wycofał V4-Flash i obniżył ceny (w godzinach szczytu $0.30 za wejście / $1.20 za wyjście, poza szczytem o połowę mniej).
Claude Managed Agents zyskał politykę uprawnień auto, w ramach której serwer ocenia każde wywołanie agenta lub narzędzia MCP i wykonuje je, odrzuca albo wstrzymuje do czasu uzyskania zgody.
OpenAI udostępniło gpt-6-astra ($10/$1/$50), swój najbardziej zaawansowany model. Nowości obejmują asynchroniczne wywoływanie narzędzi, sterowanie w trakcie tury przez WebSockets i zmianę poziomu nakładu rozumowania w trakcie rozmowy. Wywoływanie narzędzi wymaga Responses API.
Google udostępniło gemini-3.8-flash, przeznaczony do długotrwałych zadań inżynierii oprogramowania i autonomicznych agentów, w cenie promocyjnej $0.75/$3.75 za 1M tokenów do 2026-12-31.
Meta udostępniła Muse Spark 1.3 z maksymalnym poziomem rozumowania w Muse Code i Meta Model API w cenie $1.25/$4.25 za 1M tokenów (stawka dla współtwórców: $0.10/$0.20).
claude-fable-5-1 zadebiutował w cenie $10/$50 za MTok. Odczyt z cache potaniał do $0.25 (0.025x), okno kontekstu wynosi 1M, a limit wyjścia 128K. Uczestnicy Project Glasswing otrzymali też Claude Mythos 5.1. Wymuszona wartość tool_choice nie jest obsługiwana.
Wzajemny TLS i federacja tożsamości obciążenia X.509 stały się ogólnie dostępne dla OpenAI API. Można je skonfigurować w konsoli Platform.
Assistants API zostało wyłączone. OpenAI ogłosiło również, że modele whisper-1 i gpt-4o transcribe zostaną wyłączone 2027-02-26.
Cena GPT-5.6 Sol spadła do $4 za wejście / $20 za wyjście na 1M tokenów (wejście tańsze o 20%, wyjście o 33%). Cena promocyjna obowiązuje co najmniej do 2026-11-21.
Computer use wyszedł z bety jako computer_toolset_20260801 (akcje wsadowe, domyślnie włączone powiększanie). Udostępniono zestaw narzędzi klienta browser_toolset_20260801, a Files API i Agent Skills/Skills API nie wymagają już nagłówków beta.
Wydano openai-agents-python v0.22.0 z ulepszeniami bezpieczeństwa środowiska uruchomieniowego, redakcją wyników guardrail, walidacją opcji dostawcy i rozszerzoną wizualizacją grafu przekazań. Zmiany niekompatybilne wstecz opisano w informacjach o wydaniu.
Z.ai udostępniło GLM-5.3 (oparty na tej samej bazie co GLM-5.2, ulepszony przez post-training) w cenie $1.40/$4.40 za 1M tokenów. Nie można już wyłączyć trybu thinking.
DeepSeek udostępnił V4-Pro w wersji GA, z lepszymi wynikami w benchmarkach agentów, natywnym formatem OpenAI Responses API (dostosowanym do Codex) i poziomami nakładu low/high/max. Ogłoszono też ceny szczytowe i poza szczytem, obowiązujące od 2026-08-16.
Google udostępniło gemini-3.7-flash do programowania i pracy z agentami w cenie promocyjnej obowiązującej do 2026-12-31.
claude-agent-sdk v0.2.137 dodaje ConversationResetMessage, pola określające pochodzenie wiadomości oraz opcje resume_session_at/resume_drops_turn, które umożliwiają bezpieczne skracanie wznowionych sesji.
Anthropic odwołało zaplanowaną na 2026-09-01 podwyżkę do $3/$15, utrzymując cenę Claude Sonnet 5 na poziomie $2/$10 za MTok.
Sesje Claude Managed Agents zyskały sztywne limity wydatków (wstrzymanie po osiągnięciu limitu budget_reached), model doradczy, z którym agent może konsultować się w trakcie tury, ustawienie inference_geo dla każdego agenta oraz automatyczne ładowanie skills z podmontowanych repozytoriów GitHub.
Organizacje Claude Enterprise mogą kierować zarządzane prompty do własnego serwera bezpieczeństwa AI, aby przed inferencją uzyskać decyzję o zezwoleniu lub odmowie; model claude-opus-4-1-20250805 został wycofany.
Alibaba udostępniło w Model Studio model Qwen3.8-Max — architekturę MoE z 2.4T parametrów i kontekstem 1M — zapowiadając publikację otwartych wag w kolejnym tygodniu.
Priority processing zmieniło nazwę na Fast mode (2x wyższa cena, do 2.5x większa szybkość dla GPT-5.6 Sol), a GPT-5.6 Luna potaniał o 80%, zaś GPT-5.6 Terra o 20%.
Nowa wersja MCP usuwa uzgadnianie initialize i sesje protokołu, dodaje wymagane RPC server/discover oraz wzorzec Multi Round-Trip Request, przenosi tasks do rozszerzenia i oznacza Roots, Sampling oraz Logging jako przestarzałe.
Model claude-opus-5 zadebiutował w cenie $5/$25 za MTok, z kontekstem 1M i limitem wyjścia 128K. Wprowadzono także możliwość zmiany narzędzi w trakcie rozmowy (beta) oraz domyślny tryb rezerwowy po stronie serwera.
Tego dnia zaplanowano wycofanie starszych nazw modeli deepseek-chat i deepseek-reasoner (ogłoszone 2026-04-24 wraz z premierą V4).
Google udostępniło modele gemini-3.6-flash i gemini-3.5-flash-lite jako ogólnodostępne oraz oznaczyło parametry próbkowania temperature, top_p i top_k jako przestarzałe.
Moonshot udostępniło model Kimi K3 — otwartą architekturę MoE z 2.8T parametrów i kontekstem 1M — w Kimi API w cenie $3/$15 za 1M tokenów; wagi opublikowano do 2026-07-27.
Model claude-sonnet-5 zadebiutował z kontekstem 1M i nowym tokenizerem (około 30% więcej tokenów); ręczne włączanie extended thinking i niestandardowe parametry próbkowania zwracają teraz błąd 400.
Google udostępniło publiczną wersję zapoznawczą narzędzia Computer Use w Gemini 3.5 Flash. Obsługuje ono środowiska przeglądarkowe, mobilne i desktopowe, konfigurowalne zasady bezpieczeństwa oraz wykrywanie prompt injection.
Modele claude-sonnet-4-20250514 i claude-opus-4-20250514 zostały wycofane; żądania zwracają teraz błędy.
Modele gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite i gemini-2.0-flash-lite-001 zostały wycofane. Ich zamiennikami są gemini-3.5-flash lub gemini-3.1-flash-lite.