Itinigil ang Claude Sonnet 4.5
Inanunsyo ng Anthropic ang paghinto sa claude-sonnet-4-5-20250929. Nakaiskedyul ang paghinto nito sa Claude API sa 2026-11-30, at inirerekomenda bilang kapalit ang Sonnet 5.5.
Mga paglulunsad at paghinto ng modelo, release ng API at SDK, pagbabago sa MCP spec at presyo na nakaaapekto sa code na naipadala mo na. Pinakabago muna; may link ang bawat entry papunta sa sariling tala ng vendor.
Inanunsyo ng Anthropic ang paghinto sa claude-sonnet-4-5-20250929. Nakaiskedyul ang paghinto nito sa Claude API sa 2026-11-30, at inirerekomenda bilang kapalit ang Sonnet 5.5.
Inilabas ng OpenAI ang gpt-6.1-sol para sa coding at propesyonal na gawain, sa halagang $2 input / $0.10 cached / $10 output (<=272K prompts), kasama ang multi-agent na delegasyon ng gawain sa mga subagent sa beta sa Responses API.
Sa DevDay 2026, inanunsyo ng OpenAI ang mga persistent agent ng Dots, GPT-6.1 Sol, ang Ultrafast speed tier, limitadong preview ng Decisions API, Amazon Bedrock Managed Agents na pinapagana ng OpenAI, at suporta ng ChatGPT para sa draft na MCP Events spec.
Maaari nang kumumpleto ng mga gawain sa browser na hosted ng OpenAI ang mga agent na binuo gamit ang Agents API, habang ang application ng developer ang namamahala sa mga pahintulot para ma-access ang website at sa pag-sign in.
Matatawag ang gpt-6-astra gamit ang service_tier "ultrafast" sa Responses API sa halagang $60 para sa input / $300 para sa output kada 1M token (maikling context), at sa global at US lang pinoproseso ang data ayon sa data-residency.
Inilunsad ang claude-sonnet-5-5 sa halagang $2/$10 kada MTok, na may 1M context at 128K output. Mayroon itong limang breaking change kumpara sa Sonnet 5, kabilang ang sapilitang tool_choice na nagbabalik ng 400 at hindi na pagtanggap sa computer_20251124 sa Claude API.
Muling sinisingil ang mga pagtangging dumarating bago ang anumang output kapag bio, frontier_llm o reasoning_extraction ang stop_details.category; nananatiling libre ang mga maagang pagtanggi sa ibang category.
Idinagdag sa OpenClaw 2026.9.6 ang recovery para sa managed updates, pag-uulat ng paggamit sa loob ng 30 araw, Files/Memory/Skills para sa remote workspace, at suporta sa chat model para sa Claude Opus 5.5, GPT-6 Sol/Luna at Grok 4.7.
Inilabas ng OpenAI ang mga reasoning model na gpt-6-sol ($2/$0.20/$10) at gpt-6-luna ($0.10/$0.01/$0.50) para sa Responses at Chat Completions API.
Inilunsad ang claude-opus-5-5 sa halagang $4/$20 kada MTok (mas mura kaysa Opus 5), na may 1M context, 128K output at laging naka-enable na adaptive thinking. Hindi maaaring i-disable ang thinking, at kailangan ang computer_toolset_20260801 para magamit ang computer.
Gamit ang beta header na inline-tools-2026-09-15, maaaring magdagdag o magbago ng mga tool (kabilang ang MCP toolset sa pamamagitan ng mcp-client-2026-09-15) sa system message sa gitna ng pag-uusap nang hindi nawawalan ng bisa ang prompt cache.
Inilunsad ang grok-4.7 na may 500K context window sa halagang $2 para sa input / $0.50 para sa naka-cache / $6 para sa output (doble ang presyo para sa mga prompt na >=200K), function calling at structured output; hindi ito compatible sa Batch API.
Nilimitahan ng Google ang access sa mga Gemini 2.5 model para lang sa mga user na nakagamit na sa mga ito (hindi deprecated ang mga model) at pinayuhan ang mga bagong project na gumamit ng Gemini 3.5 Flash-Lite o 3.8 Flash.
Ipinakilala ng OpenClaw 2026.9.5 ang Atomic Updates, mga plugin na nai-install nang hindi nire-restart ang Gateway, mga pag-uusap na maaaring ibahagi, GPT Live sa mga meeting at tawag, at guided setup para sa mga pangkat ng mga espesyalisadong agent.
Inilabas ng Google ang managed agent na antigravity-preview-09-2026, na may mga built-in tool na pinalitan ang pangalan gamit ang PascalCase at mga pag-edit ng file ayon sa saklaw ng mga linya; isasara ang antigravity-preview-05-2026 sa 2026-10-05.
Maaaring i-compact ang isang pag-uusap kapag hiniling sa Messages API (gamit ang beta header na compact-2026-09-04). Nagbabalik ito ng pirmadong compaction block na papalit sa mga naunang mensahe sa mga susunod na request.
Inilunsad ng OpenAI ang Agents API bilang pampublikong beta. Iniaalok nito bilang managed service ang open-source na Codex harness, na may mga persistent session, MCP/tools, subagent at sandbox na hosted ng OpenAI, self-hosted o mula sa partner. Walang dagdag na bayarin bukod sa mga token at tool.
Opisyal nang available ang mga full-duplex voice session ng gpt-live-1 sa halagang $0.05 kada minuto (sinisingil kada segundo). Maaaring italaga sa Responses o sa client ang reasoning ng backend model o agent.
Inilabas ng DeepSeek ang multimodal na V4.1-Flash sa ilalim ng model name na deepseek-flash, itinigil ang V4-Flash, at ibinaba ang mga presyo (peak: $0.30 in / $1.20 out; kalahati ang presyo sa off-peak).
Nagkaroon ang Claude Managed Agents ng patakaran sa pahintulot na auto, kung saan sinusuri ng server ang bawat tawag ng agent o MCP tool at isinasagawa ito, tinatanggihan, o ipinagpapaliban para sa pag-apruba.
Inilabas ng OpenAI ang gpt-6-astra ($10/$1/$50) bilang pinakamalakas nitong model, na may async tool calling, pag-aayos ng kilos sa kalagitnaan ng turn gamit ang WebSockets, at pagbabago ng reasoning effort habang nagpapatuloy ang usapan; kailangan ang Responses API para sa tool calling.
Inilabas ng Google ang gemini-3.8-flash para sa software engineering na may mahabang takdang panahon at mga autonomous agent, sa panimulang presyong $0.75/$3.75 kada 1M tokens hanggang 2026-12-31.
Inilabas ng Meta ang Muse Spark 1.3 na may max reasoning sa Muse Code at Meta Model API sa halagang $1.25/$4.25 kada 1M tokens (contributor tier: $0.10/$0.20).
Inilunsad ang claude-fable-5-1 sa halagang $10/$50 kada MTok; ibinaba sa $0.25 (0.025x) ang presyo ng cache reads, at mayroon itong 1M context at 128K output. Inilunsad din ang Claude Mythos 5.1 para sa mga kalahok sa Project Glasswing; hindi suportado ang forced tool_choice.
Naging generally available ang Mutual TLS at X.509 workload identity federation para sa OpenAI API; maaari itong i-configure sa Platform console.
Itinigil na ang Assistants API. Inanunsyo rin ng OpenAI na ititigil ang whisper-1 at ang mga gpt-4o transcribe model sa 2027-02-26.
Bumaba ang presyo ng GPT-5.6 Sol sa $4 input / $20 output kada 1M tokens (20% mas mura ang input, 33% mas mura ang output). Promosyonal ang presyong ito at magiging available kahit hanggang 2026-11-21.
Lumabas na sa beta ang computer use bilang computer_toolset_20260801 (may batch actions at naka-on bilang default ang zoom). Inilunsad ang browser_toolset_20260801 na client toolset, at inalis ang mga beta header sa Files API at Agent Skills/Skills API.
Inilabas ang openai-agents-python v0.22.0 na may pinatibay na runtime, redaction ng guardrail output, validation ng provider option, at pinalawak na visualization ng handoff graph. Nakalista sa release ang mga breaking change.
Inilabas ng Z.ai ang GLM-5.3 (kapareho ng base model ng GLM-5.2, pero pinahusay sa post-training) sa halagang $1.40/$4.40 kada 1M tokens; hindi na maaaring i-disable ang thinking.
Inilabas ng DeepSeek ang V4-Pro GA na may mas mahuhusay na benchmark para sa agent, native na format ng OpenAI Responses API (inangkop para sa Codex), at low/high/max effort. Inanunsyo rin nito ang peak/off-peak pricing na magkakabisa sa 2026-08-16.
Inilabas ng Google ang gemini-3.7-flash para sa coding at agentic workflow, sa panimulang presyo hanggang 2026-12-31.
Idinagdag sa claude-agent-sdk v0.2.137 ang ConversationResetMessage, mga field para sa pinagmulan ng mensahe, at ang mga opsyong resume_session_at/resume_drops_turn para ligtas na putulin ang mga ipinagpatuloy na session.
Kinansela ng Anthropic ang nakatakdang pagtaas sa 2026-09-01 sa $3/$15 at pinanatili ang presyo ng Claude Sonnet 5 sa $2/$10 bawat MTok.
Nagkaroon ang mga session ng Claude Managed Agents ng mahigpit na limitasyon sa gastos (na nagpa-pause sa session kapag umabot sa budget_reached), modelong advisor na maaaring konsultahin ng agent sa gitna ng turn, inference_geo para sa bawat agent, at awtomatikong pag-load ng skills mula sa mga naka-mount na GitHub repo.
Maaaring iruta ng mga organisasyong Claude Enterprise ang mga prompt na pinamamahalaan nila sa sarili nilang AI security server para makakuha ng allow/deny na pasya bago ang inference; itinigil na rin ang claude-opus-4-1-20250805.
Inilunsad ng Alibaba ang Qwen3.8-Max, isang MoE na may 2.4T parameter at 1M context, sa Model Studio. Nangako rin itong ilalabas ang open weights sa susunod na linggo.
Pinalitan ang pangalan ng Priority processing at ginawa itong Fast mode (2x ang presyo at hanggang 2.5x ang bilis para sa GPT-5.6 Sol). Bumaba naman nang 80% ang presyo ng GPT-5.6 Luna at nang 20% ang GPT-5.6 Terra.
Inalis ng bagong bersyon ng MCP ang initialize handshake at mga protocol session, nagdagdag ng mandatoryong server/discover RPC at ng Multi Round-Trip Request pattern, inilipat ang tasks sa isang extension, at itinakdang deprecated ang Roots, Sampling at Logging.
Inilunsad ang claude-opus-5 sa halagang $5/$25 bawat MTok, na may 1M context at 128K output. Kasabay nito, ipinakilala ang pagbabago ng tools sa gitna ng usapan (beta) at ang default na server-side fallback mode.
Nakatakdang itigil sa petsang ito ang mga lumang pangalan ng modelong deepseek-chat at deepseek-reasoner (inihayag noong 2026-04-24 kasabay ng paglulunsad ng V4).
Ginawang generally available ng Google ang gemini-3.6-flash at gemini-3.5-flash-lite, at itinakdang deprecated ang mga sampling parameter na temperature, top_p at top_k.
Inilunsad ng Moonshot ang Kimi K3 sa Kimi API sa halagang $3/$15 bawat 1M token. Isa itong open-weight MoE na may 2.8T parameter at 1M context; nakatakdang ilabas ang weights pagsapit ng 2026-07-27.
Inilunsad ang claude-sonnet-5 na may 1M context at bagong tokenizer (humigit-kumulang 30% na mas maraming token). Nagbabalik na ngayon ng 400 ang manual extended thinking at mga sampling parameter na hindi default.
Naglabas ang Google ng public preview ng Computer Use tool sa Gemini 3.5 Flash, na may mga browser, mobile at desktop environment, mga nako-configure na safety policy, at pagtukoy sa prompt injection.
Itinigil na ang claude-sonnet-4-20250514 at claude-opus-4-20250514; nagbabalik na ngayon ng mga error ang mga request.
Itinigil na ang gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite at gemini-2.0-flash-lite-001. Puwedeng gamitin bilang kapalit ang gemini-3.5-flash o gemini-3.1-flash-lite.