Claude Sonnet 4.5の提供終了を発表
Anthropicはclaude-sonnet-4-5-20250929の提供終了を発表しました。Claude APIでの提供は2026-11-30に終了する予定で、後継モデルとしてSonnet 5.5を推奨しています。
リリース済みのコードに影響するモデルのリリース・提供終了、API・SDKのリリース、MCP仕様の変更、価格変更を掲載します。新しい順に並び、各項目からベンダー公式の発表を確認できます。
Anthropicはclaude-sonnet-4-5-20250929の提供終了を発表しました。Claude APIでの提供は2026-11-30に終了する予定で、後継モデルとしてSonnet 5.5を推奨しています。
OpenAIはコーディングや専門業務向けにgpt-6.1-solをリリースしました。価格は入力$2 / キャッシュ入力$0.10 / 出力$10(<=272K prompts)です。Responses APIでは、複数のエージェントからサブエージェントにタスクを委任する機能をベータ版として提供します。
DevDay 2026でOpenAIは、永続的に動作するエージェントのDots、GPT-6.1 Sol、速度重視のUltrafastティア、限定プレビュー版のDecisions API、OpenAIを基盤とするAmazon Bedrock Managed Agents、ドラフト版MCP Events仕様へのChatGPT対応を発表しました。
Agents APIで構築したエージェントが、OpenAIホストのブラウザーでタスクを実行できるようになりました。Webサイトへのアクセス許可やサインインは、開発者のアプリケーションが処理します。
Responses APIでは、gpt-6-astraをservice_tier "ultrafast"で呼び出せます。料金は入力$60 / 出力$300(100万トークンあたり、短いコンテキストの場合)で、データレジデンシー処理はグローバルと米国のみです。
claude-sonnet-5-5が$2/$10(MTokあたり)でリリースされました。コンテキスト長は1M、出力は128Kです。Sonnet 5からの破壊的変更は5件あり、tool_choiceを強制すると400が返ること、Claude APIでcomputer_20251124が受け付けられなくなったことなどが含まれます。
出力前に返される拒否応答は、stop_details.categoryがbio、frontier_llm、reasoning_extractionの場合、再び課金対象になります。他のカテゴリの早期拒否は引き続き無料です。
OpenClaw 2026.9.6では、管理アップデートからの復旧、30日間の使用状況レポート、リモートワークスペースでのFiles/Memory/Skillsに加え、Claude Opus 5.5、GPT-6 Sol/Luna、Grok 4.7のチャットモデル対応が追加されました。
OpenAIは推論モデルgpt-6-sol($2/$0.20/$10)とgpt-6-luna($0.10/$0.01/$0.50)をResponses APIとChat Completions APIでリリースしました。
claude-opus-5-5が$4/$20(MTokあたり、Opus 5より低価格)でリリースされました。コンテキスト長は1M、出力は128Kで、適応型思考は常時有効です。思考機能は無効化できず、computer useにはcomputer_toolset_20260801が必要です。
inline-tools-2026-09-15ベータヘッダーを使うと、プロンプトキャッシュを無効化せずに、会話途中のシステムメッセージでツール(mcp-client-2026-09-15経由のMCPツールセットを含む)を追加・変更できます。
grok-4.7はコンテキストウィンドウ500Kでリリースされました。料金は入力$2 / キャッシュ済み$0.50 / 出力$6(プロンプトが>=200Kの場合は2倍)です。関数呼び出しと構造化出力に対応しますが、Batch APIには対応していません。
GoogleはGemini 2.5モデルの利用を、すでに使用したことのあるユーザーに制限しました(非推奨化ではありません)。新規プロジェクトにはGemini 3.5 Flash-Liteまたは3.8 Flashの利用を案内しています。
OpenClaw 2026.9.5では、Atomic Updates、Gatewayを再起動せずにインストールできるプラグイン、共有可能な会話、会議や通話でのGPT Live、専門エージェントチーム向けのガイド付きセットアップが導入されました。
Googleは、組み込みツールの名前をPascalCaseに変更し、行範囲を指定したファイル編集に対応するマネージドエージェントantigravity-preview-09-2026をリリースしました。antigravity-preview-05-2026は2026-10-05に停止します。
Messages APIでは、リクエストに応じて会話を圧縮できます(compact-2026-09-04ベータヘッダー)。署名付きの圧縮ブロックが返され、後続のリクエストで以前のメッセージを置き換えます。
OpenAIはAgents APIのパブリックベータを開始しました。オープンソースのCodexハーネスをマネージドサービスとして提供し、永続セッション、MCP/ツール、サブエージェント、OpenAIホスト型・セルフホスト型・パートナー提供のサンドボックスを利用できます。トークンとツール以外の追加料金はありません。
gpt-live-1の全二重音声セッションが一般提供になりました。料金は1分あたり$0.05(秒単位で課金)です。バックエンドのモデルまたはエージェントによる推論は、Responsesまたはクライアント経由で委任できます。
DeepSeekはマルチモーダルモデルV4.1-Flashをdeepseek-flashというモデル名でリリースし、V4-Flashを提供終了しました。価格も引き下げられ、ピーク時は入力$0.30/出力$1.20、オフピーク時はその半額です。
Claude Managed Agentsに「auto」権限ポリシーが追加されました。サーバーがエージェントまたはMCPツールの呼び出しごとに評価し、実行、拒否、または承認待ちにします。
OpenAIは最も高性能なモデルとしてgpt-6-astra($10/$1/$50)をリリースしました。非同期ツール呼び出し、WebSockets経由のターン中の制御、会話中の推論エフォート変更に対応。ツール呼び出しにはResponses APIが必要です。
Googleは、長期的なソフトウェアエンジニアリングと自律型エージェントを対象とするgemini-3.8-flashをリリースしました。2026-12-31まで、導入価格は100万トークンあたり$0.75/$3.75です。
MetaはMuse Spark 1.3をリリースしました。Muse CodeとMeta Model APIで最大推論に対応し、価格は100万トークンあたり$1.25/$4.25(contributor tierは$0.10/$0.20)です。
claude-fable-5-1がMTokあたり$10/$50でリリースされました。キャッシュ読み取りは$0.25(0.025x)に引き下げられ、コンテキスト長は1M、出力上限は128Kです。Project Glasswing参加者向けにはClaude Mythos 5.1も提供されます。強制的なtool_choiceには対応していません。
OpenAI APIで相互TLSとX.509ワークロードIDフェデレーションが一般提供となり、Platformコンソールで設定できるようになりました。
Assistants APIが提供終了しました。OpenAIはあわせて、whisper-1とgpt-4o transcribeモデルを2027-02-26に提供終了すると発表しました。
GPT-5.6 Solの価格が100万トークンあたり入力$4/出力$20に引き下げられました(入力は20%、出力は33%の値下げ)。このプロモーション価格は少なくとも2026-11-21まで適用されます。
Computer useがベータを終了し、computer_toolset_20260801として提供開始しました(バッチ操作に対応し、ズームはデフォルトでオン)。browser_toolset_20260801クライアントtoolsetもリリースされ、Files APIとAgent Skills/Skills APIではベータヘッダーが不要になりました。
openai-agents-python v0.22.0がリリースされました。ランタイムの堅牢性向上、guardrail出力の編集、プロバイダーオプションの検証、ハンドオフグラフの可視化拡張が含まれます。破壊的変更はリリースノートに記載されています。
Z.aiはGLM-5.3を100万トークンあたり$1.40/$4.40でリリースしました。ベースモデルはGLM-5.2と同じで、事後学習により性能が向上しています。thinkingは無効にできなくなりました。
DeepSeekは、エージェントベンチマークの強化、Codex向けに調整したOpenAI Responses API形式のネイティブ対応、low/high/max effortを備えるV4-Proを一般提供しました。また、2026-08-16から適用されるピーク/オフピーク料金を発表しました。
Googleは、コーディングとエージェント型ワークフロー向けのgemini-3.7-flashをリリースしました。導入価格は2026-12-31まで適用されます。
claude-agent-sdk v0.2.137では、ConversationResetMessage、メッセージの発生元フィールド、安全に再開セッションを切り詰めるためのresume_session_at/resume_drops_turnオプションが追加されました。
Anthropicは予定していた2026-09-01の$3/$15への値上げを中止し、Claude Sonnet 5の価格をMTokあたり$2/$10に据え置きました。
Claude Managed Agentsのセッションに、利用額のハード上限(上限到達時はbudget_reachedで一時停止)、ターンの途中でエージェントが相談できるアドバイザーモデル、エージェントごとのinference_geo、マウントしたGitHubリポジトリからスキルを自動読み込みする機能が追加されました。
Claude Enterpriseの組織は、推論の前に管理対象のプロンプトを自社のAIセキュリティサーバーに転送し、許可または拒否の判定を受けられるようになりました。また、claude-opus-4-1-20250805の提供が終了しました。
AlibabaはModel Studioで、1Mコンテキストを備えた2.4TパラメーターのMoE、Qwen3.8-Maxをリリースしました。翌週にはオープンウェイトを公開すると発表しています。
Priority processingがFast modeに名称変更されました(価格は2倍、GPT-5.6 Solでは最大2.5倍高速)。GPT-5.6 Lunaは80%、GPT-5.6 Terraは20%値下げされました。
新しいMCP仕様では、initializeハンドシェイクとプロトコルセッションが廃止され、必須のserver/discover RPCとMulti Round-Trip Requestパターンが追加されました。タスクは拡張機能に移され、Roots、Sampling、Loggingは非推奨になりました。
claude-opus-5が、1Mコンテキストと128K出力に対応し、MTokあたり$5/$25でリリースされました。また、会話中のツール変更(ベータ版)と、デフォルトのサーバー側フォールバックモードも導入されました。
従来のモデル名deepseek-chatとdeepseek-reasonerは、この日付で廃止される予定でした(V4のリリースに合わせて2026-04-24に発表)。
Googleはgemini-3.6-flashとgemini-3.5-flash-liteを正式提供し、temperature、top_p、top_kのsamplingパラメーターを非推奨にしました。
MoonshotはKimi APIで、1Mコンテキストを備えた2.8TパラメーターのオープンウェイトMoE、Kimi K3を、100万トークンあたり$3/$15でリリースしました。ウェイトは2026-07-27までに公開されました。
claude-sonnet-5は1Mコンテキストと新しいトークナイザー(トークン数が約30%増加)を備えてリリースされました。手動の拡張思考と、デフォルト以外のsamplingパラメーターを指定すると、400エラーが返されるようになりました。
GoogleはGemini 3.5 FlashのComputer Useツールをパブリックプレビューとして公開しました。ブラウザー、モバイル、デスクトップ環境に対応し、安全ポリシーの設定とプロンプトインジェクションの検出が可能です。
claude-sonnet-4-20250514とclaude-opus-4-20250514の提供が終了し、リクエストにはエラーが返されるようになりました。
gemini-2.0-flash、gemini-2.0-flash-001、gemini-2.0-flash-lite、gemini-2.0-flash-lite-001 の提供が終了しました。後継モデルには gemini-3.5-flash または gemini-3.1-flash-lite をご利用ください。