Claude Sonnet 4.5 지원 종료 예정
Anthropic은 claude-sonnet-4-5-20250929의 지원 종료를 발표했습니다. Claude API에서의 지원 종료일은 2026-11-30이며, 권장 대체 모델은 Sonnet 5.5입니다.
이미 배포한 코드에 영향을 주는 모델 출시 및 지원 종료, API와 SDK 릴리스, MCP 사양 변경, 가격 변경 사항을 확인하세요. 최신 항목부터 표시하며 각 항목은 공급업체의 공식 안내로 연결됩니다.
Anthropic은 claude-sonnet-4-5-20250929의 지원 종료를 발표했습니다. Claude API에서의 지원 종료일은 2026-11-30이며, 권장 대체 모델은 Sonnet 5.5입니다.
OpenAI가 코딩 및 전문 업무용 gpt-6.1-sol을 출시했습니다. 가격은 입력 $2 / 캐시 입력 $0.10 / 출력 $10(<=272K prompts)이며, Responses API에서 멀티 에이전트 하위 에이전트 위임 기능을 베타로 제공합니다.
DevDay 2026에서 OpenAI는 Dots persistent agents, GPT-6.1 Sol, Ultrafast 속도 티어, 제한된 프리뷰로 제공되는 Decisions API, OpenAI 기반 Amazon Bedrock Managed Agents, 그리고 초안 MCP Events 사양에 대한 ChatGPT 지원을 발표했습니다.
Agents API로 구축한 에이전트가 이제 OpenAI 호스팅 브라우저에서 작업을 완료할 수 있습니다. 웹사이트 접근 승인과 로그인은 개발자의 애플리케이션에서 처리합니다.
Responses API에서 gpt-6-astra를 service_tier "ultrafast"로 호출할 수 있습니다. 입력 1M tokens당 $60, 출력 1M tokens당 $300이며(짧은 컨텍스트), 데이터 레지던시는 글로벌 및 미국 처리만 지원합니다.
claude-sonnet-5-5가 MTok당 $2/$10에 출시되었습니다. 컨텍스트는 1M, 출력은 128K이며, Sonnet 5와 비교해 호환성을 깨는 변경 사항이 5가지 있습니다. 여기에는 강제 지정한 tool_choice가 400을 반환하는 동작과 Claude API에서 computer_20251124를 더 이상 허용하지 않는 변경이 포함됩니다.
출력이 시작되기 전에 반환된 거부 응답도 stop_details.category가 bio, frontier_llm 또는 reasoning_extraction이면 다시 요금이 부과됩니다. 그 외 카테고리의 초기 거부 응답은 계속 무료입니다.
OpenClaw 2026.9.6에는 관리형 업데이트 복구, 30일 사용량 보고, 원격 작업 공간의 Files/Memory/Skills, 그리고 Claude Opus 5.5, GPT-6 Sol/Luna, Grok 4.7의 채팅 모델 지원이 추가되었습니다.
OpenAI가 Responses API와 Chat Completions API에서 추론 모델 gpt-6-sol($2/$0.20/$10) 및 gpt-6-luna($0.10/$0.01/$0.50)를 출시했습니다.
claude-opus-5-5가 MTok당 $4/$20에 출시되었습니다(Opus 5보다 저렴). 컨텍스트는 1M, 출력은 128K이며 적응형 thinking이 항상 활성화됩니다. thinking은 비활성화할 수 없고, computer use에는 computer_toolset_20260801이 필요합니다.
inline-tools-2026-09-15 베타 헤더를 사용하면 대화 중간의 system 메시지에서 도구를 추가하거나 변경할 수 있습니다. 여기에는 mcp-client-2026-09-15를 통한 MCP 도구 모음도 포함되며, prompt cache는 무효화되지 않습니다.
grok-4.7은 500K 컨텍스트 윈도우와 함께 출시되었습니다. 입력은 $2, 캐시 입력은 $0.50, 출력은 $6이며(prompt가 >=200K이면 요금 두 배), function calling과 구조화된 출력을 지원합니다. Batch API는 지원하지 않습니다.
Google은 Gemini 2.5 모델 액세스를 이미 사용한 사용자로 제한했습니다(지원 종료는 아님). 새 프로젝트에는 Gemini 3.5 Flash-Lite 또는 3.8 Flash를 사용하도록 안내했습니다.
OpenClaw 2026.9.5에는 Atomic Updates, Gateway를 재시작하지 않고 설치하는 플러그인, 공유 가능한 대화, 회의와 통화에서의 GPT Live, 전문 에이전트 팀을 위한 단계별 설정이 추가되었습니다.
Google은 PascalCase로 이름을 바꾼 기본 제공 도구와 줄 범위 파일 편집을 지원하는 관리형 에이전트 antigravity-preview-09-2026을 출시했습니다. antigravity-preview-05-2026은 2026-10-05에 종료됩니다.
Messages API에서 요청에 따라 대화를 압축할 수 있습니다(compact-2026-09-04 베타 헤더). 이후 요청에서 이전 메시지를 대체하는 서명된 압축 블록이 반환됩니다.
OpenAI가 Agents API 공개 베타를 출시했습니다. 오픈소스 Codex harness를 관리형 서비스로 제공하며, 영구 세션, MCP/도구, 하위 에이전트, OpenAI 호스팅·셀프 호스팅·파트너 sandbox를 지원합니다. tokens와 도구 사용료 외에 추가 요금은 없습니다.
gpt-live-1의 전이중 음성 세션이 분당 $0.05(초 단위 청구)로 정식 출시되었습니다. Responses 또는 클라이언트를 통해 백엔드 모델이나 에이전트에 추론을 위임할 수 있습니다.
DeepSeek가 모델명 deepseek-flash로 멀티모달 V4.1-Flash를 출시하고 V4-Flash를 종료했으며, 가격을 인하했습니다(피크 시간대 입력 $0.30 / 출력 $1.20, 비피크 시간대에는 절반).
Claude Managed Agents에 auto 권한 정책이 추가되었습니다. 서버가 각 에이전트 또는 MCP 도구 호출을 평가해 실행하거나 거부하거나 승인을 위해 일시 중지합니다.
OpenAI가 가장 강력한 모델로 gpt-6-astra($10/$1/$50)를 출시했습니다. 비동기 도구 호출, WebSockets를 통한 턴 중 제어, 대화 도중 reasoning effort 변경 기능이 추가되었습니다. 도구 호출에는 Responses API가 필요합니다.
Google이 장기 소프트웨어 엔지니어링과 자율 에이전트를 겨냥한 gemini-3.8-flash를 출시했습니다. 2026-12-31까지 1M tokens당 $0.75/$3.75의 출시 기념 가격이 적용됩니다.
Meta가 Muse Code와 Meta Model API에서 max reasoning을 지원하는 Muse Spark 1.3을 출시했습니다. 가격은 1M tokens당 $1.25/$4.25이며, contributor 등급은 $0.10/$0.20입니다.
claude-fable-5-1이 MTok당 $10/$50에 출시되었습니다. cache read 가격은 $0.25(0.025x)로 인하되었고, 컨텍스트는 1M, 출력은 128K입니다. Project Glasswing 참가자에게는 Claude Mythos 5.1도 제공됩니다. forced tool_choice는 지원되지 않습니다.
OpenAI API에서 상호 TLS와 X.509 워크로드 ID 페더레이션을 정식으로 사용할 수 있게 되었으며, Platform 콘솔에서 구성할 수 있습니다.
Assistants API가 종료되었습니다. OpenAI는 whisper-1 및 gpt-4o transcribe 모델도 2027-02-26에 종료한다고 발표했습니다.
GPT-5.6 Sol 가격이 1M tokens당 입력 $4 / 출력 $20으로 인하되었습니다(입력 20%, 출력 33% 인하). 프로모션 가격은 최소 2026-11-21까지 적용됩니다.
computer_toolset_20260801로 computer use가 베타를 종료했습니다(일괄 작업 지원, 확대 기능 기본 활성화). browser_toolset_20260801 클라이언트 toolset이 출시되었으며, Files API와 Agent Skills/Skills API의 베타 헤더가 제거되었습니다.
openai-agents-python v0.22.0에는 런타임 강화, guardrail 출력 redaction, provider 옵션 검증, 확장된 handoff 그래프 시각화가 포함됩니다. 주요 변경 사항은 릴리스 노트에 정리되어 있습니다.
Z.ai가 1M tokens당 $1.40/$4.40의 GLM-5.3을 출시했습니다(GLM-5.2와 같은 베이스 모델을 post-training으로 개선). thinking은 더 이상 비활성화할 수 없습니다.
DeepSeek가 에이전트 벤치마크 성능을 높인 V4-Pro 정식 버전을 출시했습니다. OpenAI Responses API 형식을 네이티브로 지원하고(Codex에 맞게 조정), low/high/max effort를 제공하며, 2026-08-16부터 적용되는 피크·비피크 요금을 발표했습니다.
Google이 코딩과 에이전트 워크플로를 위한 gemini-3.7-flash를 출시했습니다. 2026-12-31까지 출시 기념 가격이 적용됩니다.
claude-agent-sdk v0.2.137에 ConversationResetMessage, 메시지 출처 필드, 재개된 세션을 안전하게 자르는 resume_session_at/resume_drops_turn 옵션이 추가됐습니다.
Anthropic이 예정된 2026-09-01 가격 인상을 취소해 Claude Sonnet 5의 가격을 MTok당 $2/$10으로 유지했습니다.
Claude Managed Agents 세션에 최대 지출 한도(budget_reached 발생 시 일시 중지), 에이전트가 턴 도중 참조할 수 있는 어드바이저 모델, 에이전트별 inference_geo, 마운트된 GitHub 저장소에서 스킬을 자동으로 불러오는 기능이 추가됐습니다.
Claude Enterprise 조직은 추론 전에 관리 대상 프롬프트를 자체 AI 보안 서버로 보내 허용/거부 판정을 받을 수 있게 됐으며, claude-opus-4-1-20250805는 서비스가 종료됐습니다.
Alibaba가 Model Studio에서 1M 컨텍스트를 지원하는 2.4T 파라미터 MoE 모델 Qwen3.8-Max를 출시했으며, 다음 주에 오픈 웨이트를 공개하겠다고 밝혔습니다.
Priority processing의 이름이 Fast mode로 바뀌었습니다(GPT-5.6 Sol 기준 가격은 2배, 속도는 최대 2.5배). GPT-5.6 Luna는 80%, GPT-5.6 Terra는 20% 저렴해졌습니다.
새 MCP 개정판은 initialize 핸드셰이크와 프로토콜 세션을 제거하고, 필수 server/discover RPC와 Multi Round-Trip Request 패턴을 추가했습니다. 또한 task를 확장 기능으로 옮기고 Roots, Sampling, Logging을 더 이상 사용하지 않도록 지정했습니다.
claude-opus-5가 1M 컨텍스트와 128K 출력, MTok당 $5/$25의 가격으로 출시됐습니다. 대화 도중 도구 변경(베타)과 기본 서버 측 대체 모드도 추가됐습니다.
기존 모델 이름 deepseek-chat과 deepseek-reasoner는 이날부터 사용이 중단될 예정이었습니다(V4 출시와 함께 2026-04-24에 발표).
Google이 gemini-3.6-flash와 gemini-3.5-flash-lite를 정식 출시하고 temperature, top_p, top_k 샘플링 파라미터를 지원 중단했습니다.
Moonshot이 Kimi API에서 1M 컨텍스트를 지원하는 2.8T 파라미터 오픈 웨이트 MoE 모델 Kimi K3를 토큰 1M개당 $3/$15에 출시했으며, 웨이트는 2026-07-27까지 공개했습니다.
claude-sonnet-5가 1M 컨텍스트와 새로운 토크나이저(토큰 수 약 30% 증가)로 출시됐습니다. 수동 확장 사고 모드와 기본값이 아닌 샘플링 파라미터를 사용하면 이제 400 오류가 반환됩니다.
Google이 Gemini 3.5 Flash에서 Computer Use 도구 공개 프리뷰를 시작했습니다. 브라우저, 모바일, 데스크톱 환경과 구성 가능한 안전 정책, 프롬프트 인젝션 감지 기능을 제공합니다.
claude-sonnet-4-20250514와 claude-opus-4-20250514가 서비스 종료됐으며, 이제 요청에 오류가 반환됩니다.
gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite, gemini-2.0-flash-lite-001의 서비스가 종료되었습니다. 대체 모델로 gemini-3.5-flash 또는 gemini-3.1-flash-lite를 사용할 수 있습니다.