Claude Sonnet 4.5 ประกาศเลิกให้บริการ
Anthropic ประกาศเลิกให้บริการ claude-sonnet-4-5-20250929 โดยมีกำหนดเลิกให้บริการผ่าน Claude API ใน 2026-11-30 และแนะนำ Sonnet 5.5 เป็นรุ่นทดแทน
การเปิดตัวและเลิกให้บริการโมเดล การออกรุ่น API และ SDK การเปลี่ยนแปลงสเปก MCP และการเปลี่ยนราคาที่ส่งผลต่อโค้ดที่คุณ deploy ไปแล้ว เรียงจากใหม่ไปเก่า พร้อมลิงก์ไปยังบันทึกของผู้ให้บริการแต่ละราย
Anthropic ประกาศเลิกให้บริการ claude-sonnet-4-5-20250929 โดยมีกำหนดเลิกให้บริการผ่าน Claude API ใน 2026-11-30 และแนะนำ Sonnet 5.5 เป็นรุ่นทดแทน
OpenAI เปิดตัว gpt-6.1-sol สำหรับงานเขียนโค้ดและงานระดับมืออาชีพ ในราคา $2 input / $0.10 cached / $10 output (<=272K prompts) พร้อมเปิดให้ทดลองใช้การมอบหมายงานแก่ subagent แบบ multi-agent ใน Responses API
ในงาน DevDay 2026 OpenAI ประกาศเปิดตัว Dots persistent agents, GPT-6.1 Sol, ระดับความเร็ว Ultrafast, Decisions API ใน limited preview, Amazon Bedrock Managed Agents ที่ขับเคลื่อนด้วย OpenAI และการรองรับสเปก MCP Events ฉบับร่างใน ChatGPT
ตอนนี้ agent ที่สร้างด้วย Agents API สามารถทำงานในเบราว์เซอร์ที่โฮสต์โดย OpenAI ได้แล้ว ส่วนแอปพลิเคชันของนักพัฒนาจะจัดการการอนุมัติให้เข้าถึงเว็บไซต์และการลงชื่อเข้าใช้
เรียกใช้ gpt-6-astra ด้วย service_tier "ultrafast" ใน Responses API ได้ในราคา $60 สำหรับ input / $300 สำหรับ output ต่อ 1M tokens (context สั้น) โดยประมวลผลได้เฉพาะในพื้นที่จัดเก็บข้อมูลทั่วโลกและสหรัฐฯ
เปิดตัว claude-sonnet-5-5 ในราคา $2/$10 ต่อ MTok พร้อม context 1M และ output 128K โดยมี breaking changes 5 รายการเมื่อเทียบกับ Sonnet 5 รวมถึงการบังคับใช้ tool_choice ซึ่งจะส่งคืน 400 และไม่รองรับ computer_20251124 บน Claude API อีกต่อไป
ระบบจะคิดค่าบริการอีกครั้งสำหรับการปฏิเสธที่เกิดขึ้นก่อนมี output เมื่อ stop_details.category เป็น bio, frontier_llm หรือ reasoning_extraction ส่วนการปฏิเสธก่อนตอบในหมวดอื่นยังคงไม่มีค่าใช้จ่าย
OpenClaw 2026.9.6 เพิ่มการกู้คืนการอัปเดตที่จัดการโดยระบบ รายงานการใช้งานย้อนหลัง 30 วัน Files/Memory/Skills สำหรับ remote workspace และรองรับ Claude Opus 5.5, GPT-6 Sol/Luna และ Grok 4.7 เป็น chat model
OpenAI เปิดตัวโมเดล reasoning gpt-6-sol ($2/$0.20/$10) และ gpt-6-luna ($0.10/$0.01/$0.50) บน Responses API และ Chat Completions API
เปิดตัว claude-opus-5-5 ในราคา $4/$20 ต่อ MTok (ถูกกว่า Opus 5) พร้อม context 1M, output 128K และ adaptive thinking ที่เปิดใช้งานตลอด โดยปิด thinking ไม่ได้ และการใช้คอมพิวเตอร์ต้องใช้ computer_toolset_20260801
เมื่อใช้ beta header inline-tools-2026-09-15 จะเพิ่มหรือเปลี่ยน tools (รวมถึง MCP toolsets ผ่าน mcp-client-2026-09-15) ใน system message ระหว่างการสนทนาได้โดยไม่ทำให้ prompt cache ใช้ไม่ได้
เปิดตัว grok-4.7 พร้อม context window 500K ในราคา $2 สำหรับ input / $0.50 สำหรับ cached / $6 สำหรับ output (ราคาเพิ่มเป็นสองเท่าสำหรับ prompts >=200K) รองรับ function calling และ structured outputs แต่ไม่รองรับ Batch API
Google จำกัดการเข้าถึงโมเดล Gemini 2.5 เฉพาะผู้ใช้ที่เคยใช้งานโมเดลเหล่านี้แล้ว (ไม่ได้เลิกใช้งาน) และแนะนำให้โปรเจกต์ใหม่ใช้ Gemini 3.5 Flash-Lite หรือ 3.8 Flash
OpenClaw 2026.9.5 เพิ่ม Atomic Updates, plugins ที่ติดตั้งได้โดยไม่ต้องรีสตาร์ต Gateway, การสนทนาที่แชร์ได้, GPT Live สำหรับการประชุมและการโทร และการตั้งค่าแบบมีคำแนะนำสำหรับทีม agent เฉพาะทาง
Google เปิดตัว managed agent antigravity-preview-09-2026 พร้อมเปลี่ยนชื่อเครื่องมือในตัวเป็น PascalCase และรองรับการแก้ไขไฟล์ตามช่วงบรรทัด ส่วน antigravity-preview-05-2026 จะปิดให้บริการในวันที่ 2026-10-05
Messages API ย่อการสนทนาได้ตามคำขอ (beta header compact-2026-09-04) และส่งคืน compaction block ที่ลงลายเซ็นแล้วเพื่อใช้แทนข้อความก่อนหน้าในคำขอถัดไป
OpenAI เปิดตัว Agents API ในรุ่นเบต้าสาธารณะ โดยให้ใช้ Codex harness แบบโอเพนซอร์สเป็นบริการที่จัดการให้ พร้อม sessions ที่คงอยู่, MCP/tools, subagents และ sandbox ที่โฮสต์โดย OpenAI, โฮสต์เอง หรือให้พาร์ตเนอร์โฮสต์ โดยไม่มีค่าธรรมเนียมนอกเหนือจาก tokens และ tools
เซสชันเสียง full-duplex ของ gpt-live-1 พร้อมใช้งานทั่วไปในราคา $0.05 ต่อนาที (คิดค่าบริการเป็นรายวินาที) โดยมอบหมายการ reasoning ให้ backend model หรือ agent ผ่าน Responses หรือ client ได้
DeepSeek เปิดตัว V4.1-Flash แบบ multimodal ในชื่อโมเดล deepseek-flash ยุติการให้บริการ V4-Flash และลดราคา (ช่วงพีค $0.30 ขาเข้า / $1.20 ขาออก ช่วงนอกพีคราคาครึ่งหนึ่ง)
Claude Managed Agents เพิ่มนโยบายสิทธิ์ auto โดยเซิร์ฟเวอร์จะประเมินการเรียกใช้ agent หรือเครื่องมือ MCP แต่ละครั้ง แล้วเรียกใช้ ปฏิเสธ หรือหยุดรอการอนุมัติ
OpenAI เปิดตัว gpt-6-astra ($10/$1/$50) ซึ่งเป็นโมเดลที่มีความสามารถสูงสุด โดยเพิ่มการเรียกใช้เครื่องมือแบบ async การปรับทิศทางระหว่างเทิร์นผ่าน WebSockets และการเปลี่ยนระดับ reasoning effort ระหว่างสนทนา การเรียกใช้เครื่องมือต้องใช้ Responses API
Google เปิดตัว gemini-3.8-flash สำหรับงานวิศวกรรมซอฟต์แวร์ที่ใช้เวลานานและ agent อัตโนมัติ ในราคาโปรโมชันช่วงเปิดตัว $0.75/$3.75 ต่อ 1M tokens จนถึง 2026-12-31
Meta เปิดตัว Muse Spark 1.3 พร้อม max reasoning บน Muse Code และ Meta Model API ในราคา $1.25/$4.25 ต่อ 1M tokens (ระดับ contributor ราคา $0.10/$0.20)
เปิดตัว claude-fable-5-1 ในราคา $10/$50 ต่อ MTok โดยลดราคาอ่าน cache เหลือ $0.25 (0.025x) รองรับ context 1M และ output 128K พร้อมกับ Claude Mythos 5.1 สำหรับผู้เข้าร่วม Project Glasswing ทั้งนี้ไม่รองรับ forced tool_choice
การเชื่อมโยงข้อมูลประจำตัวของ workload ด้วย Mutual TLS และ X.509 เปิดให้ใช้งานทั่วไปสำหรับ OpenAI API และกำหนดค่าได้ในคอนโซล Platform
ปิด Assistants API แล้ว โดย OpenAI ยังประกาศว่าจะปิด whisper-1 และโมเดล gpt-4o transcribe ในวันที่ 2027-02-26
GPT-5.6 Sol ลดราคาเหลือ $4 สำหรับ input / $20 สำหรับ output ต่อ 1M tokens (input ถูกลง 20% และ output ถูกลง 33%) โดยเป็นราคาโปรโมชันที่มีให้ใช้อย่างน้อยจนถึง 2026-11-21
Computer use ออกจากช่วง beta ในชื่อ computer_toolset_20260801 (รองรับ batch actions และเปิด zoom ไว้โดยค่าเริ่มต้น) พร้อมเปิดตัว toolset ฝั่ง client browser_toolset_20260801 และถอด beta header ออกจาก Files API กับ Agent Skills/Skills API
openai-agents-python v0.22.0 เพิ่มความแข็งแกร่งของ runtime การปกปิดข้อมูล guardrail output การตรวจสอบตัวเลือก provider และการแสดงภาพ handoff graph ที่ครอบคลุมยิ่งขึ้น โดยระบุ breaking changes ไว้ใน release
Z.ai เปิดตัว GLM-5.3 (ใช้ base เดียวกับ GLM-5.2 และปรับปรุงด้วย post-training) ในราคา $1.40/$4.40 ต่อ 1M tokens โดยไม่สามารถปิด thinking ได้อีกต่อไป
DeepSeek เปิดตัว V4-Pro เวอร์ชัน GA พร้อมผล benchmark ด้าน agent ที่ดีขึ้น รองรับรูปแบบ OpenAI Responses API โดยตรง (ปรับให้ใช้กับ Codex ได้) และระดับ effort low/high/max พร้อมประกาศราคาแยกช่วงพีค/นอกพีค ซึ่งมีผลตั้งแต่ 2026-08-16
Google เปิดตัว gemini-3.7-flash สำหรับงานเขียนโค้ดและ workflow แบบ agent ในราคาโปรโมชันช่วงเปิดตัวจนถึง 2026-12-31
claude-agent-sdk v0.2.137 เพิ่ม ConversationResetMessage, ฟิลด์ระบุที่มาของข้อความ และตัวเลือก resume_session_at/resume_drops_turn สำหรับตัดเซสชันที่กลับมาทำงานต่ออย่างปลอดภัย
Anthropic ยกเลิกแผนขึ้นราคาในวันที่ 2026-09-01 จาก $3/$15 โดยคงราคา Claude Sonnet 5 ไว้ที่ $2/$10 ต่อ MTok
เซสชัน Claude Managed Agents เพิ่มงบใช้จ่ายสูงสุด (หยุดชั่วคราวเมื่อถึง budget_reached), โมเดล advisor ที่ agent ปรึกษาได้ระหว่าง turn, inference_geo แยกตาม agent และการโหลด skills อัตโนมัติจาก GitHub repos ที่ mount ไว้
องค์กร Claude Enterprise สามารถส่ง prompt ที่อยู่ภายใต้การกำกับดูแลไปยังเซิร์ฟเวอร์ความปลอดภัย AI ของตนเอง เพื่อรับผลอนุญาต/ปฏิเสธก่อน inference ได้ และเลิกให้บริการ claude-opus-4-1-20250805 แล้ว
Alibaba เปิดตัว Qwen3.8-Max ซึ่งเป็น MoE ขนาด 2.4T พารามิเตอร์และมี context 1M บน Model Studio พร้อมประกาศว่าจะเปิด weights ในสัปดาห์ถัดไป
เปลี่ยนชื่อ Priority processing เป็น Fast mode (ราคา 2x และเร็วขึ้นสูงสุด 2.5x สำหรับ GPT-5.6 Sol) พร้อมลดราคา GPT-5.6 Luna ลง 80% และ GPT-5.6 Terra ลง 20%
MCP revision ใหม่ตัดขั้นตอน initialize handshake และ protocol sessions ออก เพิ่ม RPC server/discover ที่ต้องมีและรูปแบบคำขอ Multi Round-Trip ย้าย tasks ไปเป็น extension และเลิกใช้ Roots, Sampling และ Logging
เปิดตัว claude-opus-5 ในราคา $5/$25 ต่อ MTok พร้อม context 1M และ output 128K รวมถึงการเปลี่ยน tools ระหว่างสนทนา (เบต้า) และโหมด fallback ฝั่งเซิร์ฟเวอร์ที่เปิดใช้เป็นค่าเริ่มต้น
กำหนดยกเลิกชื่อโมเดลรุ่นเดิม deepseek-chat และ deepseek-reasoner ในวันนี้ (ประกาศเมื่อ 2026-04-24 พร้อมการเปิดตัว V4)
Google เปิดให้ใช้งาน gemini-3.6-flash และ gemini-3.5-flash-lite ทั่วไป และเลิกใช้พารามิเตอร์ sampling temperature, top_p และ top_k
Moonshot เปิดตัว Kimi K3 ซึ่งเป็น MoE แบบ open-weight ขนาด 2.8T พารามิเตอร์และมี context 1M บน Kimi API ในราคา $3/$15 ต่อ 1M tokens โดยจะเผยแพร่ weights ภายใน 2026-07-27
เปิดตัว claude-sonnet-5 พร้อม context 1M และ tokenizer ใหม่ (มี tokens เพิ่มขึ้นประมาณ 30%); การเปิดใช้ extended thinking ด้วยตนเองและพารามิเตอร์ sampling ที่ไม่ใช่ค่าเริ่มต้นจะส่งกลับข้อผิดพลาด 400
Google เปิดพรีวิวสาธารณะของเครื่องมือ Computer Use ใน Gemini 3.5 Flash โดยรองรับสภาพแวดล้อม browser, mobile และ desktop, นโยบายความปลอดภัยที่กำหนดค่าได้ และการตรวจจับ prompt injection
เลิกให้บริการ claude-sonnet-4-20250514 และ claude-opus-4-20250514 แล้ว คำขอจะส่งกลับข้อผิดพลาด
ยุติการให้บริการ gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite และ gemini-2.0-flash-lite-001 โดยมี gemini-3.5-flash หรือ gemini-3.1-flash-lite เป็นโมเดลทดแทน