Claude Opus 4.8
เรือธงใหม่ล่าสุดของ Anthropic เปิดตัวเมื่อวันที่ 28 พฤษภาคม 2026 พร้อมการเขียนโค้ดแบบเอเจนต์ที่แข็งแกร่งขึ้น, เวิร์กโฟลว์แบบไดนามิกที่กระจายตัวแทนย่อยหลายร้อยตัวแบบขนาน และโหมดเร็วที่ถูกลง 3 เท่าในราคาปกติเท่ากับ Opus 4.7
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 4.8 คือรุ่นเรือธงของ Anthropic ที่เปิดตัวเมื่อวันที่ 28 พฤษภาคม 2026 ซึ่งเป็นการอัปเกรดโดยตรงจาก Opus 4.7 ในราคาตามรายการของผู้ขายที่ $5/$25 เท่าเดิม มันทำคะแนนสูงสุดใน SWE-bench Pro (69.2%), OSWorld-Verified (83.4%), MCP-Atlas (82.2%) และ Humanity's Last Exam (57.9% พร้อมเครื่องมือ) ที่ Anthropic เคยจัดส่งมา และเป็นโมเดลแรกที่ทำลาย 10% ในมาตรฐานการผ่านทั้งหมดของตัวแทนทางกฎหมาย
การเปลี่ยนแปลงโครงสร้างสองอย่างที่ควรทราบคือเวิร์กโฟลว์แบบไดนามิก (วางแผนงาน กระจายงานไปยังตัวแทนย่อยหลายร้อยตัวพร้อมกันในเซสชันเดียว) และการลดราคาโหมดเร็วเหลือ 2.5 เท่าของความเร็วที่ $10/$50 ต่อ 1 ล้านโทเค็น — ถูกกว่าโหมดเร็วในโมเดล Claude ก่อนหน้าถึงสามเท่า ระดับความพยายามขยายเป็นสูง (ค่าเริ่มต้น), พิเศษ และสูงสุด Anthropic เองก็กล่าวถึงการเปิดตัวนี้ว่าเป็น "การปรับปรุงเล็กน้อยแต่จับต้องได้" มากกว่าที่จะเป็นการก้าวกระโดด
Claude Opus 4.8 คืออะไร?
28 พฤษภาคม 2026
การเปลี่ยนแปลงโครงสร้างสองประการมีความสำคัญสำหรับผู้ใช้ Okou ประการแรก เวิร์กโฟลว์แบบไดนามิก: โมเดลสามารถวางแผนงานและกระจายงานไปยังตัวแทนย่อยหลายร้อยตัวที่ทำงานพร้อมกันในเซสชันเดียว ซึ่ง Anthropic อธิบายว่าเป็นก้าวหนึ่งไปสู่การจัดการการย้ายข้อมูลขนาดโค้ดเบสในหลายแสนบรรทัดโค้ดในการรันครั้งเดียว ประการที่สอง โหมดเร็วที่ความเร็ว 2.5 เท่า ตอนนี้ราคา $10 / $50 ต่อ 1M โทเค็น — ถูกกว่าโหมดเร็วในโมเดล Claude ก่อนหน้าถึงสามเท่า ระดับความพยายามขยายเป็นสามระดับ: สูง (ค่าเริ่มต้น), พิเศษ (xhigh ใน Claude Code) และสูงสุด
การอ่านอิสระ (LLM Stats, VentureBeat, Vellum) ยืนยันลำดับสัมพัทธ์เทียบกับ 4.7 และคู่แข่ง: 4.8 ชนะในทุกเซลล์ของชุดการเปรียบเทียบที่เผยแพร่ของ Anthropic ยกเว้น Terminal-Bench 2.1 ซึ่ง GPT-5.5 ยังคงนำอยู่ (78.2% เทียบกับ 74.6% ของ 4.8) การกระโดดจาก 4.7 เป็น 4.8 บน SWE-bench Pro คือ +4.9 คะแนน; บน USAMO 2026 คือ +27.4; บน GraphWalks long-context F1 1M-token ใหม่คือ +27.8 ถือว่าคะแนนสัมบูรณ์เป็นทิศทาง — SWE-bench Verified กำลังเข้าใกล้ความอิ่มตัวในทุกโมเดลแนวหน้า
อะไรที่น่าสนใจเกี่ยวกับ Claude Opus 4.8
สถาปัตยกรรมหัวข้อข่าวและคุณสมบัติความสามารถ
Opus 4.8 ยังคงหน้าต่างบริบท 1M โทเค็นและเอาต์พุตสูงสุด 128K จาก Opus 4.7 โดยคิดค่าบริการตามราคาอินพุตมาตรฐานตลอดทั้งหน้าต่าง การควบคุมความพยายามขยายเป็นสามระดับ: สูง (ค่าเริ่มต้นใหม่), พิเศษ (xhigh ภายใน Claude Code) และสูงสุด Messages API ตอนนี้ยอมรับรายการระบบกลางการสนทนาโดยไม่ทำลายการแคชพรอมต์ เวิร์กโฟลว์แบบไดนามิกช่วยให้ Claude วางแผนและจัดส่งซับเอเจนต์แบบขนานหลายร้อยตัวในเซสชันเดียว โหมดเร็วทำงานที่ความเร็วประมาณ 2.5 เท่าของมาตรฐานในราคา 10 ดอลลาร์ / 50 ดอลลาร์ต่อ 1M โทเค็น อินพุตหลายรูปแบบทั้งข้อความ, วิสัยทัศน์ และโค้ดไม่เปลี่ยนแปลง
ข้อมูลจำเพาะโดยย่อ
เกณฑ์มาตรฐาน Claude Opus 4.8
คะแนนที่ผู้ขายรายงานจากบัตรระบบ Opus 4.8 ของ Anthropic พร้อมการเปรียบเทียบกับ Opus 4.7, GPT-5.5 และ Gemini 3.1 Pro ที่ความพยายามสูงสุดและค่าเฉลี่ย 5 ครั้ง 4.8 นำในหกจากเจ็ดเซลล์ที่ Anthropic เผยแพร่ GPT-5.5 ยังคงนำใน Terminal-Bench 2.1 SWE-bench Verified กำลังเข้าสู่จุดอิ่มตัวในทุกโมเดลแนวหน้า — ชุด SWE-bench Pro ที่ยากกว่าเป็นสัญญาณที่ทนทานกว่า
ราคา Claude Opus 4.8
ราคาผู้ให้บริการต่อ 1M โทเค็น
Claude Opus 4.8 ทำงานอย่างไรในทางปฏิบัติ
พฤติกรรมที่สังเกตได้จากการทำงานของเอเจนต์การผลิต
เวิร์กโฟลว์แบบไดนามิก
ความสามารถใหม่ที่โดดเด่น Opus 4.8 สามารถวางแผนงานและรันตัวแทนย่อยแบบขนานได้หลายร้อยตัวภายในเซสชันเดียวกัน — Anthropic วางตำแหน่งสิ่งนี้เป็นเส้นทางสู่การย้ายโค้ดเบสขนาดใหญ่ข้ามหลายแสนบรรทัดในการรันครั้งเดียว บน Okou นี่หมายถึงการรันตัวแทนเพียงครั้งเดียวสามารถจัดการงานแบบกระจายที่ก่อนหน้านี้ต้องมีการจัดตารางเวลาภายนอก
การแก้ไขโค้ดครั้งแรก
Anthropic รายงานว่า Opus 4.8 มีโอกาสน้อยกว่า 4.7 ประมาณสี่เท่าที่จะมองข้ามข้อบกพร่องเมื่อตรวจสอบโค้ด และการกระโดด +4.9 จุดใน SWE-bench Pro (69.2% เทียบกับ 64.3%) สนับสนุนสิ่งนี้ในชุดการเขียนโค้ดที่ยากขึ้นและอิ่มตัวน้อยลง เลือก 4.8 สำหรับแพตช์ที่ต้องนำไปใช้อย่างสะอาดในหลายไฟล์
การเรียกคืนบริบทแบบยาว
GraphWalks F1 ที่ 1M โทเค็นกระโดดจาก 40.3% เป็น 68.1% — เป็นการเพิ่มขึ้นของเกณฑ์มาตรฐานเดียวที่ใหญ่ที่สุดในการเผยแพร่ หน้าต่าง 1M โทเค็นตอนนี้สามารถใช้งานได้จริงที่ปลายด้านบนของช่วง ไม่ใช่แค่ตามชื่อ
ความซื่อสัตย์และความมั่นใจเกินไป
Anthropic รายงานการลดความมั่นใจเกินจริงมากกว่าสิบเท่าเมื่อเทียบกับ 4.7, 0% ในการรายงานผลลัพธ์ที่บกพร่องโดยไม่วิพากษ์วิจารณ์ (เป็นครั้งแรกสำหรับตระกูล Claude) และอัตรา 3.7% ในการไม่แจ้งเหตุการณ์สำคัญให้ผู้ใช้ทราบ อุบัติการณ์ความไม่สอดคล้องกันอยู่ที่ประมาณ 1.9 ซึ่งเทียบเท่ากับ Mythos Preview ที่จัดเรียงได้ดีที่สุดของ Anthropic
ความเร็วและโหมดเร็ว
ความเร็วมาตรฐานเทียบเท่ากับ Opus 4.7 การเปลี่ยนแปลงราคาเป็นหัวข้อข่าว: โหมดเร็วที่ความเร็ว 2.5 เท่ามีค่าใช้จ่าย 10 ดอลลาร์ / 50 ดอลลาร์ต่อ 1 ล้านโทเค็น ซึ่งถูกกว่าโหมดเร็วในโมเดล Claude ก่อนหน้าถึงสามเท่า คุ้มค่าที่จะใช้สำหรับขั้นตอนการประสานงานที่ความหน่วงของนาฬิกาจริงมีความสำคัญ
คำเตือนการแทรกพรอมต์
บัตรระบบของ Anthropic ระบุว่า 4.8 มีความทนทานต่อการฉีดพรอมต์ของเอเจนต์น้อยกว่า 4.7 เล็กน้อย — การทดสอบ Gray Swan แสดงอัตราความสำเร็จของการโจมตีประมาณ 9.6% เทียบกับ 6.0% ใน 4.7 ทีมที่ใช้ 4.8 ในไปป์ไลน์ที่จัดการอินพุตที่ไม่น่าเชื่อถือควรทบทวนแนวทางการแซนด์บ็อกซ์ของตน
งานตัวแทนที่ดีที่สุดสำหรับ Claude Opus 4.8
การย้ายข้อมูลขนาด codebase ที่เคยต้องใช้ sprint
มอบหมาย Opus 4.8 ให้กับการย้ายข้อมูลที่เกี่ยวข้องกับไฟล์หลายร้อยไฟล์ — การสลับ ORM, การอัปเดตเวอร์ชันเฟรมเวิร์ก, การแก้ไขความปลอดภัยทั่วทั้ง monorepo — และให้เวิร์กโฟลว์แบบไดนามิกกระจายงานไปยังตัวแทนย่อยแบบขนานภายในเซสชันเดียว การกระโดดของ SWE-bench Pro +4.9 จุด และการลดข้อผิดพลาดที่พลาดในการตรวจสอบโค้ดลงสี่เท่าคือสิ่งที่ได้รับจากการรันประเภทนี้
การรันการวิจัย 1M โทเค็นที่ยังคงทำงานร่วมกันได้จริง
วางร่างสัญญา 200 หน้า, ข้อเสนอคู่แข่งสามฉบับ, และความเห็นทางกฎหมายของไตรมาสที่แล้วลงในหน้าต่าง จากนั้นขอให้ Opus 4.8 ทำเครื่องหมายทุกข้อที่เข้มงวดกว่าตลาด GraphWalks ที่ 1M กระโดดจาก 40.3% เป็น 68.1% คือสิ่งที่ทำให้การสังเคราะห์ข้ามเอกสารประเภทนี้มีความน่าเชื่อถือใหม่
ผู้ประสานงานเอเจนต์ที่ไม่โกหกเกี่ยวกับงานของตน
ใช้ 4.8 เป็นผู้วางแผนที่แบ่งคำขอออกเป็นสิบขั้นตอน ส่งแต่ละขั้นตอนไปยังตัวแทนย่อยที่ถูกกว่า และรายงานผลลัพธ์ อัตรา 0% ในการรายงานผลลัพธ์ที่บกพร่องโดยไม่วิพากษ์วิจารณ์ ควบคู่ไปกับการลดความมั่นใจเกินเหตุลงสิบเท่า เป็นเหตุผลที่ทีมผลิตเลือกใช้ 4.8 เมื่อรายงานตนเองของตัวแทนต้องน่าเชื่อถือ
โฟลว์ที่ไวต่อความหน่วงที่ในที่สุดก็ทำงานได้ดีในโหมดเร็ว
โหมดเร็วที่ความเร็ว 2.5 เท่าเคยมีราคาแพงกว่าตอนนี้สามเท่า ($10/$50 ต่อ 1M เทียบกับระดับก่อนหน้า) สำหรับโคไพลอตแบบโต้ตอบ, สรุปข้อมูลตามคำขอ, หรือขั้นตอนใดๆ ที่เวลาแฝงของนาฬิกาจริงมีผลต่อประสบการณ์, โหมดเร็ว 4.8 เป็นตัวเลือกเริ่มต้นในตระกูล Claude แล้ว
เมื่อใดที่ควรข้าม Claude Opus 4.8
ข้าม Opus 4.8 สำหรับงานประจำที่มีปริมาณมาก ซึ่ง Sonnet 4.6 ให้คุณภาพเท่ากันในราคาที่ถูกกว่ามาก สำหรับการตอบกลับแชทที่สำคัญต่อความหน่วง ซึ่ง Kimi K2.7 Code เร็วกว่ามาก สำหรับการเขียนโค้ดเทอร์มินัลแบบ agentic ซึ่ง GPT-5.5 ยังคงนำ Terminal-Bench 2.1 (78.2% เทียบกับ 74.6% ของ 4.8) และสำหรับไปป์ไลน์ที่รับอินพุตที่ไม่น่าเชื่อถือโดยไม่มีแซนด์บ็อกซ์ — ความทนทานต่อการฉีดพรอมต์ของ 4.8 อ่อนแอกว่า 4.7 เล็กน้อย
Claude Opus 4.8 เทียบกับโมเดลอื่นๆ
Claude Opus 4.8 เทียบกับ GPT-5.5
Opus 4.8 เป็นผู้นำในหกจากเจ็ดเซลล์ในชุดเปรียบเทียบของ Anthropic โดยมีช่องว่างที่ใหญ่ที่สุดใน SWE-bench Pro (69.2% เทียบกับ 58.6%) และ OSWorld-Verified (83.4% เทียบกับ 78.7%) GPT-5.5 ยังคงเป็นผู้นำใน Terminal-Bench 2.1 (78.2% เทียบกับ 74.6%) เลือก 4.8 สำหรับการเขียนโค้ดข้ามไฟล์และตัวแทนที่ใช้คอมพิวเตอร์ เลือก GPT-5.5 โดยเฉพาะเมื่อการทำงานที่ขับเคลื่อนด้วยเทอร์มินัลเป็นหลัก
Claude Opus 4.8 เทียบกับ Gemini 3.1 Pro
Opus 4.8 นำหน้าอย่างกว้างขวางบน SWE-bench Pro (+15.0) และ OSWorld-Verified (+7.2) โมเดลทั้งสองยังคงอยู่ในระดับเสียงรบกวนบนเกณฑ์มาตรฐานทางวิทยาศาสตร์ที่อิ่มตัว เช่น GPQA Diamond ใช้ 4.8 เป็นค่าเริ่มต้นสำหรับงานของเอเจนต์ พิจารณา Gemini โดยเฉพาะเมื่อคุณต้องการการรวมเครื่องมือของ Google
สรุป: คุณควรใช้ Claude Opus 4.8 หรือไม่
ค่าเริ่มต้นใหม่สำหรับเอเจนต์ใหม่ในตระกูล Claude ย้ายจาก 4.7 เมื่อคุณสามารถตรวจสอบซ้ำได้; ใช้เป็นค่าเริ่มต้นโดยตรงสำหรับงานใหม่ เก็บ Sonnet 4.6 ไว้เป็นเครื่องมือทำงานที่ถูกกว่าภายใต้
คำถามที่พบบ่อย
Claude Opus 4.8 เปิดตัวเมื่อใด
Anthropic เปิดตัว Opus 4.8 เมื่อวันที่ 28 พฤษภาคม 2026, 41 วันหลังจาก Opus 4.7 มีให้บริการแล้ววันนี้ในผลิตภัณฑ์ Claude, Claude API (รหัสโมเดล claude-opus-4-8), Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry และ Okou
ราคา Opus 4.8 เปรียบเทียบกับ 4.7 อย่างไร
ราคาปกติเหมือนกัน: $5 ต่อ 1M โทเค็นอินพุต, $25 ต่อ 1M โทเค็นเอาต์พุต, $0.50 ต่อ 1M อินพุตที่แคช การเปลี่ยนแปลงคือโหมดเร็ว ตอนนี้ $10 / $50 ต่อ 1M โทเค็นที่ความเร็ว 2.5 เท่า — ถูกกว่าโหมดเร็วในโมเดล Claude ก่อนหน้าถึงสามเท่า
เวิร์กโฟลว์แบบไดนามิกคืออะไร
ความสามารถใหม่ที่ช่วยให้ Opus 4.8 วางแผนงานและรันซับเอเจนต์หลายร้อยตัวพร้อมกันภายในเซสชันเดียว Anthropic วางตำแหน่งสิ่งนี้เป็นเส้นทางสู่การย้ายข้อมูลขนาดโค้ดเบสข้ามโค้ดหลายแสนบรรทัดในการรันเอเจนต์ครั้งเดียว
Opus 4.8 รองรับระดับความพยายามใดบ้าง
สามระดับ: สูง (ค่าเริ่มต้นใหม่), พิเศษ (xhigh ใน Claude Code) และสูงสุด การตั้งค่าที่สูงขึ้นจะใช้โทเค็นมากขึ้นในการให้เหตุผลก่อนที่จะสร้างการตอบสนอง การตั้งค่าที่ต่ำกว่าจะเน้นความเร็วและประสิทธิภาพในการจำกัดอัตรา
Opus 4.8 รองรับการแคชพรอมต์หรือไม่?
ใช่ อินพุตที่แคชจะถูกเรียกเก็บเงินที่ $0.50 ต่อ 1M โทเค็น ซึ่งเป็นส่วนลด 10 เท่าสำหรับส่วนที่แคช API ตอนนี้ยังยอมรับรายการระบบกลางการสนทนาโดยไม่ทำให้แคชเสียหาย
ทางเลือก
การใช้ Claude Opus 4.8 บน Okou
สองวิธีในการเข้าถึง Claude Opus 4.8 บน Okou
Okou รองรับ Claude Opus 4.8 เป็นโมเดลในตัวที่เรียกเก็บเงินเป็นเครดิต Okou และผ่านการนำมาใช้เองด้วย Anthropic API key เส้นทางในตัวใช้การกำหนดเส้นทาง Okou Managed และระดับราคาที่อธิบายไว้ด้านล่าง; เส้นทางนำมาใช้เองจะเรียกเก็บเงินคุณโดยตรงกับผู้จำหน่ายต้นน้ำและข้ามการแปลงเครดิต Okou ทั้งหมด
คำแนะนำของ Okou
Okou วางตำแหน่ง Claude Opus 4.8 เป็นโมเดลเอเจนต์หลักสำหรับการจัดระเบียบ งานที่เกี่ยวข้องกับโค้ด และขั้นตอนอื่นๆ ที่คำตอบผิดมีค่าใช้จ่ายสูง
เครดิตและระดับราคา $$$
Okou กำหนดราคาโมเดล Built-in ทุกรุ่นตามระดับเครดิตสี่ระดับ — $, $$, $$$, $$$$ — แสดงเป็นป้ายในตัวเลือกโมเดลและบนบรรทัด price tier ของ zero model ls Claude Opus 4.8 อยู่ที่ $$$ ระดับนั้นคือสิ่งที่คุณใช้จากยอดเครดิต Okou ของคุณ; ราคาขายปลีกของผู้ขายในตารางด้านบนคือสิ่งที่ผู้ให้บริการต้นน้ำเรียกเก็บก่อนที่ Okou จะแปลงเป็นเครดิต
มีให้บริการบน Okou ตั้งแต่ May 28, 2026

