ทุกโมเดล

Claude Opus 4.7: โมเดลการให้เหตุผล Anthropic

โมเดล Claude 4 เรือธงของ Anthropic เป็นตัวเลือกที่แข็งแกร่งที่สุดในตระกูลสำหรับลูปเอเจนต์ที่มีขอบเขตยาว การให้เหตุผลที่ยาก และการแก้ไขโค้ดครั้งแรก

1M tokens · Text / Vision / Code · Prompt cache

Okou ไม่ได้รัน Claude Opus 4.7 อีกต่อไป หน้านี้เก็บไว้เป็นข้อมูลอ้างอิงสำหรับข้อมูลจำเพาะ ราคา และเกณฑ์มาตรฐาน สำหรับงานประเภทเดียวกัน ให้ใช้ GPT 5.6 Luna

ดู GPT 5.6 Luna

Claude Opus 4.7 เป็นโมเดลที่คุณเลือกใช้เมื่องานต้องถูกต้องตั้งแต่ครั้งแรก: โค้ดที่คอมไพล์ได้อย่างสะอาด, แผนหลายขั้นตอนที่ไม่หลุดจากเธรดในสายเครื่องมือที่ยาวนาน, ปริศนาเชิงนามธรรมที่โมเดลขนาดเล็กกว่ามักจะสะดุด เกณฑ์มาตรฐานของผู้ขาย (SWE-bench Verified, Terminal-Bench 2.0, ARC AGI 2, OSWorld, BrowseComp) ให้ตัวเลขที่เป็นรูปธรรมเกี่ยวกับประสิทธิภาพที่เพิ่มขึ้นเมื่อเทียบกับ Opus 4.6

ราคาขายปลีกของผู้ขายคือ 5 ดอลลาร์ / 25 ดอลลาร์ต่อ 1M โทเค็น โดยอินพุตที่แคชไว้ที่ 0.50 ดอลลาร์ / 1M ซึ่งเป็นราคาสูงสุดในตระกูล Claude รูปแบบที่คุ้มค่าคือการใช้ Sonnet 4.6 เป็นค่าเริ่มต้นและส่งเฉพาะขั้นตอนที่ยากที่สุดไปยัง Opus

Claude Opus 4.7 คืออะไร?

เมษายน 2026 (สืบทอด Opus 4.6) · ระดับสูงสุดของตระกูล Claude 4. การอัปเกรดที่แนะนำของ Anthropic สำหรับผู้ใช้ Opus 4.6

Claude Opus 4.7 เป็นเรือธงของตระกูล Claude 4 ของ Anthropic ซึ่งเปิดตัวในเดือนเมษายน 2026 ในฐานะการอัปเกรดที่แนะนำจาก Opus 4.6 Anthropic กำหนดให้เป็นการปรับปรุงที่ก้าวกระโดดในการเขียนโค้ดแบบเอเจนต์และการให้เหตุผลเชิงนามธรรม แทนที่จะเป็นการปรับปรุง API ผิวเผิน หน้าต่างบริบท 1M โทเค็นและระดับความพยายามในการคิดแบบปรับตัวที่นำมาใช้ใน 4.6 ยังคงไม่เปลี่ยนแปลง ดังนั้นโค้ดเอเจนต์ที่มีอยู่จึงสามารถใช้งานได้โดยไม่ต้องเขียนใหม่

เมื่อเทียบกับ Sonnet 4.6 (ตัวหลักในตระกูลเดียวกัน) Opus ใช้การประมวลผลต่อโทเค็นมากกว่า ผลลัพธ์ด้านพฤติกรรมปรากฏในสามด้าน: คำสั่งที่ตกหล่นน้อยลงในการวนซ้ำของเอเจนต์ที่ยาวนาน, การแก้ไขโค้ดครั้งแรกที่ดีขึ้นอย่างเห็นได้ชัด, และการเรียกคืนที่แข็งแกร่งขึ้นเมื่อประวัติการสนทนาเกิน 100K โทเค็น ข้อเสียคือราคาที่สูงที่สุดในตระกูล Claude (5 ดอลลาร์ / 25 ดอลลาร์ต่อ 1M โทเค็น) และความเร็วในการส่งออกต่อโทเค็นที่ช้าลง ซึ่งเป็นเหตุผลว่าทำไม Anthropic จึงวางตำแหน่ง Opus เป็นผู้ประสานงานหรือระดับการยกระดับ แทนที่จะเป็นค่าเริ่มต้นทั่วไป

กระดานผู้นำอิสระ (Artificial Analysis, Vellum) ยืนยันลำดับสัมพัทธ์เมื่อเทียบกับ Opus 4.6 แต่ตัวเลขสัมบูรณ์เปลี่ยนแปลงทุกสัปดาห์ และ OpenAI ได้ตั้งข้อสังเกตถึงการปนเปื้อนของข้อมูลการฝึกอบรมบน SWE-bench Verified ในทุกโมเดลแนวหน้า ถือว่าคะแนนสาธารณะเป็นแนวทางมากกว่าเป็นข้อมูลที่เชื่อถือได้; ความแตกต่างทางพฤติกรรมที่มีโครงสร้าง (ความสอดคล้องของวงจรยาว, คุณภาพของแพตช์ครั้งแรก, ความน่าเชื่อถือของการกำหนดเส้นทางหลายเครื่องมือ) เป็นสัญญาณที่คงทนกว่า

ข้อมูลจำเพาะโดยย่อ

ครอบครัวClaude รุ่นที่ 4
รูปแบบข้อความ, ภาพ, โค้ด
ภาษาภาษาอังกฤษเป็นหลัก หลายภาษา
การแคชพร้อมท์รองรับ (Anthropic)
หน้าต่างบริบท1M โทเค็น
เอาต์พุตสูงสุดสูงสุด 64K โทเค็น
ระดับความพยายามต่ำ / ปานกลาง / สูง / สูงสุด
ราคาตามรายการของผู้ขายอินพุต $5 / เอาต์พุต $25 ต่อ 1M

เกณฑ์มาตรฐาน Claude Opus 4.7

คะแนนที่ผู้ขายรายงานจากเอกสารเผยแพร่ Opus 4.7 ของ Anthropic โดยแสดงความแตกต่างกับตัวเลข Opus 4.6 สาธารณะ การตรวจสอบอิสระระบุว่า 4.7 เหนือกว่า GPT-5.2 ในงานการเขียนโค้ดแบบ agentic ส่วนใหญ่ และใกล้เคียงกับ Gemini 3 Pro ในการให้เหตุผลเชิงนามธรรมภายในไม่กี่จุด ถือว่าเปอร์เซ็นต์สัมบูรณ์เป็นแนวทาง; OpenAI ได้ตั้งค่าสถานะการปนเปื้อนข้อมูลการฝึกอบรมบน SWE-bench Verified ในทุกโมเดลแนวหน้า

SWE-bench Verifiedรายงานโดยผู้ขาย; เพิ่มขึ้นจาก 80.8% ของ Opus 4.6
~83.5%
SWE-bench Proรายงานผู้ขาย
นำครอบครัว Claude ในการเปิดตัว
Terminal-Bench 2.0รายงานโดยผู้ขาย; เพิ่มขึ้นจาก 65.4% ของ Opus 4.6
~71%
τ2-bench Retailการใช้เครื่องมือที่ผู้ขายรายงาน
~93%
OSWorld (การใช้คอมพิวเตอร์)รายงานโดยผู้ขาย; เพิ่มขึ้นจาก 72.7% ของ Opus 4.6
~76%
BrowseCompงานเว็บที่ผู้ขายรายงาน
~88%
ARC AGI 2รายงานโดยผู้ขาย; เพิ่มขึ้นจาก 68.8% ของ Opus 4.6
~75%
การสอบครั้งสุดท้ายของมนุษยชาติ (พร้อมเครื่องมือ)รายงานผู้ขาย
ครอบครัว Leads Claude
GPQA Diamondวิทยาศาสตร์ระดับบัณฑิตศึกษาที่รายงานโดยผู้ขาย
~92%
MRCR v2 (1M, 8 เข็ม)การเรียกคืนบริบทแบบยาว
ปรับปรุงจาก 76% ของ 4.6
MMMU Pro (หลายรูปแบบ)รายงานผู้ขาย
ครอบครัว Leads Claude

ราคา Claude Opus 4.7

ราคาผู้ให้บริการต่อ 1M โทเค็น

อินพุต$5.00
เอาต์พุต$25.00
อ่านแคช$0.50
เขียนแคช$6.25

Claude Opus 4.7 ทำงานอย่างไรในทางปฏิบัติ

พฤติกรรมที่สังเกตได้จากการทำงานของเอเจนต์การผลิต

การกำหนดเส้นทางเครื่องมือ

อัตราการเรียกใช้เครื่องมือที่ผิดพลาดต่ำที่สุดในตระกูล Claude ช่องว่างเมื่อเทียบกับ Sonnet 4.6 กว้างขึ้นในกรณีขอบที่ยาก เช่น การเลือกเครื่องมือแบบมีเงื่อนไข อาร์กิวเมนต์ที่ซ้อนกันลึก และการเรียกใช้เครื่องมือที่ส่งหลังจากช่วงเวลาการให้เหตุผลที่ยาวนาน

การเรียกคืนบริบทแบบยาว

สอดคล้องกันในบันทึกตัวแทนมากกว่า 200K โทเค็น หน้าต่าง 1M โทเค็นทำงานได้ดีกว่ารุ่นก่อนหน้ามาก ต้องขอบคุณการปรับปรุงการหมุนเวียนบริบทที่ Anthropic นำมาใช้ใน Opus 4.6 และปรับปรุงเพิ่มเติมสำหรับ 4.7 MRCR v2 ที่รายงานโดยผู้ขายที่ 1M แสดงให้เห็นถึงการเพิ่มขึ้นที่วัดได้เหนือ 76% ของ Opus 4.6

การแก้ไขโค้ดครั้งแรก

คุณภาพแพทช์ที่แข็งแกร่งที่สุดในตระกูล Claude เป็นตัวเลือกที่เหมาะสมเมื่อเอเจนต์ต้องแก้ไขโค้ดที่ต้องคอมไพล์และผ่านการทดสอบต่อไป โดยเฉพาะอย่างยิ่งเมื่อแพทช์ครอบคลุมหลายไฟล์ ผลลัพธ์ Terminal-Bench 2.0 ของ Anthropic สะท้อนสิ่งนี้โดยตรง

ความเร็ว

ช้ากว่า Sonnet 4.6 และช้ากว่า Kimi K2.7 Code อย่างเห็นได้ชัด Anthropic เผยแพร่ประมาณ 41 โทเค็น/วินาทีที่ความพยายามสูงสุดสำหรับ Opus 4.6 และ 4.7 อยู่ในช่วงที่คล้ายกัน สงวนไว้สำหรับขั้นตอนที่ต้องการความลึกของการให้เหตุผลเพิ่มเติมจริงๆ และเรียกใช้ระดับที่เบากว่าพร้อมกัน

พฤติกรรมการหลอน

Opus 4.7 ยังคงรักษาท่าทีการปฏิเสธแบบอนุรักษ์นิยมของ Anthropic และมักจะยอมรับความไม่แน่นอนมากกว่าที่จะสร้างเรื่องขึ้นมา ซึ่งเป็นเหตุผลที่ทีมผลิตยังคงจ่ายเบี้ยประกันสำหรับการให้เหตุผลที่มีความเสี่ยงสูง แม้ว่าจะมีทางเลือกแบบ open-weight ที่ถูกกว่า เช่น Kimi K2.7 Code และ DeepSeek V4 Pro ที่ตอนนี้สามารถเทียบเท่าได้ในเกณฑ์มาตรฐาน

งานตัวแทนที่ดีที่สุดสำหรับ Claude Opus 4.7

การตรวจสอบ PR ที่จับสิ่งที่มนุษย์พลาดไป

เมื่อคำขอดึงข้อมูลเปลี่ยนแปลง 30 ไฟล์ Opus 4.7 จะเก็บการเปลี่ยนแปลงทั้งหมดไว้ในหน่วยความจำทำงานและเขียนรีวิวที่เชื่อมโยงสิ่งที่เปลี่ยนแปลงใน auth/middleware.ts กับการทดสอบที่เสียใน routes/admin.test.ts ผู้ตรวจสอบรุ่นน้องจะได้รับข้อเสนอแนะข้ามไฟล์ที่วิศวกรอาวุโสมักจะตรวจพบในการตรวจสอบครั้งที่สอง และทีมจะส่งแพตช์ที่ผ่าน CI แต่มักจะเสียในการผลิตน้อยลง

การรันการวิจัยที่อ่านกองทั้งหมด

วางร่างสัญญา 200 หน้า ข้อเสนอคู่แข่งสามฉบับ และความเห็นทางกฎหมายของไตรมาสที่แล้วลงในหน้าต่างบริบท 1M โทเค็น จากนั้นขอให้ Opus ระบุทุกข้อที่เข้มงวดกว่าตลาดและระบุประเด็นการเจรจาที่เป็นไปได้ โมเดลขนาดเล็กจะเริ่มละทิ้งส่วนต้นๆ หลังจาก 100K โทเค็น; Opus จะเก็บภาพรวมทั้งหมดไว้และอ้างอิงย่อหน้าต้นฉบับที่อ้างถึงอย่างแม่นยำ

ผู้ประสานงานที่รันแผนหลายเครื่องมือ

ใช้ Opus 4.7 เป็นผู้วางแผนที่แบ่งคำขอของลูกค้าออกเป็นสิบขั้นตอน ส่งแต่ละขั้นตอนไปยังตัวแทนย่อย Sonnet หรือตัวแทนย่อยที่ประหยัดค่าใช้จ่าย และนำผลลัพธ์กลับมารวมกัน การรัน Opus เฉพาะในชั้นผู้วางแผน (และชั้นที่ถูกกว่าในส่วนอื่นๆ) มีค่าใช้จ่ายเพียงเศษเสี้ยวของการรัน Opus แบบครบวงจร โดยยังคงคุณภาพส่วนใหญ่ไว้ได้

การแก้ไขโค้ดครั้งแรกที่ไม่ทำให้การรัน CI เสียเวลา

ขอให้ Opus 4.7 ย้ายโค้ดเบส 50 ไฟล์จาก ORM หนึ่งไปยังอีก ORM หนึ่ง ปรับโครงสร้างโมดูลที่พันกัน หรือใช้การแก้ไขความปลอดภัยทั่วทั้งที่เก็บ แพตช์จะถูกนำไปใช้อย่างสะอาดในการลองครั้งแรกบ่อยกว่าโมเดลอื่น ๆ ในตระกูล ซึ่งเป็นสิ่งที่ Terminal-Bench 2.0 ที่รายงานโดยผู้ขายสะท้อนให้เห็น และสิ่งที่บิล CI ของคุณจะสะท้อนให้เห็นด้วย

เมื่อใดที่ควรข้าม Claude Opus 4.7

ข้าม Opus 4.7 สำหรับงานประจำที่มีปริมาณมากที่ Sonnet 4.6 ให้คุณภาพเท่ากันแต่ใช้ต้นทุนเพียงเล็กน้อย สำหรับการตอบกลับแชทที่ไวต่อเวลาแฝงที่ Kimi K2.7 Code เร็วกว่ามาก และสำหรับงานจัดหมวดหมู่หรือการแยกข้อมูลจำนวนมากที่ GPT-5.4 Mini เป็นตัวเลือกจำนวนมากที่รองรับที่ถูกกว่า

Claude Opus 4.7 เทียบกับโมเดลอื่นๆ

Claude Opus 4.7 เทียบกับ Claude Sonnet 4.6

Sonnet 4.6 เป็นค่าเริ่มต้นที่ใช้งานได้ดีในตระกูล Claude และเป็นตัวเลือกที่เหมาะสมสำหรับเอเจนต์ส่วนใหญ่ เลื่อนระดับเป็น Opus 4.7 เฉพาะเมื่อ Sonnet ล้มเหลวอย่างเห็นได้ชัดในการให้เหตุผลที่ยาก ลำดับความยาว หรือการแก้ไขโค้ดครั้งแรก ซึ่งมักจะเป็นผู้ประสานงานที่มอบหมายงานให้กับ Sonnet หรือซับเอเจนต์ที่ประหยัดค่าใช้จ่าย

Claude Opus 4.7 เทียบกับ Claude Opus 4.6

หน้าต่างบริบทเดียวกัน (1M โทเค็น) ราคาผู้ขายเดียวกัน และสถาปัตยกรรมการคิดแบบปรับตัวเดียวกัน Opus 4.7 เป็นรุ่นใหม่กว่าที่มีการปรับปรุงตามที่ผู้ขายรายงานใน SWE-bench Verified, Terminal-Bench 2.0, ARC AGI 2 และ OSWorld เลือก 4.7 สำหรับเอเจนต์ใหม่; ปักหมุด 4.6 เฉพาะเมื่อเอเจนต์ที่มีอยู่ได้รับการตรวจสอบกับเวอร์ชันนั้นแล้วและคุณต้องการความเสถียรของพฤติกรรม

สรุป: คุณควรใช้ Claude Opus 4.7 หรือไม่

Opus 4.7 เป็นระดับการยกระดับ เริ่มต้นด้วย Sonnet 4.6; เลื่อนระดับเป็น Opus เฉพาะในขั้นตอนที่ Sonnet ล้มเหลวอย่างเห็นได้ชัดเท่านั้น

คำถามที่พบบ่อย

หน้าต่างบริบทของ Claude Opus 4.7 คืออะไร

1 ล้านโทเค็น พร้อมเอาต์พุตสูงสุด 64K โทเค็นต่อการตอบสนอง หน้าต่างเต็มจะถูกเรียกเก็บเงินในอัตรามาตรฐาน คำขอ 900K โทเค็นมีอัตราต่อโทเค็นเท่ากับคำขอ 9K โทเค็น

Claude Opus 4.7 สามารถจัดการรูปภาพได้หรือไม่?

ใช่ Opus 4.7 เป็นแบบหลายรูปแบบ มันยอมรับอินพุตภาพพร้อมกับข้อความและโค้ด ดังนั้นตัวแทนที่ขับเคลื่อนด้วยภาพหน้าจอและวิสัยทัศน์เอกสารจึงทำงานได้โดยกำเนิด

ฉันควรเลือก Opus 4.7 แทน Sonnet 4.6 เมื่อใด?

เมื่อ (a) ตัวแทนเป็นผู้วางแผน / ผู้ประสานงานและการตัดสินใจเป็นแบบต่อเนื่อง (b) การรันยาวพอที่ Sonnet เริ่มละทิ้งคำสั่ง หรือ (c) ผลลัพธ์ต้องใช้ได้อย่างสะอาดในการลองครั้งแรก (การแก้ไขโค้ด, เพย์โหลดที่มีโครงสร้าง)

Opus 4.7 รองรับการแคชพรอมต์หรือไม่?

ใช่ อินพุตที่แคชไว้จะคิดค่าบริการที่ $0.50 ต่อ 1M โทเค็น ส่วนลด 10 เท่าสำหรับส่วนที่แคชไว้ คุ้มค่าที่จะใช้เมื่อพรอมต์ระบบหรือสคีมาเครื่องมือของคุณเสถียรตลอดการเรียกใช้

ทางเลือก

ความพร้อมใช้งานของ Claude Opus 4.7 บน Okou

Claude Opus 4.7 ถูกลบออกจากรายการ Okou แล้ว ดังนั้นจึงไม่สามารถเลือกได้ในการแชทหรือในเวิร์กโฟลว์ และไม่สามารถใช้งานได้กับคีย์ API ของคุณเอง GPT 5.6 Luna ครอบคลุมระดับการประหยัดต้นทุนเดียวกัน