DeepSeek V4 Flash บน Okou การเขียนโค้ดระดับเอเจนต์ในระดับราคาที่ถูกที่สุด
โมเดล Mixture-of-Experts 284B แบบเปิดน้ำหนักของ DeepSeek ที่มี 13B ทำงานต่อโทเค็น รุ่น 0731 ชนะ V4 Pro ในทุกเกณฑ์มาตรฐานของตัวแทนที่ DeepSeek เผยแพร่ ที่ $0.14 / $0.28 ต่อ 1M โทเค็น
1M tokens · Text / Code · Prompt cache
DeepSeek V4 Flash เป็นส่วนประสิทธิภาพของ DeepSeek รุ่น V4: โมเดล Mixture-of-Experts พารามิเตอร์ 284B ที่เปิดใช้งานพารามิเตอร์ 13B ต่อโทเค็น เปิดตัวภายใต้ใบอนุญาต MIT พร้อมน้ำหนักแบบเปิดเผย รุ่น 0731 ที่จัดส่งเมื่อวันที่ 31 กรกฎาคม 2026 ยังคงสถาปัตยกรรมไม่เปลี่ยนแปลงและรันการฝึกอบรมหลังการฝึกอบรมซ้ำบนข้อมูลเอเจนต์ ซึ่งทำให้มันแซงหน้า DeepSeek V4 Pro (Preview) ในเกณฑ์มาตรฐานเอเจนต์ทั้งเก้าที่ DeepSeek เผยแพร่ — 82.7 เทียบกับ 72.1 บน Terminal-Bench 2.1 และ 54.4 เทียบกับ 12.8 บน DeepSWE
ราคาตามรายการของผู้ขายคือ $0.14 / $0.28 ต่อ 1 ล้านโทเค็น โดยมีการเข้าถึงแคชที่ $0.0028 / 1 ล้าน และไม่มีค่าใช้จ่ายสำหรับการเขียนแคช ซึ่งทำให้เป็นโมเดลการให้เหตุผลที่ถูกที่สุดในกลุ่มผลิตภัณฑ์ปัจจุบันของ Okou มันมีหน้าต่างบริบท 1 ล้านโทเค็น, เอาต์พุตสูงสุด 384K และโหมดการคิดเปิดใช้งานโดยค่าเริ่มต้น มันเป็นข้อความเท่านั้น: ไม่มีวิสัยทัศน์ เลือกใช้ Claude Sonnet 4.6 เมื่อขั้นตอนต้องการรูปภาพหรือเฟรมเวิร์ก Claude Code และสำหรับ GPT 5.6 Luna เมื่อคุณต้องการระดับราคาถูกของตระกูล OpenAI แทน
DeepSeek V4 Flash คืออะไร?
31 กรกฎาคม 2026 (DeepSeek-V4-Flash-0731, รุ่นเบต้าสาธารณะ) · ครึ่งหนึ่งของประสิทธิภาพของตระกูล DeepSeek V4: พารามิเตอร์ที่ใช้งาน 13B เทียบกับ 49B ของ V4 Pro ซึ่งได้รับการฝึกอบรมเพิ่มเติมสำหรับงานของเอเจนต์
DeepSeek V4 Flash ปรากฏตัวครั้งแรกเมื่อวันที่ 24 เมษายน 2026 ในฐานะครึ่งเล็กของตระกูล V4 — MoE พารามิเตอร์ 284B ที่มี 13B ทำงานต่อโทเค็นและหน้าต่างบริบท 1M โทเค็น ถัดจาก V4 Pro พารามิเตอร์ 1.6T มันออกจากช่วงพรีวิวเมื่อวันที่ 31 กรกฎาคม 2026 ในชื่อ DeepSeek-V4-Flash-0731 ซึ่งเป็นรุ่นเบต้าสาธารณะที่ยังคงสถาปัตยกรรมเดิมและรันเฉพาะขั้นตอนหลังการฝึกอบรมใหม่ คราวนี้ใช้ข้อมูลที่เน้นเอเจนต์
การฝึกอบรมซ้ำนั้นเป็นเรื่องราวทั้งหมดของการเปิดตัว ตามตัวเลขของ DeepSeek เอง รุ่น 0731 เอาชนะ V4 Pro (Preview) ในเกณฑ์มาตรฐานเอเจนต์ที่เผยแพร่ทั้งเก้าตัว ในขณะที่เปิดใช้งานพารามิเตอร์ประมาณหนึ่งในสี่: Terminal-Bench 2.1 เพิ่มขึ้นจาก 61.8 ใน Flash preview เป็น 82.7, DeepSWE จาก 7.3 เป็น 54.4, Toolathlon-Verified จาก 49.7 เป็น 70.3 หลายตัวอยู่ในช่วงไม่กี่คะแนนของ Claude Opus 4.8 — 82.7 เทียบกับ 85.0 บน Terminal-Bench 2.1, 25.2 เทียบกับ 25.7 บน Agents' Last Exam — ในราคาที่ถูกกว่ามาก
ข้อควรระวังนั้นคุ้มค่าที่จะกล่าวอย่างชัดเจน ทุกคะแนนถูกรายงานโดย DeepSeek และรันด้วย DeepSeek Harness ซึ่งยังไม่ได้รับการเผยแพร่ ดังนั้นจึงไม่มีการทำซ้ำอย่างอิสระ และสองในเก้าชุดเป็นชุดภายในของ DeepSeek โมเดลนี้เป็นแบบข้อความเท่านั้น ตามหลังแนวหน้าในการให้เหตุผลระดับบัณฑิตศึกษา และยังคงตามหลัง V4 Pro ในงานหลายขั้นตอนระยะยาว โหมดการคิดเปิดใช้งานโดยค่าเริ่มต้น และโทเค็นการคิดจะถูกเรียกเก็บเงินเป็นเอาต์พุต
อะไรที่น่าสนใจเกี่ยวกับ DeepSeek V4 Flash
สถาปัตยกรรมหัวข้อข่าวและคุณสมบัติความสามารถ
V4 Flash เป็นโมเดล Mixture-of-Experts แบบ Sparse: พารามิเตอร์ทั้งหมด 284B โดยมี 13B เปิดใช้งานต่อโทเค็น โดยแต่ละเลเยอร์ MoE มีผู้เชี่ยวชาญที่ใช้ร่วมกัน 1 คนและผู้เชี่ยวชาญที่กำหนดเส้นทาง 256 คนที่มิติกลาง 2048 และผู้เชี่ยวชาญที่กำหนดเส้นทาง 6 คนทำงานต่อโทเค็น สามเลเยอร์ MoE แรกใช้การกำหนดเส้นทางแบบแฮช และความลึกของการทำนายหลายโทเค็นคือ 1 จุดตรวจสอบ 0731 ที่เผยแพร่มีพารามิเตอร์ 304B เนื่องจากมีการจัดส่งโมดูลร่างการถอดรหัสแบบคาดเดาเพิ่มเติมจากฐาน 284B รองรับหน้าต่างบริบท 1M โทเค็นพร้อมเอาต์พุตสูงสุด 384K โหมดการคิดและไม่คิด และพารามิเตอร์ reasoning_effort ที่มีระดับ low, high และ max น้ำหนักได้รับอนุญาตภายใต้ MIT และไม่ถูกจำกัด
ข้อมูลจำเพาะโดยย่อ
เกณฑ์มาตรฐาน DeepSeek V4 Flash
ตัวเลขที่รายงานโดย DeepSeek จากการ์ดโมเดล DeepSeek-V4-Flash-0731 ซึ่งรันด้วย DeepSeek Harness ในโหมดขั้นต่ำที่ความพยายามในการให้เหตุผลสูงสุด (อุณหภูมิ 1.0, top_p 0.95) Harness ยังไม่ได้รับการเผยแพร่ ดังนั้นจึงไม่มีการทำซ้ำสิ่งเหล่านี้อย่างอิสระ และ DSBench-FullStack และ DSBench-Hard เป็นชุดทดสอบภายในของ DeepSeek
ราคา DeepSeek V4 Flash
ราคาผู้ให้บริการต่อ 1M โทเค็น
DeepSeek V4 Flash ทำงานอย่างไรในทางปฏิบัติ
พฤติกรรมที่สังเกตได้จากการทำงานของเอเจนต์การผลิต
การดำเนินการแบบ Agentic
เป้าหมายหลังการฝึกอบรม 0731 ตรงกับสิ่งนี้อย่างแม่นยำ: การขับเคลื่อนเทอร์มินัล การเรียกใช้เครื่องมือตามลำดับ และการทำงานให้เสร็จสิ้นโดยไม่มีมนุษย์เข้ามาเกี่ยวข้อง คะแนน 82.7 บน Terminal-Bench 2.1 และ 70.3 บน Toolathlon-Verified ทำให้มันอยู่ในกลุ่มบริษัทชั้นนำสำหรับราคานี้
โปรไฟล์ต้นทุน
0.14 ดอลลาร์ / 0.28 ดอลลาร์ต่อ 1 ล้านโทเค็น, การเข้าถึงแคชที่ 0.0028 ดอลลาร์ / 1 ล้านโทเค็น, และการเขียนแคชไม่ถูกเรียกเก็บเงินเลย นี่คือตำแหน่งที่ถูกที่สุดในกลุ่มผลิตภัณฑ์ปัจจุบันและประมาณหนึ่งในสามของราคาเอาต์พุตของ V4 Pro ดังนั้นจึงเป็นโมเดลที่เหมาะสำหรับงานปริมาณมาก
บริบทขนาดยาว
1M โทเค็นเข้าและสูงสุด 384K ออก ดังนั้นการอ่านทั่วทั้งที่เก็บและข้อความถอดเสียงยาวจึงพอดีโดยไม่ต้องแบ่งส่วน คุณภาพในการวนลูปเอเจนต์ระยะยาวหลายขั้นตอนยังคงตามหลัง V4 Pro
ความลึกของการให้เหตุผล
สามระดับ reasoning_effort — low, high และ max — แลกเปลี่ยนความหน่วงกับการพิจารณา และคะแนนที่เผยแพร่ของ DeepSeek ล้วนอยู่ที่ max การให้เหตุผลระดับบัณฑิตศึกษาไม่ใช่จุดแข็งของมัน นั่นคือจุดที่ Claude Opus 5 และ GPT 5.6 Sol ยังคงนำหน้าอยู่
รูปแบบ
ข้อความและโค้ดเท่านั้น สิ่งใดก็ตามที่มีภาพหน้าจอ PDF ที่สแกน หรือแผนภูมิในวงจรจะต้องใช้โมเดลวิสัยทัศน์ เช่น Claude Sonnet 4.6 หรือ GPT 5.6 Luna
งานตัวแทนที่ดีที่สุดสำหรับ DeepSeek V4 Flash
เอเจนต์การเขียนโค้ดปริมาณมาก
การตรวจสอบ PR จำนวนมาก การเขียนทดสอบ การตรวจสอบและแก้ไข และการปรับโครงสร้างตามกำหนดเวลา ซึ่งเอเจนต์เดียวกันทำงานหลายร้อยครั้งต่อวัน ด้วยราคา $0.28 ต่อ 1M โทเค็นเอาต์พุต ค่าใช้จ่ายต่อการรันยังคงต่ำพอที่ปริมาณจะไม่เป็นข้อจำกัดอีกต่อไป
ระบบอัตโนมัติที่ขับเคลื่อนด้วยเทอร์มินัลและเครื่องมือ
ผลลัพธ์ที่เผยแพร่ที่แข็งแกร่งที่สุดของบิลด์ 0731 คือในงานเทอร์มินัลและการใช้เครื่องมือ ซึ่งเป็นสิ่งที่เอเจนต์แก้ไขบิลด์ ตรวจสอบการปรับใช้ หรือคัดแยกบันทึกทำตลอดทั้งวัน
การอ่านทั่วทั้งที่เก็บ
หน้าต่าง 1M โทเค็นสามารถรองรับที่เก็บข้อมูลขนาดกลางทั้งหมด, ไทม์ไลน์เหตุการณ์ที่ยาวนาน หรือชุดเอกสารการออกแบบทั้งหมดในครั้งเดียว ดังนั้นตัวแทนการย้ายข้อมูลหรือการตรวจสอบสามารถให้เหตุผลกับทั้งหมดได้แทนที่จะเป็นส่วนๆ
เลเยอร์ราคาถูกภายใต้ผู้ประสานงานแนวหน้า
ให้ Claude Opus 5 หรือ GPT 5.6 Sol วางแผนและตรวจสอบ และมอบขั้นตอนทางกลไกมากมาย — การอ่านไฟล์ การรันคำสั่ง การร่างแพตช์ — ให้กับ V4 Flash คุณจ่ายอัตราสูงสุดเฉพาะในขั้นตอนที่ตัดสินการรันเท่านั้น
เมื่อใดที่ควรข้าม DeepSeek V4 Flash
ข้าม V4 Flash สำหรับสิ่งใดก็ตามที่มีรูปภาพอยู่ในวงจร เนื่องจากไม่มีวิสัยทัศน์ และสำหรับการให้เหตุผลระดับบัณฑิตศึกษา ซึ่งโมเดลแนวหน้ายังคงนำหน้าอย่างชัดเจน การทำงานระยะยาวที่ยังคงสอดคล้องกันเป็นเวลาหลายชั่วโมงยังคงเป็นขอบเขตของ V4 Pro และ Claude Opus และถือว่าคะแนนเอเจนต์ที่เผยแพร่เป็นคำกล่าวอ้างของผู้ขายจนกว่า DeepSeek Harness จะจัดส่ง: ทดสอบประสิทธิภาพบนที่เก็บของคุณเองก่อนที่คุณจะย้ายเอเจนต์การผลิตข้ามไป
DeepSeek V4 Flash เทียบกับโมเดลอื่นๆ
DeepSeek V4 Flash เทียบกับ DeepSeek V4 Pro
ตระกูลเดียวกัน แต่มีการแลกเปลี่ยนที่ตรงกันข้าม Pro เป็นเรือธง 1.6T ที่มี 49B ทำงานต่อโทเค็น; Flash เปิดใช้งาน 13B และมีราคาหนึ่งในสามของราคาเอาต์พุตของ Pro ในเกณฑ์มาตรฐานเอเจนต์ที่เผยแพร่ของ DeepSeek รุ่น 0731 Flash ได้คะแนนสูงกว่า V4 Pro (Preview) ในทั้งเก้า ดังนั้นกรณีสำหรับ Pro คือความลึกในการให้เหตุผลหลายขั้นตอนที่ยาวนาน แทนที่จะเป็นปริมาณงานของเอเจนต์ V4 Pro ไม่มีให้บริการบน Okou อีกต่อไป — หน้าของมันที่นี่เป็นเอกสารอ้างอิง
DeepSeek V4 Flash เทียบกับ GPT 5.6 Luna
ทั้งสองเป็นระดับราคาถูกของตระกูลและทั้งสองทำงานบนเฟรมเวิร์ก Codex Luna เป็นแบบหลายรูปแบบและได้รับการสนับสนุนโดยระบบนิเวศของ OpenAI; Flash เป็นแบบข้อความเท่านั้น น้ำหนักเปิด ราคาต่ำกว่าหนึ่งในสี่ของราคาเอาต์พุตของ Luna และมีคะแนนเกณฑ์มาตรฐานของเอเจนต์ที่เผยแพร่ที่แข็งแกร่งกว่ามาก เลือก Luna เมื่อคุณต้องการวิสัยทัศน์หรือพฤติกรรมเฉพาะของ OpenAI, Flash เมื่อเป็นงานโค้ดและเครื่องมือ
DeepSeek V4 Flash เทียบกับ Claude Sonnet 4.6
Sonnet 4.6 เป็นโมเดลเอเจนต์หลักที่มีวิสัยทัศน์, เฟรมเวิร์ก Claude Code และความน่าเชื่อถือในการกำหนดเส้นทางเครื่องมือของ Anthropic; Flash เป็นโมเดลที่ประหยัดค่าใช้จ่ายและเป็นข้อความเท่านั้น โดยมีราคาเอาต์พุตประมาณหนึ่งในห้าสิบของ Sonnet เก็บ Sonnet ไว้ในขั้นตอนที่ตัดสินการรันและให้ Flash จัดการปริมาณงานที่อยู่ภายใต้
สรุป: คุณควรใช้ DeepSeek V4 Flash หรือไม่
DeepSeek V4 Flash เป็นวิธีที่ถูกที่สุดในการเรียกใช้ตัวแทนการเขียนโค้ดที่มีความสามารถบน Okou: เกณฑ์มาตรฐานตัวแทนที่ใกล้เคียงกับแนวหน้า, หน้าต่าง 1M โทเค็น, และ $0.28 ต่อ 1M โทเค็นเอาต์พุต ตรวจสอบตัวเลขของผู้ขายบนที่เก็บของคุณเอง, เก็บวิสัยทัศน์และการให้เหตุผลที่ยากที่สุดไว้ที่อื่น, และมันยากที่จะเอาชนะในด้านต้นทุนต่อภารกิจที่เสร็จสมบูรณ์
คำถามที่พบบ่อย
หน้าต่างบริบทของ DeepSeek V4 Flash คืออะไร?
อินพุต 1M โทเค็น และเอาต์พุตสูงสุด 384K โทเค็นต่อการตอบสนอง DeepSeek แนะนำให้ใช้เพดานเอาต์พุต 384K เต็มที่ในระดับความพยายามในการให้เหตุผลของ high และ max
DeepSeek V4 Flash มีราคาเท่าไหร่?
ราคาขายปลีกของผู้ขายคือ $0.14 ต่อ 1M โทเค็นอินพุต และ $0.28 ต่อ 1M โทเค็นเอาต์พุต โดยมีค่าใช้จ่ายสำหรับ cache hits ที่ $0.0028 ต่อ 1M และไม่มีค่าใช้จ่ายสำหรับการเขียน cache บน Okou มันอยู่ในระดับราคา $ ซึ่งเป็นระดับที่ถูกที่สุดในสี่ระดับ DeepSeek ได้ประกาศนโยบายช่วงเวลาเร่งด่วนที่จะเพิ่มราคาขายปลีกของตัวเองเป็นสองเท่าระหว่าง 09:00-12:00 น. และ 14:00-18:00 น. ตามเวลาปักกิ่ง; ยังไม่มีผลบังคับใช้
DeepSeek V4 Flash ดีกว่า DeepSeek V4 Pro หรือไม่
จากเกณฑ์มาตรฐานเอเจนต์เก้าตัวที่ DeepSeek เผยแพร่สำหรับการสร้าง 0731 ใช่: มันได้คะแนนสูงกว่า V4 Pro (Preview) ในทุกตัว ในขณะที่เปิดใช้งานพารามิเตอร์ 13B เทียบกับ Pro ที่ 49B Pro ยังคงมีความได้เปรียบในการให้เหตุผลหลายขั้นตอนที่มีขอบเขตยาวนาน V4 Pro ไม่ได้นำเสนอใน Okou อีกต่อไป
DeepSeek V4 Flash รองรับวิสัยทัศน์หรือไม่?
ไม่ มันรับเฉพาะข้อความและโค้ดเท่านั้น กำหนดเส้นทางขั้นตอนที่ขับเคลื่อนด้วยภาพหน้าจอ แผนภูมิ หรือ PDF ไปยังโมเดลหลายรูปแบบ เช่น Claude Sonnet 4.6 หรือ GPT 5.6 Luna
DeepSeek V4 Flash ใช้เฟรมเวิร์กอะไรบน Okou
Codex Okou กำหนดเส้นทางผ่าน DeepSeek's Responses API ซึ่ง V4 Flash เป็นโมเดล DeepSeek เดียวที่รองรับในปัจจุบัน รันเป็นโมเดลในตัวที่เรียกเก็บเงินเป็นเครดิต Okou หรือนำคีย์ API ของ DeepSeek มาเอง
ทางเลือก
การใช้ DeepSeek V4 Flash บน Okou
สองวิธีในการเข้าถึง DeepSeek V4 Flash บน Okou
Okou รองรับ DeepSeek V4 Flash เป็นโมเดลในตัวที่เรียกเก็บเงินเป็นเครดิต Okou และผ่านการนำมาใช้เองด้วย DeepSeek API key เส้นทางในตัวใช้การกำหนดเส้นทาง Okou Managed และระดับราคาที่อธิบายไว้ด้านล่าง; เส้นทางนำมาใช้เองจะเรียกเก็บเงินคุณโดยตรงกับผู้จำหน่ายต้นน้ำและข้ามการแปลงเครดิต Okou ทั้งหมด
คำแนะนำของ Okou
Okou วางตำแหน่ง DeepSeek V4 Flash เป็นตัวเลือกที่ช่วยประหยัดค่าใช้จ่ายสำหรับการจัดประเภทจำนวนมาก การกรองล่วงหน้า การตอบกลับที่ไวต่อความหน่วง และงานปริมาณมากอื่นๆ
เครดิตและระดับราคา $
Okou กำหนดราคาโมเดล Built-in ทุกรุ่นตามระดับเครดิตสี่ระดับ — $, $$, $$$, $$$$ — แสดงเป็นป้ายในตัวเลือกโมเดลและบนบรรทัด price tier ของ zero model ls DeepSeek V4 Flash อยู่ที่ $ ระดับนั้นคือสิ่งที่คุณใช้จากยอดเครดิต Okou ของคุณ; ราคาขายปลีกของผู้ขายในตารางด้านบนคือสิ่งที่ผู้ให้บริการต้นน้ำเรียกเก็บก่อนที่ Okou จะแปลงเป็นเครดิต
มีให้บริการบน Okou ตั้งแต่ July 31, 2026

