
โดย Thanedpol Dechaduangsakul | เผยแพร่: 4 สิงหาคม 2569 | อ้างอิง: DeepSeek, HuggingFace
DeepSeek ปล่อย V4-Flash ตัวจริงเข้า public beta วันที่ 31 กรกฎาคม 2026 model string เดิม ไม่ต้องแก้โค้ด
คะแนน agent benchmark แซง V4-Pro-Preview ทั้ง 9 สนาม เช่น Terminal Bench 2.1 อยู่ที่ 82.7 และ Cybergym อยู่ที่ 76.7
Architecture และขนาดโมเดลเหมือนเดิมทุกอย่าง เปลี่ยนแค่การเทรนรอบใหม่ (post-training)
รองรับ Responses API และ Codex แบบ native ไม่ต้องมี shim แปลงข้อมูล
ราคาไม่เปลี่ยน ยังอยู่ที่ 0.14 ดอลลาร์ต่อ 1 ล้าน input token
ถ้าคุณเคยคิดว่าโมเดลราคาประหยัดต้องยอมแพ้โมเดลตัวท็อปเสมอ เรื่องนี้กำลังจะเปลี่ยนความคิดนั้นไปเลย
Flash เวอร์ชัน 0731 นี้ใช้ architecture และขนาดโมเดลเหมือนกับ V4-Flash-Preview ทุกประการ สิ่งเดียวที่ DeepSeek ทำเพิ่มคือรัน post-training ใหม่อีกรอบ ซึ่งเป็นขั้นตอนที่ปรับพฤติกรรมการเรียก tool การตอบสนอง และสไตล์การทำงานแบบ agent โดยเฉพาะ ผลลัพธ์คือโมเดลตัวเดิมที่ฉลาดขึ้นโดยไม่ต้องเพิ่มขนาดหรือต้นทุนเลย
DeepSeek เปิดเผยผลทดสอบ 9 รายการ โดยวัดด้วย DeepSeek Harness minimal mode ที่ tier สูงสุด top_p 0.95 temperature 1.0

Benchmark | คะแนน V4-Flash | วัดอะไร |
|---|---|---|
Terminal Bench 2.1 | 82.7 | งาน agent terminal/shell แบบยาว |
NL2Repo | 54.2 | สร้าง repository จากสเปกภาษาธรรมชาติ |
Cybergym | 76.7 | การให้เหตุผลสไตล์ security/CTF |
DeepSWE | 54.4 | การแก้ปัญหา software engineering จริง |
Toolathlon (verified) | 70.3 | การประสาน multi-tool ภายใต้การตรวจสอบ |
Agent Last Exam | 25.2 | การให้เหตุผล agent ระดับยาก |
Automation Bench (Public) | 25.1 | Workflow automation แบบครบวงจร |
ตัวเลขทั้งหมดเป็นข้อมูลที่ DeepSeek รายงานเอง ยังไม่มีการทดสอบซ้ำจากบุคคลที่สาม จึงควรมองเป็นสัญญาณทิศทาง ไม่ใช่ผลชี้ขาดสุดท้าย
ไม่ต้อง เพราะ model string เดิม endpoint เดิม เรียกใช้เหมือนเดิมแล้วได้เวอร์ชันล่าสุดโดยอัตโนมัติ แต่เนื่องจากพฤติกรรมโมเดลอาจเปลี่ยนไปจาก post-training รอบใหม่ ใครที่มี agent scaffolding แบบเปราะบางควรรัน eval ใหม่อีกรอบเพื่อความชัวร์
ไม่มี ราคายังอยู่ที่เดิมทุกอย่าง คือ 0.14 ดอลลาร์ต่อ 1 ล้าน input token แบบ cache miss 0.0028 ดอลลาร์แบบ cache hit และ 0.28 ดอลลาร์ต่อ 1 ล้าน output token มีการประกาศเรื่อง peak-hour surcharge ไว้แล้วแต่ยังไม่เริ่มใช้งานจริง
ตอนนี้สิ่งที่ทีมพัฒนาควรทำคือกลับไปเช็คว่า agent ที่ตัวเองสร้างไว้ ยังใช้โมเดลที่คุ้มค่าที่สุดอยู่หรือเปล่า เพราะเทรนด์ที่เห็นชัดคือของถูกกำลังไล่ตามของแพงเร็วกว่าที่หลายคนคาดไว้
━━━━━━━━━━━━━━━━━━━━━━━━━━━━
Q: ต้องเปลี่ยน model string ไหม?
A: ไม่ต้อง ใช้ deepseek-v4-flash เหมือนเดิม ได้เวอร์ชันล่าสุดอัตโนมัติ
Q: V4-Pro อัปเกรดด้วยไหม?
A: ยังไม่อัปเกรด มีแค่ Flash API เท่านั้นที่ปรับ ส่วน V4-Pro ตัวจริงยังรอการเปิดตัวอยู่
Q: ตัวเลขคะแนนพวกนี้เชื่อถือได้แค่ไหน?
A: เป็นตัวเลขที่ DeepSeek รายงานเอง สองรายการคือ DSBench-FullStack และ DSBench-Hard เป็นชุดทดสอบภายในที่เทียบกับคนนอกไม่ได้โดยตรง
Q: รองรับ Codex ยังไง?
A: Flash ตัวใหม่คุยกับ Responses API ได้แบบ native จึงต่อกับ Codex-style harness ได้เลยโดยไม่ต้องมีตัวแปลงข้อมูลคั่นกลาง
// อ่านต่อ


Kitesurf คือ browser ตัวใหม่ที่ Cloudflare สร้างขึ้นมาเพื่อ AI agents โดยเฉพาะ รันทั้งหมดบน V8 isolates ของ Cloudflare Workers ชื่ออาจฟังดูแปลกๆ แต่แนวคิดนั้นชัดเจนมาก พวกเขาถามตัวเองว่า "ทำไมเราถึงใช้ Chromium ซึ่งเป็น browser ที่สร้างมาเพื่อมนุษย์ มาให้ AI ใช้?" คำตอบคือมันแพงเกินไป กินทรัพยากรเยอะเกิน และเต็มไปด้วยฟีเจอร์ที่ AI ไม่ได้ต้องการเลย
อ่าน →
Genspark เพิ่งปล่อย Workspace 6.0 อัปเดตใหญ่ที่เปลี่ยนกฎเกมการทำงาน โดยฝังความจำถาวรให้ AI ผ่านฟีเจอร์ SecondBrain ที่จำบริบทงานเราได้เลย ไม่ต้องมานั่งป้อนข้อมูลซ้ำทุกครั้งที่สั่งงาน
อ่าน →