สงครามราคา AI เดือด DeepSeek ทำต้นทุนถูกลง จนยักษ์ใหญ่ต้องขยับตาม
ลองนึกภาพว่าระบบหนึ่งต้องอ่านข้อมูลระดับหลายพันล้านโทเคน แต่บิลกลับอยู่แค่หลักสิบดอลลาร์ ภาพแบบนี้เมื่อไม่นานก่อนยังฟังคล้ายเรื่องเกินจริง เพราะต้นทุนของโมเดลภาษาไม่ได้มาจากแค่การสร้างคำตอบ แต่มาจากการต้องแบกบริบทจำนวนมหาศาลไว้ตลอดเวลาที่ประมวลผล
ประเด็นที่ทำให้ DeepSeek V4 Flash ถูกจับตาคือการพยายามแก้คอขวดตรงนี้โดยตรง รุ่นดังกล่าวเป็นโมเดลแบบ Mixture of Experts มีพารามิเตอร์รวม 284 พันล้านตัว แต่เปิดใช้งานประมาณ 13 พันล้านตัวต่อโทเคน และรองรับบริบทยาวถึง 1 ล้านโทเคน แนวคิดคือไม่จำเป็นต้องปลุกสมองทั้งก้อนขึ้นมาทำงานทุกครั้ง ถ้าเลือกเฉพาะส่วนที่เกี่ยวข้องได้ ต้นทุนต่อคำก็ลดลงทันที
เรื่องที่หนักกว่านั้นคือกลไก Attention ปกติ ยิ่งบริบทยาวก็ยิ่งกินทั้งกำลังคำนวณและหน่วยความจำ โดยเฉพาะ KV cache ที่ต้องเก็บข้อมูลจากข้อความก่อนหน้าไว้เพื่อสร้างคำถัดไป พอขยายไปถึงหลักแสนหรือหลักล้านโทเคน เซิร์ฟเวอร์ราคาแพงก็รับงานพร้อมกันได้น้อยลง ต้นทุนต่อผู้ใช้จึงสูงขึ้นตาม
DeepSeek เลือกใช้แนวทางที่ไม่บังคับให้โมเดลจ้องทุกโทเคนเท่ากันทั้งหมด สถาปัตยกรรม V4 ใช้การบีบอัดข้อมูลร่วมกับ sparse attention เพื่อให้ระบบมองภาพรวมของบริบทก่อน แล้วค่อยทุ่มการคำนวณละเอียดให้ส่วนที่น่าจะเกี่ยวข้องจริง วิธีนี้มีญาติทางความคิดกับงาน Native Sparse Attention ที่เสนอการบีบอัด การเลือกส่วนสำคัญ และการเก็บบริบทใกล้ปัจจุบันไว้พร้อมกัน แทนที่จะลากทุกคำในอดีตมาคำนวณแบบเต็มรูปทุกครั้ง
ตัวเลขจาก DeepSeek ระบุว่าในบริบทขนาด 1 ล้านโทเคน รุ่น V4 Pro ใช้ FLOPs สำหรับการอนุมานต่อหนึ่งโทเคนประมาณ 27% และใช้ KV cache ราว 10% เมื่อเทียบกับ V3.2 นี่ไม่ได้แปลว่าเร็วขึ้นหรือถูกลงในทุกงานแบบเส้นตรง แต่แสดงชัดว่าการออกแบบโมเดลเริ่มแข่งขันกันที่ประสิทธิภาพของระบบ ไม่ใช่ไล่เพิ่มจำนวนพารามิเตอร์อย่างเดียว
จุดที่ทำให้เรื่องนี้ลามไปเป็นสงครามราคาคือต้นทุนบริการ API ปัจจุบันของ DeepSeek V4 Flash สำหรับข้อมูลขาเข้าที่ไม่โดนแคชอยู่ที่ 0.14 ดอลลาร์ต่อหนึ่งล้านโทเคน และถ้าเป็นข้อมูลที่แคชไว้แล้วจะถูกกว่านั้นมาก ตัวเลขระดับนี้ทำให้งานที่เคยต้องคอยตัดข้อความ ทิ้งประวัติ หรือย่อเอกสารเพื่อประหยัดเงิน เริ่มมีทางเลือกใหม่ เช่น ป้อนฐานโค้ดขนาดใหญ่ เอกสารจำนวนมาก หรือประวัติการทำงานของเอเจนต์เข้าไปทีเดียวแล้วปล่อยให้ระบบค้นหาส่วนที่เกี่ยวข้องเอง
วันที่ 30 กรกฎาคม 2026 OpenAI ประกาศลดราคา GPT-5.6 Luna ลง 80% และ Terra ลง 20% พร้อมอธิบายว่าประสิทธิภาพของระบบดีขึ้นจนสามารถส่งต่อการประหยัดต้นทุนให้ลูกค้าได้ จังหวะเวลานี้เกิดท่ามกลางการแข่งขันจากโมเดลจีนราคาต่ำหลายค่าย จึงทำให้ตลาดตีความว่าแรงกดดันด้านราคากำลังบีบผู้เล่นรายใหญ่ให้ขยับเร็วขึ้น แต่ยังไม่มีหลักฐานจาก OpenAI ที่ยืนยันตรงๆ ว่าการลดราคาครั้งนี้เกิดเพราะ DeepSeek เพียงรายเดียว
ตรงนี้ควรแยกข่าวพาดหัวออกจากข้อเท็จจริงให้ชัด เพราะคำว่า DeepSeek ทำให้ OpenAI ลดราคา 80% ฟังแรงและจำง่าย แต่สาเหตุจริงในตลาดมักซ้อนกันหลายชั้น ทั้งประสิทธิภาพชิป การปรับซอฟต์แวร์ การแคช การแข่งขันจากหลายบริษัท และแรงกดดันจากลูกค้าองค์กรที่เริ่มถามหนักขึ้นว่าเงินที่จ่ายไปให้ AI สร้างผลลัพธ์คุ้มแค่ไหน
ฝั่งคนใช้งาน สิ่งที่น่าสนใจกว่าดราม่าระหว่างบริษัทคือพฤติกรรมการใช้ AI จะเปลี่ยนเมื่อราคาต่อโทเคนลดลงแรง เดิมนักพัฒนามักออกแบบระบบให้ประหยัดคำทุกวิถีทาง เพราะการส่งข้อมูลยาวเท่ากับต้นทุนที่พุ่งขึ้น แต่เมื่อการอ่านบริบทขนาดใหญ่ถูกลง การออกแบบเอเจนต์สามารถหันไปเน้นความครบถ้วนมากขึ้น เช่น ให้ระบบอ่านเอกสารทั้งชุดก่อนตอบ ตรวจโค้ดหลายโมดูลพร้อมกัน หรือเก็บประวัติการทำงานยาวกว่าที่เคย
แต่ของถูกไม่ได้แปลว่าปลอดข้อเสีย Sparse attention มีความเสี่ยงเฉพาะตัว ถ้าระบบเลือกส่วนสำคัญพลาด ข้อมูลที่จำเป็นอาจไม่ถูกอ่านละเอียดตั้งแต่ต้น งานที่ต้องไล่ครบทุกบรรทัด เช่น รวมยอดตัวเลขจากเอกสารจำนวนมาก ตรวจข้อความกฎหมายแบบคำต่อคำ หรือเทียบโค้ดที่ต่างกันเพียงจุดเล็กๆ จึงต้องทดสอบความแม่นยำจริง ไม่ควรตัดสินจากราคาเพียงอย่างเดียว
อีกเรื่องที่คนทำระบบต้องจับตาคือราคาหน้าเว็บไม่เท่ากับต้นทุนรวม โมเดลที่ถูกกว่าแต่ต้องเรียกซ้ำหลายรอบ ออกคำตอบยาวเกินจำเป็น หรือผิดจนต้องใช้โมเดลแพงมาตรวจอีกที อาจจบด้วยบิลสูงกว่าโมเดลที่แพงตั้งแต่ต้น การวัดต้นทุนต่อหนึ่งงานที่เสร็จจริงจึงมีประโยชน์กว่าดูแค่ราคาต่อหนึ่งล้านโทเคน
การแข่งขันรอบนี้เลยไม่ได้มีแค่คำถามว่าโมเดลไหนฉลาดที่สุด แต่กลายเป็นคำถามว่าใครให้ความฉลาดที่พอใช้กับงานจริงได้ในราคาต่ำที่สุด ถ้าราคาอินพุตยังลดต่อ งานหลายประเภทที่เคยถูกมองว่าแพงเกินไปจะกลายเป็นฟีเจอร์พื้นฐานในซอฟต์แวร์ธรรมดา และฝั่งผู้ใช้จะได้อำนาจต่อรองมากขึ้นแบบเห็นชัด
ตอนนี้สิ่งที่ควรทำไม่ใช่ย้ายทุกงานไปหาโมเดลที่ถูกที่สุดทันที แต่แบ่งงานตามความเสี่ยง งานค้นหา สรุป จัดหมวด หรือประมวลผลจำนวนมากอาจเหมาะกับโมเดลราคาต่ำ ส่วนงานที่ตัวเลขต้องเป๊ะ ข้อความต้องครบ หรือความผิดพลาดมีต้นทุนสูง ควรมีชั้นตรวจสอบเพิ่ม แล้วสงครามราคาครั้งนี้จะกลายเป็นประโยชน์จริงแทนที่จะเป็นแค่ป้ายราคาที่ดูหวือหวา
https://api-docs.deepseek.com/quick_start/pricing
https://api-docs.deepseek.com/news/news260424/
https://huggingface.co/deepseek-ai/DeepSeek-V4-Pro
https://openai.com/index/advancing-the-price-performance-frontier-with-gpt-5-6/
https://arxiv.org/abs/2502.11089
ทำไมเวลา “ล้างจาน” น้ำร้อนถึงช่วยให้จานแห้งเร็วกว่า ทั้งที่อุณหภูมิห้องเท่ากัน?
จังหวัดที่มีคนญี่ปุ่นอาศัยอยู่มากที่สุดในประเทศไทย
5 สำนัก เลขตรงกัน “5” ตัวเดียว งวด 16 ส.ค. 69
เลขท้าย 2 ตัวที่ออกเพียงครั้งเดียวในรอบ 20 ปี
เที่ยวบินพีเอสเอ 1771 โศกนาฏกรรมบนฟ้าที่เริ่มจากช่องโหว่ความปลอดภัยของระบบพนักงานสนามบิน
ทำไมคนหนุ่มสาวนิวซีแลนด์ถึงย้ายออก ทั้งที่ประเทศยังน่าอยู่ระดับโลก
เมดคาเฟ่ญี่ปุ่น ทำไม ความน่ารัก ถึงขายได้ และ งานบริการ แบบสวมบทบาท มี ต้นทุน ทางอารมณ์ ซ่อนอยู่
ส่องเลข 'วิ่งตาม' เลขท้ายงวดก่อน ก่อน 16 ส.ค. 69 — หาความสัมพันธ์ผสมการคำนวณและสัญญาณ
10 โรงเรียนที่ขึ้นชื่อว่าสอบเข้ายากที่สุด
10 ต้นไม้สวยแต่มีพิษ หลายบ้านปลูกโดยไม่รู้
เด็กไม่ยอมคาดเข็มขัด เครื่องบินพอร์เตอร์ต้องวนกลับเทอร์มินัล ก่อนเที่ยวบินถูกยกเลิก
ทำไมห้องว่างถึง “เสียงก้อง” กว่าห้องที่มีเฟอร์นิเจอร์? ทั้งที่ขนาดห้องเท่าเดิม
ทำไมเวลา “ล้างจาน” น้ำร้อนถึงช่วยให้จานแห้งเร็วกว่า ทั้งที่อุณหภูมิห้องเท่ากัน?
เมดคาเฟ่ญี่ปุ่น ทำไม ความน่ารัก ถึงขายได้ และ งานบริการ แบบสวมบทบาท มี ต้นทุน ทางอารมณ์ ซ่อนอยู่
เที่ยวบินพีเอสเอ 1771 โศกนาฏกรรมบนฟ้าที่เริ่มจากช่องโหว่ความปลอดภัยของระบบพนักงานสนามบิน
ปม กสทช. แตกหนัก ทำไมความขัดแย้งเรื่องประธานถึงลามเป็นข้อเสนอให้ล้างไพ่ทั้งบอร์ด
บทบาทสาธารณะของ รี ซอลจู ภรรยา คิม จองอึน ที่ลดลงในเกาหลีเหนือช่วงหลายปีที่ผ่านมา
ทำไมคนไทยบางส่วนยังยอมซื้อของหรู ทั้งที่รายได้ตึงและหนี้ครัวเรือนยังสูง
โนเกียจากมือถือในความทรงจำ สู่ธุรกิจเครือข่ายปัญญาประดิษฐ์ที่กำลังโตแรงในยุคดาต้าเซ็นเตอร์
🎬 แจกฟรี! Prompt สร้างวิดีโอ AI สาย Parkour Action ซีนระดับฮอลลีวูด (8K HDR / IMAX Quality)
ChatGPT รอบใหม่ Sol ฉลาดขึ้น ส่วน Luna เปิดทางใช้ฟรีคุยข้อความได้ยาวกว่าเดิม
Apple เปิดศึก OpenAI ฟ้องคดี ความลับการค้า หลังอดีตวิศวกรย้ายค่าย จุดชนวน สงครามฮาร์ดแวร์ AI ครั้งใหญ่