หน้าแรก ตรวจหวย เว็บบอร์ด ควิซ Pic Post แชร์ลิ้ง หาเพื่อน Chat หาเพื่อน Line Page อัลบั้ม คำคม Glitter เกมถอดรหัสภาพ คำนวณ การเงิน ราคาทองคำ กินอะไรดี
ข้อตกลงการใช้บริการนโยบายความเป็นส่วนตัวนโยบายเนื้อหานโยบายการสร้างรายได้About Usติดต่อเว็บไซต์แจ้งเนื้อหาไม่เหมาะสม
เว็บบอร์ด บอร์ดต่างๆค้นหาตั้งกระทู้

สงครามราคา AI เดือด DeepSeek ทำต้นทุนถูกลง จนยักษ์ใหญ่ต้องขยับตาม

เขียนโดย phana3462

ลองนึกภาพว่าระบบหนึ่งต้องอ่านข้อมูลระดับหลายพันล้านโทเคน แต่บิลกลับอยู่แค่หลักสิบดอลลาร์ ภาพแบบนี้เมื่อไม่นานก่อนยังฟังคล้ายเรื่องเกินจริง เพราะต้นทุนของโมเดลภาษาไม่ได้มาจากแค่การสร้างคำตอบ แต่มาจากการต้องแบกบริบทจำนวนมหาศาลไว้ตลอดเวลาที่ประมวลผล

ประเด็นที่ทำให้ DeepSeek V4 Flash ถูกจับตาคือการพยายามแก้คอขวดตรงนี้โดยตรง รุ่นดังกล่าวเป็นโมเดลแบบ Mixture of Experts มีพารามิเตอร์รวม 284 พันล้านตัว แต่เปิดใช้งานประมาณ 13 พันล้านตัวต่อโทเคน และรองรับบริบทยาวถึง 1 ล้านโทเคน แนวคิดคือไม่จำเป็นต้องปลุกสมองทั้งก้อนขึ้นมาทำงานทุกครั้ง ถ้าเลือกเฉพาะส่วนที่เกี่ยวข้องได้ ต้นทุนต่อคำก็ลดลงทันที

เรื่องที่หนักกว่านั้นคือกลไก Attention ปกติ ยิ่งบริบทยาวก็ยิ่งกินทั้งกำลังคำนวณและหน่วยความจำ โดยเฉพาะ KV cache ที่ต้องเก็บข้อมูลจากข้อความก่อนหน้าไว้เพื่อสร้างคำถัดไป พอขยายไปถึงหลักแสนหรือหลักล้านโทเคน เซิร์ฟเวอร์ราคาแพงก็รับงานพร้อมกันได้น้อยลง ต้นทุนต่อผู้ใช้จึงสูงขึ้นตาม

DeepSeek เลือกใช้แนวทางที่ไม่บังคับให้โมเดลจ้องทุกโทเคนเท่ากันทั้งหมด สถาปัตยกรรม V4 ใช้การบีบอัดข้อมูลร่วมกับ sparse attention เพื่อให้ระบบมองภาพรวมของบริบทก่อน แล้วค่อยทุ่มการคำนวณละเอียดให้ส่วนที่น่าจะเกี่ยวข้องจริง วิธีนี้มีญาติทางความคิดกับงาน Native Sparse Attention ที่เสนอการบีบอัด การเลือกส่วนสำคัญ และการเก็บบริบทใกล้ปัจจุบันไว้พร้อมกัน แทนที่จะลากทุกคำในอดีตมาคำนวณแบบเต็มรูปทุกครั้ง

ตัวเลขจาก DeepSeek ระบุว่าในบริบทขนาด 1 ล้านโทเคน รุ่น V4 Pro ใช้ FLOPs สำหรับการอนุมานต่อหนึ่งโทเคนประมาณ 27% และใช้ KV cache ราว 10% เมื่อเทียบกับ V3.2 นี่ไม่ได้แปลว่าเร็วขึ้นหรือถูกลงในทุกงานแบบเส้นตรง แต่แสดงชัดว่าการออกแบบโมเดลเริ่มแข่งขันกันที่ประสิทธิภาพของระบบ ไม่ใช่ไล่เพิ่มจำนวนพารามิเตอร์อย่างเดียว

จุดที่ทำให้เรื่องนี้ลามไปเป็นสงครามราคาคือต้นทุนบริการ API ปัจจุบันของ DeepSeek V4 Flash สำหรับข้อมูลขาเข้าที่ไม่โดนแคชอยู่ที่ 0.14 ดอลลาร์ต่อหนึ่งล้านโทเคน และถ้าเป็นข้อมูลที่แคชไว้แล้วจะถูกกว่านั้นมาก ตัวเลขระดับนี้ทำให้งานที่เคยต้องคอยตัดข้อความ ทิ้งประวัติ หรือย่อเอกสารเพื่อประหยัดเงิน เริ่มมีทางเลือกใหม่ เช่น ป้อนฐานโค้ดขนาดใหญ่ เอกสารจำนวนมาก หรือประวัติการทำงานของเอเจนต์เข้าไปทีเดียวแล้วปล่อยให้ระบบค้นหาส่วนที่เกี่ยวข้องเอง

วันที่ 30 กรกฎาคม 2026 OpenAI ประกาศลดราคา GPT-5.6 Luna ลง 80% และ Terra ลง 20% พร้อมอธิบายว่าประสิทธิภาพของระบบดีขึ้นจนสามารถส่งต่อการประหยัดต้นทุนให้ลูกค้าได้ จังหวะเวลานี้เกิดท่ามกลางการแข่งขันจากโมเดลจีนราคาต่ำหลายค่าย จึงทำให้ตลาดตีความว่าแรงกดดันด้านราคากำลังบีบผู้เล่นรายใหญ่ให้ขยับเร็วขึ้น แต่ยังไม่มีหลักฐานจาก OpenAI ที่ยืนยันตรงๆ ว่าการลดราคาครั้งนี้เกิดเพราะ DeepSeek เพียงรายเดียว

ตรงนี้ควรแยกข่าวพาดหัวออกจากข้อเท็จจริงให้ชัด เพราะคำว่า DeepSeek ทำให้ OpenAI ลดราคา 80% ฟังแรงและจำง่าย แต่สาเหตุจริงในตลาดมักซ้อนกันหลายชั้น ทั้งประสิทธิภาพชิป การปรับซอฟต์แวร์ การแคช การแข่งขันจากหลายบริษัท และแรงกดดันจากลูกค้าองค์กรที่เริ่มถามหนักขึ้นว่าเงินที่จ่ายไปให้ AI สร้างผลลัพธ์คุ้มแค่ไหน

ฝั่งคนใช้งาน สิ่งที่น่าสนใจกว่าดราม่าระหว่างบริษัทคือพฤติกรรมการใช้ AI จะเปลี่ยนเมื่อราคาต่อโทเคนลดลงแรง เดิมนักพัฒนามักออกแบบระบบให้ประหยัดคำทุกวิถีทาง เพราะการส่งข้อมูลยาวเท่ากับต้นทุนที่พุ่งขึ้น แต่เมื่อการอ่านบริบทขนาดใหญ่ถูกลง การออกแบบเอเจนต์สามารถหันไปเน้นความครบถ้วนมากขึ้น เช่น ให้ระบบอ่านเอกสารทั้งชุดก่อนตอบ ตรวจโค้ดหลายโมดูลพร้อมกัน หรือเก็บประวัติการทำงานยาวกว่าที่เคย

แต่ของถูกไม่ได้แปลว่าปลอดข้อเสีย Sparse attention มีความเสี่ยงเฉพาะตัว ถ้าระบบเลือกส่วนสำคัญพลาด ข้อมูลที่จำเป็นอาจไม่ถูกอ่านละเอียดตั้งแต่ต้น งานที่ต้องไล่ครบทุกบรรทัด เช่น รวมยอดตัวเลขจากเอกสารจำนวนมาก ตรวจข้อความกฎหมายแบบคำต่อคำ หรือเทียบโค้ดที่ต่างกันเพียงจุดเล็กๆ จึงต้องทดสอบความแม่นยำจริง ไม่ควรตัดสินจากราคาเพียงอย่างเดียว

อีกเรื่องที่คนทำระบบต้องจับตาคือราคาหน้าเว็บไม่เท่ากับต้นทุนรวม โมเดลที่ถูกกว่าแต่ต้องเรียกซ้ำหลายรอบ ออกคำตอบยาวเกินจำเป็น หรือผิดจนต้องใช้โมเดลแพงมาตรวจอีกที อาจจบด้วยบิลสูงกว่าโมเดลที่แพงตั้งแต่ต้น การวัดต้นทุนต่อหนึ่งงานที่เสร็จจริงจึงมีประโยชน์กว่าดูแค่ราคาต่อหนึ่งล้านโทเคน

การแข่งขันรอบนี้เลยไม่ได้มีแค่คำถามว่าโมเดลไหนฉลาดที่สุด แต่กลายเป็นคำถามว่าใครให้ความฉลาดที่พอใช้กับงานจริงได้ในราคาต่ำที่สุด ถ้าราคาอินพุตยังลดต่อ งานหลายประเภทที่เคยถูกมองว่าแพงเกินไปจะกลายเป็นฟีเจอร์พื้นฐานในซอฟต์แวร์ธรรมดา และฝั่งผู้ใช้จะได้อำนาจต่อรองมากขึ้นแบบเห็นชัด

ตอนนี้สิ่งที่ควรทำไม่ใช่ย้ายทุกงานไปหาโมเดลที่ถูกที่สุดทันที แต่แบ่งงานตามความเสี่ยง งานค้นหา สรุป จัดหมวด หรือประมวลผลจำนวนมากอาจเหมาะกับโมเดลราคาต่ำ ส่วนงานที่ตัวเลขต้องเป๊ะ ข้อความต้องครบ หรือความผิดพลาดมีต้นทุนสูง ควรมีชั้นตรวจสอบเพิ่ม แล้วสงครามราคาครั้งนี้จะกลายเป็นประโยชน์จริงแทนที่จะเป็นแค่ป้ายราคาที่ดูหวือหวา

⚠ แจ้งเนื้อหาไม่เหมาะสม 
phana3462's profile
มีผู้เข้าชมแล้ว 4 ครั้ง
เขียนโดย phana3462
เป็นกำลังใจให้เจ้าของกระทู้โดยการ VOTE และ SHARE
Hot Topic ที่น่าสนใจอื่นๆ
ทำไมเวลา “ล้างจาน” น้ำร้อนถึงช่วยให้จานแห้งเร็วกว่า ทั้งที่อุณหภูมิห้องเท่ากัน?จังหวัดที่มีคนญี่ปุ่นอาศัยอยู่มากที่สุดในประเทศไทย5 สำนัก เลขตรงกัน “5” ตัวเดียว งวด 16 ส.ค. 69เลขท้าย 2 ตัวที่ออกเพียงครั้งเดียวในรอบ 20 ปีเที่ยวบินพีเอสเอ 1771 โศกนาฏกรรมบนฟ้าที่เริ่มจากช่องโหว่ความปลอดภัยของระบบพนักงานสนามบินทำไมคนหนุ่มสาวนิวซีแลนด์ถึงย้ายออก ทั้งที่ประเทศยังน่าอยู่ระดับโลกเมดคาเฟ่ญี่ปุ่น ทำไม ความน่ารัก ถึงขายได้ และ งานบริการ แบบสวมบทบาท มี ต้นทุน ทางอารมณ์ ซ่อนอยู่ส่องเลข 'วิ่งตาม' เลขท้ายงวดก่อน ก่อน 16 ส.ค. 69 — หาความสัมพันธ์ผสมการคำนวณและสัญญาณ10 โรงเรียนที่ขึ้นชื่อว่าสอบเข้ายากที่สุด10 ต้นไม้สวยแต่มีพิษ หลายบ้านปลูกโดยไม่รู้เด็กไม่ยอมคาดเข็มขัด เครื่องบินพอร์เตอร์ต้องวนกลับเทอร์มินัล ก่อนเที่ยวบินถูกยกเลิกทำไมห้องว่างถึง “เสียงก้อง” กว่าห้องที่มีเฟอร์นิเจอร์? ทั้งที่ขนาดห้องเท่าเดิม
Hot Topic ที่มีผู้ตอบล่าสุด
ทำไมเวลา “ล้างจาน” น้ำร้อนถึงช่วยให้จานแห้งเร็วกว่า ทั้งที่อุณหภูมิห้องเท่ากัน?เมดคาเฟ่ญี่ปุ่น ทำไม ความน่ารัก ถึงขายได้ และ งานบริการ แบบสวมบทบาท มี ต้นทุน ทางอารมณ์ ซ่อนอยู่เที่ยวบินพีเอสเอ 1771 โศกนาฏกรรมบนฟ้าที่เริ่มจากช่องโหว่ความปลอดภัยของระบบพนักงานสนามบินปม กสทช. แตกหนัก ทำไมความขัดแย้งเรื่องประธานถึงลามเป็นข้อเสนอให้ล้างไพ่ทั้งบอร์ดบทบาทสาธารณะของ รี ซอลจู ภรรยา คิม จองอึน ที่ลดลงในเกาหลีเหนือช่วงหลายปีที่ผ่านมาทำไมคนไทยบางส่วนยังยอมซื้อของหรู ทั้งที่รายได้ตึงและหนี้ครัวเรือนยังสูง
กระทู้อื่นๆในบอร์ด มือถือ Gadget เทคโนโลยี
โนเกียจากมือถือในความทรงจำ สู่ธุรกิจเครือข่ายปัญญาประดิษฐ์ที่กำลังโตแรงในยุคดาต้าเซ็นเตอร์🎬 แจกฟรี! Prompt สร้างวิดีโอ AI สาย Parkour Action ซีนระดับฮอลลีวูด (8K HDR / IMAX Quality)ChatGPT รอบใหม่ Sol ฉลาดขึ้น ส่วน Luna เปิดทางใช้ฟรีคุยข้อความได้ยาวกว่าเดิมApple เปิดศึก OpenAI ฟ้องคดี ความลับการค้า หลังอดีตวิศวกรย้ายค่าย จุดชนวน สงครามฮาร์ดแวร์ AI ครั้งใหญ่
ตั้งกระทู้ใหม่