Alibaba เปิดตัว Qwen3.8-Flash-Next อ่านภาพได้ เหนือกว่า DeepSeek V4 Flash ในราคาถูกกว่า
Body
Alibaba Cloud เปิดตัวโมเดลปัญญาประดิษฐ์ใหม่ Qwen3.8-Flash-Next ที่มีขนาด 125B-A6B แต่ผลทดสอบเอาชนะโมเดลขนาดใหญ่กว่า เช่น DeepSeek V4 Flash แถมยังมีความสามารถอ่านภาพเช่นเดียวกับโมเดลตระกูล Qwen อื่นๆ
ในด้านสถาปัตยกรรม โมเดลนี้ใช้ Qwen Sparse Attention (QSA) ที่บีบโทเค็นออกเป็นบล็อกแล้วแสดงความสำคัญของแต่ละบล็อก ทำให้โมเดลสามารถเลือกใช้งานบล็อกก่อนหน้ามาประมวลผลได้ กระบวนการนี้ทำให้ประมวลผลพรอมพ์ได้เร็วขึ้น 7.6 เท่าตัว และการสร้างโทเค็น (decode) เร็วขึ้น 4.9 เท่าตัว นอกจากนี้ยังมี N-gram embedding ที่มองโทเค็นเป็นชุดๆ แทนที่จะเป็นทีละโทเค็น
ค่า API ของ Qwen3.8-Flash-Next อยู่ที่ 0.16/0.47 ดอลลาร์ต่อล้านโทเค็น นับว่าน่าสนใจมาก แต่ราคากลับพอๆ กับ GLM-5.3-Flash ที่เปิดตัวมาพร้อมกัน ทำให้ในแง่การใช้งานทั่วไปอาจจะน่าสนใจน้อยกว่า แต่เนื่องจาก Qwen3.8-Flash-Next มีขนาดเล็กกว่ามากทำให้น่าสนใจกว่าหากต้องการรันในบ้าน
ที่มา - Qwen
lew Thu, 27/08/2026 - 20:19
Continue reading...
Body
Alibaba Cloud เปิดตัวโมเดลปัญญาประดิษฐ์ใหม่ Qwen3.8-Flash-Next ที่มีขนาด 125B-A6B แต่ผลทดสอบเอาชนะโมเดลขนาดใหญ่กว่า เช่น DeepSeek V4 Flash แถมยังมีความสามารถอ่านภาพเช่นเดียวกับโมเดลตระกูล Qwen อื่นๆ
ในด้านสถาปัตยกรรม โมเดลนี้ใช้ Qwen Sparse Attention (QSA) ที่บีบโทเค็นออกเป็นบล็อกแล้วแสดงความสำคัญของแต่ละบล็อก ทำให้โมเดลสามารถเลือกใช้งานบล็อกก่อนหน้ามาประมวลผลได้ กระบวนการนี้ทำให้ประมวลผลพรอมพ์ได้เร็วขึ้น 7.6 เท่าตัว และการสร้างโทเค็น (decode) เร็วขึ้น 4.9 เท่าตัว นอกจากนี้ยังมี N-gram embedding ที่มองโทเค็นเป็นชุดๆ แทนที่จะเป็นทีละโทเค็น
ค่า API ของ Qwen3.8-Flash-Next อยู่ที่ 0.16/0.47 ดอลลาร์ต่อล้านโทเค็น นับว่าน่าสนใจมาก แต่ราคากลับพอๆ กับ GLM-5.3-Flash ที่เปิดตัวมาพร้อมกัน ทำให้ในแง่การใช้งานทั่วไปอาจจะน่าสนใจน้อยกว่า แต่เนื่องจาก Qwen3.8-Flash-Next มีขนาดเล็กกว่ามากทำให้น่าสนใจกว่าหากต้องการรันในบ้าน
ที่มา - Qwen
lew Thu, 27/08/2026 - 20:19
Continue reading...