Threads (@hkno.ai)
local-llmai-tools
Original source

Qwen3.8-Flash-Next — 125B MoE 僅 6B Active Parameters

Summary

  • Qwen3.8-Flash-Next 即將推出(MoE 架構)
  • 規格:125B total parameters,約 6B active parameters,FP8 版本
  • 基於 Qwen4 架構
  • 前代對標:Qwen3.5-122B-A10B(2026年2月推出)
  • 本次重點:MoE 架構下只啟用 ~6B params 能達到什麼水平
  • 意義:Local AI 與大品牌 AI 差距持續收窄
  • 作者計劃 deploy 到 DGX Spark 測試實際表現
  • 評論亮點:「Qwen 傳統 — 小模型接近大模型,大模型扁不贏小模型」