千問開源Qwen3.8-Flash-Next架構,輕量化多模態大模型實現效能突破阿里千問發佈多模態MoE模型Qwen3.8-Flash,並開源下一代架構Qwen3.8-Flash-Next(Qwen4雛形)。模型總參數125B,搭載51B N-gram Embedding,每token僅激活6B;原生支持26萬token,可擴展至100萬。訓練成本爲前代1/9,API定價輸入每百萬Tokens 1元、輸出3元。4 天前17.4K
LFM2.5 DSpark草稿模型發佈,推理速度最高飆升3. 18 倍Liquid AI 與 Hugging Face 發佈 LFM2.5 系列 DSpark 草稿模型檢查點,覆蓋 1.2B、2.6B、8B-A1B 三款模型。其採用全新投機解碼路徑,不改變輸出質量,大幅提升推理吞吐量。實測 GPU 端最高提速 3.18 倍,端側設備也有明顯加速。08-2124.6K