千问开源Qwen3.8-Flash-Next架构,轻量化多模态大模型实现效能突破阿里千问发布多模态MoE模型Qwen3.8-Flash,并开源下一代架构Qwen3.8-Flash-Next(Qwen4雏形)。模型总参数125B,搭载51B N-gram Embedding,每token仅激活6B;原生支持26万token,可扩展至100万。训练成本为前代1/9,API定价输入每百万Tokens 1元、输出3元。4 天前17.4K
Artificial Analysis 联手 Liquid AI 发手机端 AI 跑分:iPhone 17 Pro 跑 8GB 内模型座次出炉Artificial Analysis联合Liquid AI发布手机端本地AI性能基准,聚焦iPhone 17 Pro真实表现。前者测智能水平,后者测推理性能,涵盖函数调用、指令遵循、知识认知、高难问答与数学五类。测试对象为4bit量化、体积不超8GB的端侧模型,旨在验证小模型也能实现高智能。5 天前16.4K