DeepSeek 首个开源多模态模型来了:这双“眼睛”不给人类看图,专供 Agent 干活DeepSeek在Hugging Face上线V4家族首款实验多模态模型DeepSeek-V4-Flash-Vision-Exp,采用MIT协议,参数305B。基于V4-Flash-0731底座,接入视觉编码器与Aligner,经持续训练获得图像理解能力。与传统视觉问答不同,它重点聚焦多模态Agent能力,不做简单“看图说话”。5 小时前11.0K
中国化工行业首个大模型3.0 Pro重磅发布,从“会答”迈向“会干”8月31日,中科院大连化物所联合科大讯飞、阿里云等发布我国化工行业首个大模型迭代版——智能化工大模型3.0 Pro。该版本实现从专业知识问答向化工任务智能执行系统的跨越,成为技术底座级创新成果,推动化工智能化转型。7 小时前10.5K
中国科学院大连化物所携手科大讯飞、阿里云发布3.0 Pro近日,中科院大连化物所联合科大讯飞、阿里云发布智能化工大模型3.0 Pro。作为我国化工行业首个大模型的最新迭代版,其发布标志着行业大模型正告别单一知识问答,向更深层次工业落地迈进;技术上从过去聚焦信息检索与内容生成,跨越到全新阶段。11 小时前10.4K
Artificial Analysis 联手 Liquid AI 发手机端 AI 跑分:iPhone 17 Pro 跑 8GB 内模型座次出炉Artificial Analysis联合Liquid AI发布手机端本地AI性能基准,聚焦iPhone 17 Pro真实表现。前者测智能水平,后者测推理性能,涵盖函数调用、指令遵循、知识认知、高难问答与数学五类。测试对象为4bit量化、体积不超8GB的端侧模型,旨在验证小模型也能实现高智能。6 天前15.5K