🙋魔搭ModelScope本期社区进展:
📟4202个模型:DeepSeek-V4.1-Flash、NeoHorse-1-4B、MiniCPM5-2B-GGUF、Nex-N2.5、Intern-S2-397B、、Atria-Dawn-Preview、Meridian 等;🎨500个创新应用:MiniCPM5-2B、YuE2-3B、LingBot-World-Infinity、魔搭紫皮书 · ModelScope Cookbook等;
📄 25篇内容:
一图速览|魔搭社区@2026云栖大会
IFM 开源 K2 Horizon六款模型:覆盖 0.9B 至 375B,训练全链路开放
H3-World 开源:基于 MiniMax-H3 构建的交互式世界模型,让 MiniMax-H3 支持角色与相机控制
面壁智能开源 MiniCPM5-2B:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力
Nex-AGI 开源 Nex-N2.5:mini、Pro、Max 三档模型齐发,SWE-Bench Pro 超越 GPT-5.6
《AI4S实战派》第13期回顾|从结构到序列,AI 如何破解 RNA 的折叠密码?
Qwen Audio 团队开源两款语音增强模型:长语音分离提速 2.29 倍,AEC 延迟仅 22 ms
DeepSeek-V4.1-Flash 开源:552B MoE,非对称模型结构,大幅减少KV Cache 缓存大小
基元律动开源 NeoHorse-1:9B 均分 69.04,超底座 3.44 分
我们开源了一个三国游戏竞技场:让大模型打一场持续200回合的仗
NeuG v0.2.0:以事务为基础,面向规模化的结构、语义与关键词统一检索
最懂科学的开源基础大模型『书生-S2』发布:科学能力比肩顶尖闭源,通用性能居开源第一梯队
第十期 AIGC 月度榜单发布!月榜收官,下一站与社区共同定义!
Atria Dawn Preview 开源:7440 亿参数,多项基准比肩顶尖闭源模型
紫东太初开源 ZDTaichu5.0-9B:9B 通用多模态8 项空间基准登顶,对标前沿闭源模型 GPT‑6 Astra
《AI4S实战派》第14期回顾|一文读懂 AlphaFold 范式与后 AlphaFold 时代
Viggle AI 开源 Meridian:MiniMax-H3 + VGGT-Ω 几何引导,单图生成新视角的视频
新学期,你的AI 开源贡献可以开实践证明啦!
Ternary Bonsai 2 27B 开源:三元权重近无损压缩至1/9,27B 级能力保留 98.2%
01
模型推荐
DeepSeek-V4.1-Flash
552B MoE 仅激活 8B/16B,原生支持多模态视觉理解,同时将 KV Cache 的 HBM 占用降至上一代的 1/4,主打更低成本的高性能 Agent 与推理场景。
模型链接:
https://modelscope.cn/models/deepseek-ai/DeepSeek-V4.1-Flash
更多模型效果及部署实战教程,详见文章:
NeoHorse-1-4B
一个 40 亿参数的因果语言模型,也是迈向递归自改进(RSI) 路径上的初始原型。该模型基于 Qwen3.5-4B 进行后训练,适用于基于文本的代理框架、工具使用、代码生成和指令遵循任务。在十个基准测试上取得 64.87 的宏平均分,相比 Qwen3.5-4B 的 58.94 分提升了 +5.93。
模型链接:
https://modelscope.cn/models/TokenRhythm/NeoHorse-1-4B
更多模型介绍及部署,详见:
更多模型介绍及部署,详见
面壁智能开源 MiniCPM5-2B:AA 榜单全球 4B 以下第一,初具端侧通用 Agent 能力
Nex-AGI 推出的 Agent 模型家族,覆盖 mini、Pro、Max 三档,重点强化多模态电脑操作、网页浏览与视觉环境中的智能体能力,其中 Max 采用 1.6T 参数 MoE 底座,面向更复杂的长链路 Agent 任务。
模型合集:
https://modelscope.cn/collections/nex-agi/Nex-N25
更多模型介绍及部署推理,详见:
Nex-AGI 开源 Nex-N2.5:mini、Pro、Max 三档模型齐发,SWE-Bench Pro 超越 GPT-5.6
Intern-S2-397B
上海AI实验室开源的 397B MoE 科学多模态模型,直接从科研论文原始页面联合学习文字与视觉关系,重点强化科学推理、复杂科研任务和长程 Agent 能力。
模型链接:
https://modelscope.cn/models/Shanghai_AI_Laboratory/Intern-S2-397B
更多模型介绍及部署,详见文章:
最懂科学的开源基础大模型『书生-S2』发布:科学能力比肩顶尖闭源,通用性能居开源第一梯队
Atria-Dawn-Preview
基于 744B MoE GLM-5.2 训练的新一代科研 Agent,支持 256K 级上下文,重点强化深度研究、代码执行、实验验证和多步任务交付。
模型链接:
https://modelscope.cn/models/Shanghai_AI_Laboratory/Atria-Dawn-Preview
Meridian
Meridian:Viggle AI 开源的几何引导视频重构模型,可对已有视频重新选择视角、设计相机运动,甚至在暂停或变速时间轴上生成新的观察角度,实现“拍完之后再运镜”。
模型链接:
https://modelscope.cn/models/Viggle/Meridian
更多模型案例效果,详见文章:
Viggle AI 开源 Meridian:MiniMax-H3 + VGGT-Ω 几何引导,单图生成新视角的视频
02
数据集推荐
UltraData-SFT-Agent-2609
OpenBMB 面向 Agent 后训练开放的约 48 万条可执行轨迹数据,覆盖工具调用、搜索、多跳问答、代码执行、Office/文件处理等任务,并保留环境反馈、验证与错误恢复过程,可直接用于 Agent SFT。面向锂电池电解液“杂质/副产物清除剂”研究整理的论文 PDF 数据集,可用于电解液添加剂、酸/水捕获机制及高电压锂电池稳定性等方向的文献检索与科研模型训练。
数据集链接:
https://modelscope.cn/datasets/OpenBMB/UltraData-SFT-Agent-2609
LiBattery-Electrolyte-Scavenger-PDFs
数据集链接:
https://modelscope.cn/datasets/zhangyiK/LiBattery-Electrolyte-Scavenger-PDFs
UltraData-RL-2609
OpenBMB 面向可验证奖励强化学习开放的约 8.6 万条 RL 数据,覆盖数学、STEM、长上下文与代码任务,并提供 ground truth 或可执行测试用于稳定、可追踪的奖励验证。
数据集链接:
https://modelscope.cn/datasets/OpenBMB/UltraData-RL-2609
03
创空间
MiniCPM5-2B
OpenBMB 提供的 MiniCPM5-2B 在线体验空间,可直接测试这款 2.5B 端侧模型在长上下文、代码、数学、工具调用和 Agent 任务上的实际表现。
体验链接:
https://modelscope.cn/studios/OpenBMB/MiniCPM5-2B
面向完整歌曲生成的在线体验空间,可根据歌词和风格提示直接生成人声+伴奏,并先生成可编辑的旋律与和弦乐谱,支持继续修改后重新渲染歌曲。
体验链接: https://modelscope.cn/studios/icebergyang/YuE2-3B
LingBot-World-Infinity
可交互体验开源世界模型 LingBot-World,通过单张图像生成可实时操控的动态世界,支持键鼠控制、分钟级连续生成与长期场景一致性,面向具身智能、游戏和内容生成等场景。体验链接: https://modelscope.cn/studios/icebergyang/lingbot-world
魔搭紫皮书 · ModelScope Cookbook
面向开发者的开源模型实战指南,从模型选型、推理和微调一路覆盖评测、RAG、Agent 与 AIGC,用可运行案例帮助开发者把“模型能下载”推进到“应用能复现、能评测、能持续改进”。
体验链接:
https://modelscope.cn/studios/ms-cookbook-team/ms-cookbook
04
社区精选文章
👇点击关注ModelScope公众号获取 更多技术信息~