Qwen Audio 团队开源两款语音增强模型:长语音分离提速 2.29 倍,AEC 延迟仅 22 ms
Qwen Audio 团队开源 FLASepformer 与 JAEC 两款语音增强模型,分别实现高效长序列双说话人分离与低延迟实时声学回声消除。
共 37 篇文章
从新到旧
Qwen Audio 团队开源 FLASepformer 与 JAEC 两款语音增强模型,分别实现高效长序列双说话人分离与低延迟实时声学回声消除。
《AI4S实战派》第13期回顾:斯奇老师详解RNA逆折叠技术演进,从RDesign到SOLD,展示如何结合物理约束与AI代理高效设计RNA序列,并预告下期AlphaFold主题直播。
Nex-AGI 开源 Nex-N2.5 智能体模型家族(Mini/Pro/Max),涵盖万亿参数 MoE 架构,在 SWE-Bench Pro 等基准中表现卓越,支持芯片设计、CAD 建模、长程游戏操作等复杂真实环境任务。
模型上新2430个、数据集上新462个、创新应用上新204个、应用文章发布10篇
MiniMax H3 全流程实战复盘|深度拆解《齐马蓝》AI短片制作手记:从剧本改编边界划定、分镜母图设计,到“全能参考”素材控制与音画同步技巧,九大步骤系统梳理 AIGC 视频创作核心逻辑,助你避开形变穿帮陷阱,打造叙事完整的高质量 AI 影像作品。
VDN-H3 通过混合注意力与插件式加速,在 8 张 B200 上仅用 11.23 秒生成 14.4 秒 768p 视频,让视频生成速度首次快过播放时长。
告别纸上谈兵,9月12日杭州云谷FDE实战营带你用AI思维拆解真实企业需求,半天产出可汇报方案与轻量Demo。
Qwen团队开源全球首个统一3D感知、驾驶问答与运动规划的自动驾驶VLM模型Qwen-Drive-1.0-4B,在保留通用视觉理解能力的同时,于nuScenes及NAVSIM等权威评测中取得领先性能。
英特尔联合魔搭社区,共同邀请您注册参会!
AI 圈不缺线上信息,缺的是线下的真实碰撞。首场「AI 硬件」线下碰头来了!
Spark-X2.5正式开源4B和1.7B参数规模的智能体模型,采用混合注意力架构原生支持1M上下文窗口,在代码、数学推理和智能体任务上达到同尺寸SOTA水平,并提供多平台部署方案。
人与Agent所需信息常散落在本地文件中。zg(zvec-grep)是本地优先检索基础设施,基于Zvec向量检索与BM25,结合ripgrep,从代码文档中高效提取信息,减少搜索轮次与上下文消耗,助力快速定位内容。zg现已开源,欢迎体验、反馈与贡献!
南京大学符天凡副教授深度解析蛋白质大模型如何从序列中学习进化规律,通过Transformer架构实现Embedding表征与Zero-shot突变效应预测,并演示Mini Transformer实操,探讨AI在生命科学中"辅助假设生成、缩小实验搜索空间"的核心价值。
魔搭社区发起Qwen3.8-27B实践经验征集活动,邀请开发者分享部署、测试及应用案例,瓜分10,000元现金奖励,投稿截止9月15日。
邀请一批对空间智能有兴趣的同学,用两天时间从零搭建一个真正能跑、能演示的空间智能应用原型。
腾讯混元开源旗舰 MoE 模型 Hy4 preview:770B 总参数、49B 激活、1M 上下文,在软件工程、办公分析、游戏开发及科学研究等真实生产力任务中表现卓越。
模型上新4037个、数据集上新732个、创新应用上新165个、应用文章发布7篇