作者丨徐晓飞
编辑丨刘 伟
01
两月一次的迭代,是方向也是门槛
02
全行业都在补弹药,智谱这笔怎么花?
在基座上,提升有效规模,推进超长上下文与原生多模态的端到端统一建模; 在推理深度上,在不显著抬高推理成本的前提下,拉高有效计算深度,强化模型长链条推理与自我纠错能力; 在训练演进方面,继续加码预训练、中训练与后训练,将长程强化学习(RL)的探索空间做大; 在真实场景上,搭建更贴近现实复杂工程环境的任务沙盒。
03
为什么下一站是“完全自训练”?
04
结语
未经「AI科技评论」授权,严禁以任何方式在网页、论坛、社区进行转载!
公众号转载请先在「AI科技评论」后台留言取得授权,转载时需标注来源并插入本公众号名片。
未经「AI科技评论」授权,严禁以任何方式在网页、论坛、社区进行转载!
公众号转载请先在「AI科技评论」后台留言取得授权,转载时需标注来源并插入本公众号名片。