阅读,与值得关注的内容Readance

直播近1小时、550万人在线围观:以太大模型把具身智能大模型的"性能线"拉爆了


9月16日,上海街头,一场特殊的户外直播吸引了超过550万网友在线围观:搭载乐享科技跨本体通用模型以太大模型的机器人支起烤炉,为现场3桌、6名顾客完成从点单、烧烤到上菜的全部流程,连续工作1小时。全程没有遥控,没有剪辑,没有预设脚本。


在机器人新闻已经不算新鲜的今天,这场直播依然让见惯了大场面的科技爱好者感到意外。因为它几乎是"反着来"的。没有恒温恒湿的实验室,没有反复调试后的最佳机位,没有给机器人扫清障碍的工作人员,甚至连上桌的顾客,都是来"找茬"的。


一场专门"添乱"的直播

现场6名顾客接到的任务只有一个:把机器人当成人类服务员一样。可以临时更改需求、打乱物品位置、打断正在进行的任务,随时召唤机器人来服务。

更具戏剧性的一幕发生直播快结束时。发现原定的一位顾客临时未能到场,乐享科技没有停播,也没有调整流程,而是直接从围观人群中随机请了一位观众补位。这位观众上场前没有拿到任何流程和要求,点单、提需求、出题,全是即兴发挥。换句话说,连"出题人"都是临时的。0预设、0剧本,贯彻到底。结果,机器人全部接住了。


几个瞬间,值得反复回放

直播中最先引发弹幕刷屏的,是一次"意外打断"。一台服务机器人正在为顾客点单,对方突然说:"帮我拿瓶水。"机器人没有卡住,也没有继续机械地完成点单,而是暂停当前任务,把水送到顾客手边,甚至还为另一个顾客也拿了一瓶水,然后继续完成点单工作。

已关注
关注
重播 分享
观看更多
    网易科技

    0/0

    00:00/00:07
    进度条,百分之0
    00:00
    /
    00:07
    00:07
    全屏

    倍速播放中
    您的浏览器不支持 video 标签

    继续观看

    直播近1小时、550万人在线围观:以太大模型把具身智能大模型的"性能线"拉爆了

    转载
    ,
    直播近1小时、550万人在线围观:以太大模型把具身智能大模型的"性能线"拉爆了
    网易科技
    已同步到看一看写下你的评论


    被打断之后还记得自己刚才在做什么——对人类来说这是本能,对机器人来说,这曾是一道行业级难题。

    第二个高光属于双机交流任务进度,从头到尾没有一个触发条件是写死的,是两个机器人在读现场:感觉顾客等久了、可能饿了,服务机器人就主动去找烧烤机器人,追问餐准备得怎么样了;而心有灵犀的烧烤机器人,会指引服务机器人拿到可以先上桌的餐食。


    已关注
    关注
    重播 分享
    观看更多
      网易科技

      0/0

      00:00/00:20
      进度条,百分之0
      00:00
      /
      00:20
      00:20
      全屏

      倍速播放中
      您的浏览器不支持 video 标签

      继续观看

      直播近1小时、550万人在线围观:以太大模型把具身智能大模型的"性能线"拉爆了

      转载
      ,
      直播近1小时、550万人在线围观:以太大模型把具身智能大模型的"性能线"拉爆了
      网易科技
      已同步到看一看写下你的评论


      第三个瞬间属于协作。烧烤机器人守在炉前专职烤制,服务机器人穿梭在餐桌之间传菜上菜,交接、分工、配合全部自主完成。值得注意的是,烤串的和上菜的是两台本体结构不同的机器人,却运行着同一个"大脑"。谁烤、谁送、怎么交接,没有一步是提前写死的。

      已关注
      关注
      重播 分享
      观看更多
        网易科技

        0/0

        00:00/00:19
        进度条,百分之0
        00:00
        /
        00:19
        00:19
        全屏

        倍速播放中
        您的浏览器不支持 video 标签

        继续观看

        直播近1小时、550万人在线围观:以太大模型把具身智能大模型的"性能线"拉爆了

        转载
        ,
        直播近1小时、550万人在线围观:以太大模型把具身智能大模型的"性能线"拉爆了
        网易科技
        已同步到看一看写下你的评论


        还有一个容易被忽视的细节:服务机器人被设定了暴躁型、服从型不同性格。同样被打断,不同性格的机器人反应并不相同。它们不是在执行同一段程序,而是在用自己的"大脑"各自面对自己所理解的世界。

        而整个场地最大的挑战在于:它完全开放。桌椅怎么摆、人往哪里走、下一秒会发生什么,事先都无法预设。机器人迈出的每一步,都是现场看、现场判断、现场决定。


        这些瞬间背后,是什么在支撑

        支撑这场直播的,是乐享科技推出的以太大模型——极具颠覆性的跨本体通用具身大模型。


        它没有走行业内"海量真机数据加动作模仿"的主流路线,而是采用以神经元分配为核心的能量驱动架构,参照人类"大脑—脊髓"的贯通机制,把感知、记忆、推理、运动控制和物理反馈装进同一套系统。在这套架构里,上层负责理解意图、规划任务,底层负责力控与本能反射,中间的信息流双向贯通——思考的结果直接流向身体,身体的反馈实时回到大脑。

        一组数据可以说明这条路线的为何令行业内外震惊:整个模型仅用200小时人类视频数据完成训练,没有使用任何真机训练数据,参数规模为4B。在同行普遍比拼数据采集规模与参数量的背景下,不堆数据、不堆参数,是它与主流路线的根本区别。

        在此基础上,以太大模型形成了五项相互咬合的核心能力:主动感知、多模态理解、流式记忆、动力学建模、持续自我迭代。直播中的高光瞬间,几乎可以与这些能力一一对应——"送完水还记得回来点单",靠的是流式记忆对任务状态的完整保留;"调料瓶越用越顺手",靠的是现实反馈直接驱动的自我迭代;"开放场地里自己找路",靠的是不依赖预设地图的主动感知;"两台机器人自己分工",靠的是跨本体的通用能力。


        弹幕的变化,是另一组数据

        直播开场时,弹幕里最多的是质疑:"是不是演的?""旁边肯定有工程师遥控。"这种不信任并非没有来由——过去太多机器人视频被证明是精心设计的产物。

        但随着直播进行,风向肉眼可见地转变。当机器人一次次接住现场的刁难,当补位观众临时提出的需求被一一响应,弹幕里的问题变成了"什么时候我也能有一台"。从质疑到想要,这种转变,是任何精修视频都换不来的。

        现场超过30位行业媒体的见证,则为这场直播补上了另一层可信度:它不只经受了镜头的检验,也经受了在场专业人士的检验。


        一条被抬高的"性能线"

        过去两年,具身智能领域的成果展示大多以演示视频的形式出现:几十秒的精彩瞬间,可以剪辑、可以重拍、可以只挑最好的一次。观众看到的是一个模型"做到过",却无从知道它在镜头之外失败了多少次、遇到意外时会怎样。

        而这场直播把衡量的标尺直接抬到了另一档:真实世界、无人接管、连续作业超1小时、扛住所有临场干扰,把整件事做完。

        行业的比拼规则由此被改写:从"谁的演示更好看",变成了"谁敢在真实世界里持续干活"。当一条新标尺被立下,此后所有模型都将在这套标准下接受检验。

        对普通观众来说,这场直播的意义或许更简单。但对于具身行业来说,乐享带来了具身大模型发展的另一条路:和现实世界真实交互,并自主进化。乐享引领的具身智能大模型方向,会将行业带向何方,值得期待下。


        ——社群推荐——

        与前沿大脑同步在线,让思维时刻领先。

        欢迎扫描下方二维码,加入你的科技同行圈。

        ▲欢迎加入粉丝群▲


        —— EN——

        排版 | 张若蘅    审核 | 北辰











        前往微信阅读全文

        内容来自公众号,可前往微信查看原文。

        查看作者的更多文章 →