小米新一代人形机器人视频曝光:递花、碰拳、比心全自主,大模型驱动8月20日开放

· 科技资讯

小米官方今天放出一段视频:新一代人形机器人在 2026 世界机器人博览会的“具身花园”展台上与观众实时互动——递花、握手、碰拳、比心,动作连贯自然。官方口径是:这些看似简单的动作,背后由大模型驱动机器人自主理解、判断并完成动作

小米新一代人形机器人视频曝光:递花、碰拳、比心全自主,大模型驱动8月20日开放封面

从 8 月 20 日起,这个展台将向普通观众开放。也就是说,明天进场的人就能现场体验这台机器人的互动能力,从“演示片”到“公众实测”,中间只隔一夜。此前卢伟冰曾预告,小米机器人将在 2026 世界机器人大会上首次面向公众亮相——现在兑现了。

大模型驱动,和传统机器人的区别在哪

传统人形机器人的动作多来自预设脚本或遥控:工程师写好动作序列,机器人照做,遇到没见过的场景就“死机”。而“大模型驱动”意味着机器人需要自己完成一条链路:理解对方的意图(递花/碰拳是互动信号)→ 判断该做什么动作 → 规划动作轨迹 → 执行。这对视觉理解、意图识别、运动控制三者的协同要求很高,也是当前具身智能赛道的核心难点。

小米的视频刻意选了“互动”场景而非“走两步”展示,恰恰是在秀这套链路:观众的动作是随机的,机器人的反应必须是实时的、自主的。递花给谁、碰拳怎么接、比心比给谁,都要求机器人现场“读空气”,这在一年前还是很难想象的 demo。

为什么这场博览会值得关注

世界机器人博览会是人形机器人赛道一年一度的“期中考试”。今年参展的机器人有一个共同趋势:不再只比硬件自由度,而是比“大脑”——谁能接上更强的多模态大模型,谁的动作就更像人。小米此次把机器人从展柜搬到可互动的展台,本质上是在拿公众场景做大规模真机验证,收集真实交互数据——这对打磨 VLA(视觉-语言-动作)模型至关重要。

对小米来说,机器人的意义不止于炫技。小米生态有庞大的智能家居和汽车场景,人形机器人未来可能成为家庭服务的入口;而这一代产品与 CyberOne 一代相比,更强调“能用大模型理解人”,方向已经从“能走”转向“能交流”。从战略上看,小米在赌一个判断:下一代家庭智能终端,不只是音箱和手机,还可能是机器人。

谁该关注

– 具身智能从业者:关注其视觉-语言-动作(VLA)方案的落地表现

– 机器人爱好者和消费者:8 月 20 日起可现场体验,建议去“具身花园”展台实测

– 普通用户:人形机器人从“展示品”走向“可互动产品”的节点,值得记住

需要泼的冷水是:现场互动流畅不代表量产成熟,成本和可靠性仍是人形机器人大规模落地的大山,供应链、安全、续航都还没到消费级。但至少,这个赛道正在以肉眼可见的速度从 PPT 走进现实。

🔥 关注LC智趣厅,每天一条硬核科技观察。

👇 关注不错过。


— END —
LC 智趣厅 · 科技与生活的交点
ihygg.cn

Scroll to Top
微信公众号:LC智趣厅

扫码关注微信公众号
LC智趣厅