首页
看点啥
插画图片
首页 看点啥 智在无界发布隐式触觉世界模型 具身智能再进一步

智在无界发布隐式触觉世界模型 具身智能再进一步

2026-07-30 0

本文围绕智在无界发布隐式触觉世界模型 具身智能再进一步整理关键信息和实用建议,帮助读者快速了解主题重点。

7月28日,通用具身基础模型公司智在无界BeingBeyond,正式推出全球首个隐式触觉世界动作模型Being-H0.8,首次把触觉模态引入大规模模型预训练环节,让机器人不再只靠眼睛“看”世界,还能像人一样靠触摸感知物体,大幅拉近了具身智能和真实物理世界的距离。

很多人平时在视频里看到的机器人,大多只能靠摄像头的视觉信息来判断环境,碰到软的海绵、硬的铁块、滑的玻璃杯这类不同质感的东西,光靠眼睛看很容易判断错力度,要么抓空了,要么用力太大把东西捏碎了。这款Being-H0.8模型的核心突破,就是把触觉信息和视觉、动作、未来状态变化全部整合到同一个隐空间里,让模型能同时“看见”也“摸到”物体,像人一样理解不同东西的软硬、轻重、滑涩。

为了训练出这款能真正理解触觉的大模型,智在无界搭建了全新的人类交互数据库UniHand

3.0,这个数据库覆盖了日常自然物体交互、长时程连续任务、丰富的手部精细动作,还有各种各样的真实生活场景,总共汇聚了超过50万小时的第一人称交互视频数据。为了把数据库做的足够全面,智在无界还和数十家行业数据合作伙伴建立了深度合作,把不同场景下的真实交互数据全部收集进来,让模型见过足够多的真实操作案例。

以前的具身模型大多只靠视觉数据训练,就像一个人闭着一只手学做事情,很多靠触觉才能感知到的细节它根本理解不了。比如拿一个装了半杯水的玻璃杯,光靠眼睛看不知道杯子滑不滑、里面水有多重,很容易没拿稳掉在地上。而训练了触觉数据的Being-H0.8,能从视觉画面里预判出这个物体的大致质感,自动调整抓取的力度,碰到滑的杯子就加大一点握力,碰到软的面包就放轻力度,不会把面包捏变形。

这款模型还能把视觉、触觉、动作和后续的状态变化全部打通,机器人做完一个动作之后,能立刻结合看到的画面和摸到的触感,预判出接下来物体会发生什么变化。比如捏一块橡皮泥,它能预判出用多大的力气能把橡皮泥捏成什么形状,不用反复试错,一次就能完成想要的操作,大大提升了机器人在真实场景里的操作效率。

现在具身智能行业正在快速发展,大家都想让机器人真正走进家庭、工厂帮人干活,但光靠视觉的机器人很难搞定复杂的物理操作。智在无界这款隐式触觉世界模型的发布,补上了之前具身模型缺少触觉感知的关键短板,让机器人能像人一样用多感官理解真实世界,未来能胜任更多精细的日常操作任务,推动具身智能从实验室更快走向真实的落地场景。

以上内容可作为基础参考,实际处理时再结合具体场景灵活调整。

喜欢(0)

上一篇

360发布纳米Work企业智能体平台 首批用户赠1亿Token

360发布纳米Work企业智能体平台 首批用户赠1亿Token

下一篇

ETAS荣获高工智能汽车研究院2026年度跨域融合技术创新奖

ETAS荣获高工智能汽车研究院2026年度跨域融合技术创新奖
猜你喜欢