位置:首页 > 技术资讯 > 智在无界发布隐式触觉世界模型推动具身智能发展

智在无界发布隐式触觉世界模型推动具身智能发展

时间:2026-08-13  |  作者:怪兽小助手  |  阅读:0

7月28日,通用具身基础模型公司智在无界BeingBeyond,正式放出了全球首个隐式触觉世界动作模型Being-H0.8。

它首次把触觉模态引入了大规模模型预训练环节。此后,机器人不再只靠眼睛“看”世界,还能像人一样,靠触摸去感知物体。

这一步,实实在在拉近了具身智能与真实物理世界的距离。

智在无界发布隐式触觉世界模型 具身智能再进一步

Being-H0.8的核心突破

你平时在视频里看到的机器人,大多只能靠摄像头“看”世界。视觉信息,往往是它们判断环境的唯一依据。

当它们遇到软的海绵、硬的铁块、滑的玻璃杯这类不同质感的物体时,光靠眼睛看,很容易判断错力度。结果往往是要么抓空了,要么用力太大,直接把东西捏碎了。

Being-H0.8的核心突破,就在于它把触觉信息,和视觉、动作、未来状态变化,全部整合到了同一个隐空间里。

模型能同时“看见”也“摸到”物体,像人一样理解不同东西的软硬、轻重、滑涩。

数据基础:UniHand 3.0

要训练出能真正理解触觉的模型,数据是关键。智在无界为此搭建了全新的人类交互数据库UniHand 3.0。

这个数据库覆盖了多个维度:

  • 日常自然物体交互
  • 长时程连续任务
  • 丰富的手部精细动作
  • 各种各样的真实生活场景

总共有超过50万小时的第一人称交互视频数据。

为了把数据库做得足够全面,智在无界还与数十家行业数据合作伙伴建立了深度合作,把不同场景下的真实交互数据全部收集进来。

这样做的目的,就是让模型见过足够多的真实操作案例。

触觉能力带来的实际变化

以前的具身模型,大多只靠视觉数据训练。这就像一个人闭着一只手学做事情,很多靠触觉才能感知到的细节,它根本理解不了。

比如,拿一个装了半杯水的玻璃杯。光靠眼睛看,你根本不知道杯子滑不滑、里面水有多重。没拿稳直接掉地上,是很常见的情况。

而训练了触觉数据的Being-H0.8,能从视觉画面里预判出这个物体的大致质感,并自动调整抓取的力度。

  • 碰到滑的杯子,就加大一点握力
  • 碰到软的面包,就放轻力度,不会把面包捏变形

打通视觉、触觉、动作和状态变化

更关键的是,这款模型把视觉、触觉、动作和后续的状态变化全部打通了。

机器人做完一个动作之后,能立刻结合看到的画面和摸到的触感,预判出接下来物体会发生什么变化。

比如捏一块橡皮泥,它能预判出用多大的力气能把橡皮泥捏成什么形状。这样就不用反复试错,一次就能完成想要的操作。

这正是机器人在真实场景里操作效率大幅提升的关键所在。

具身智能走向真实场景的重要一步

眼下,具身智能行业正处在快速发展期。大家都想让机器人真正走进家庭、工厂,帮人干活。

但光靠视觉的机器人,很难搞定复杂的物理操作。

智在无界这款隐式触觉世界模型的发布,补上了之前具身模型缺少触觉感知的关键短板。

机器人终于能像人一样,用多感官去理解真实世界。未来,它们也就能胜任更多精细的日常操作任务,推动具身智能从实验室更快走向真实的落地场景。

免责声明:文中图文均来自网络,如有侵权请联系删除,心愿游戏发布此文仅为传递信息,不代表心愿游戏认同其观点或证实其描述。

相关文章

更多

精选合集

更多

大家都在玩

热门话题

大家都在看

更多