——VTLA 模型重构机器人物理智能,开启具身智能新时代
维也纳,2026 年 6 月 9 日 —— 在全球机器人领域旗舰会议 ICRA 2026 上,千觉机器人(Xense Robotics)重磅发布自研VTLA(Vision-Tactile-Language-Action)模型,首次将触觉从传统控制系统的反馈信号,提升至与视觉并列的核心认知模态,为机器人装上 “能感知物理世界的皮肤”,推动具身智能从 “看见世界” 迈向 “理解物理世界” 的关键跨越。
打破纯视觉瓶颈,触觉成物理智能核心入口
当前主流机器人 VLA 模型高度依赖视觉与语言驱动,仅能实现 “看” 与 “做” 的被动执行,在非结构化场景中面对弱柔性物料、微小形变、动态滑移等问题时,因缺乏实时物理反馈而陷入 “盲操作”,难以落地真实复杂场景。
千觉机器人联合创始人、CTO 赵浩南在主题分享中明确指出:“机器人要真正融入真实世界,必须建立触觉驱动的物理智能体系。视觉负责感知环境轮廓,触觉负责理解接触本质 —— 力的大小、材质软硬、形变程度、滑移趋势,这些都是视觉无法触及的物理认知维度。”
VTLA 模型 + 全栈技术,构建触觉认知新范式
此次 ICRA 2026,千觉机器人以 “触觉点亮物理智能” 为核心,全方位展示从硬件感知、数据采集、触觉仿真到 VTLA 模型的全栈触觉智能技术体系,核心成果引发全球业界高度关注。
- VTLA 模型:视触觉双模态认知融合VTLA 模型创新融合视觉、触觉、语言、动作四大维度,视觉实时捕捉环境与物体状态,触觉同步反馈接触过程与物理交互信息,通过端到端架构实现双模态数据深度融合,让机器人具备 “看懂环境、摸透物理” 的自主决策能力。现场演示中,搭载 VTLA 模型的双臂机器人无预设轨迹,自主完成轻薄纸板抓取、舒展、折边、定型的全流程纸盒成型操作,精准应对柔性物料动态形变,彻底摆脱传统机器人对固定编程的依赖。
- XENSE-G1 传感器:微米级触觉感知硬件自研 XENSE-G1 多模态触觉传感器,同步实现力觉、动觉、滑觉、三维形貌感知,达到 mN 级合力精度与 μm 级空间分辨率,感知密度达人类手指 800 倍,可精准捕捉微观接触信号,为 VTLA 模型提供高保真触觉数据支撑。
- TacCap-Gripper:补齐触觉数据闭环短板全球首次亮相的 TacCap-Gripper 触觉数采设备,集成高精度视触觉传感器与惯性测量单元,同步采集机器人动作、视觉、触觉多维数据,解决机器人物理交互数据稀缺痛点,为 VTLA 模型训练提供海量真实交互数据。
从技术突破到场景落地,引领具身智能新趋势
作为全球最早提出触觉空间智能理论的硬科技企业,千觉机器人成立以来快速完成技术与资本双重积累,成立一年内斩获亿元 PreA 轮融资,获理想汽车、高瓴创投等知名机构加持。目前,其触觉技术已广泛应用于工业精密装配、柔性抓取、人机交互等场景,服务智元、谷歌等头部企业,验证了触觉智能的商业化价值。
业内专家评价,千觉机器人将触觉提升至认知模态的创新,相当于为机器人补上 “感知物理世界的另一半大脑”。随着 VTLA 模型与触觉硬件的持续迭代,触觉将与视觉、语言协同,成为具身智能的核心感知支柱,推动机器人在家庭服务、工业制造、特种作业等领域规模化落地,真正实现 “像人一样感知世界、交互世界”。
未来,千觉机器人将持续深耕触觉智能领域,完善 “触觉底座” 技术生态,推动触觉成为通用人工智能的标准感知能力,让硅基生命真正拥有 “感知与理解物理世界” 的能力,开启具身智能的全新纪元。
关于千觉机器人
千觉机器人(Xense Robotics)成立于 2024 年 5 月,总部位于上海,是一家以多模态触觉感知技术为核心,专注智能体灵巧操作的高科技企业。公司致力于通过创新触觉技术,赋予智能体触觉感知能力,推动具身智能从精细操作到通用感知的跨越,让机器人真正理解真实世界。