产品 · 2026-09-01

「明觉 · 自观 API」上线

以我观物——第一人称(egocentric)视角的视频理解接口,开放注册。

第一人称的视频最难被读懂:镜头即人眼,剧烈抖动、手部遮断、目标一闪即过。第三方视角的模型在这里集体失灵。自观 API 是为这种画面专门训练的模型与接口。

它能做什么

  • 在做什么(what-is-happening)——从第一人称画面推断当前任务与意图。
  • 手边有什么——可操作物体的实时定位、可用性与拿取轨迹建议。
  • 谁在场——在场人员、身份关系与协作意图的连续跟踪。

何处可用

可穿戴头(工牌)、车载、机器人头皆场景。接口即 /v1/egocentric,WebSocket 流式,支持 4 路同步与 IMU 对齐。示例见开发者文档。

「好恶,恶恶;好憎,憎憎。」—— 《管子 · 牧民》。至微之知,莫亲于第一人称之历。

本月内开放注册试用;签约企业可获更高配额。→ 先试用演示。

← 返回研究简报