编译/VR陀螺
NVIDIA近日宣布NVIDIA XR AI正式启动公开测试,推出专属开发库,帮助开发者为AR眼镜、XR设备打造具备空间感知能力的多模态AI代理。
该平台打通了XR设备输入、AI模型、企业数据与加速计算能力,支持AI代理在工作流中完成“感知、推理、行动”全流程,同时简化了多模态感知、企业数据检索、模型推理与代理编排的集成环节,降低企业级XR应用的开发门槛。
平台核心能力覆盖四大模块:一是现实数据采集,可接入XR设备的视频、音频、深度、姿态及各类传感器数据;二是专业工具矩阵,整合Metropolis视觉AI、NeMo Retriever企业检索增强等能力;三是多模型兼容,支持Nemotron推理模型、Cosmos Reason等多款基础模型;四是全链路开发支撑,提供代理编排与运行时服务,助力开发者从原型快速落地到生产环境,支持跨云、数据中心、边缘端多场景部署。

VITURE已将NVIDIA XR AI集成到可穿戴界面中
目前已有多行业客户与机构基于该平台探索落地。工业场景中,西门子正结合NVIDIA DGX Spark测试工厂运维方案,一线工程师佩戴轻量化眼镜即可向AI代理获取故障排查、作业验证的实时指导,打通工业系统、数字孪生与自动化流程。
科研领域,AutoBio旗下Rana将LabOS实验系统接入平台,适配Meta、Rokid、VITURE等多款AI眼镜,为干细胞治疗、基因编辑等复杂实验提供自动化流程指引与标准化记录;VITURE也已将相关能力集成到自身可穿戴界面,实现免提式信息获取与任务辅助。
医疗场景里,匹兹堡大学医学中心超现实实验室打造了手术辅助方案,系统可智能调控信息呈现方式,避免遮挡术者视野,在保障手术专注力的同时推送必要的诊疗参考信息。
此外在设计与内容领域,Innoactive依托DGX Spark搭建沉浸式设计评审、产品展示与数字孪生工作流;Atlantic Studios则基于该技术完成泰坦尼克号沉浸式扫描内容,用户可通过语音指令探索沉船场景、获取背景信息。
目前NVIDIA XR AI公开测试已向全球开发者开放。
来源:auganix










