点击右上角
微信好友
朋友圈

请使用浏览器分享功能进行分享

人工智能的下一程,正在超越屏幕,进入现实世界。
大语言模型不断刷新文本生成纪录,但一个长期被遮蔽的问题也浮出水面:会写诗、会作画、会对话,并不等于理解真实世界。
人工智能学者李飞飞提出,以大语言模型为代表的AI可以生成文字、图像和视频,但对现实空间、物理规律与因果关系的理解仍显不足。它可以描述一条路,但未必知道这条路通向哪里,更不知道路上的变化将带来什么。
空间智能,正试图补上这一课。它要求机器在三维空间和时间中感知、推理并采取行动。人工智能由此不再只处理符号,还要面对道路、建筑、设备以及它们随时间发生的变化。
作为连接数字信息与物理环境的一种能力,空间智能正受到国际学术界和产业界关注,也被视为新一代人工智能的重要方向。
对中国而言,这不仅意味着人工智能应用边界的扩大,也关系到新质生产力和未来产业的培育。中国拥有自主建设、独立运行的北斗卫星导航系统,也拥有超大规模、足够复杂的应用场景。前者提供时空基准,后者提供持续检验。两者形成的合力将决定中国空间智能发展的前景。
全球竞速,中国入场
人工智能要进入现实世界,仅仅识别物体远远不够。它还要知道物体在哪里,彼此是什么关系,环境发生了什么变化,以及一次行动可能造成怎样的结果。从生成信息到理解空间,从语言交互到现实行动,方向已经显现,实践路径仍在探索中。
世界模型是支撑空间智能的一条重要技术路径。它通过学习环境的空间结构、变化规律,以及行动与结果之间的关系,在数字空间中重建或模拟现实世界,为环境理解、状态预测和行动规划提供训练与推演的基础。
国际学术界和产业界已从三维场景生成、交互环境模拟、机器人行动等方向展开探索。李飞飞创立的World Labs将空间智能称为“人工智能的下一个前沿”,其Atlas模型可以处理文本、图像、视频和三维数据,生成新视角、深度图、点云与三维场景。谷歌DeepMind推出的Genie 2可以生成交互式三维环境,Gemini Robotics则尝试解决机器人在物理空间中的推理与操作问题。Meta发布的V-JEPA 2使用超过100万小时视频进行自监督训练,并进一步探索对物理世界的预测和动作规划。
中国企业也已入场。2026年9月10日,高德发布ABot-Earth 0.7,并称其为全球首个3D原生城市世界模型。
该模型使用包含空间、时间信息的时空数据训练,可以把卫星图像或文字描述转化为可进入、可交互的三维场景,并在一个模型中完成从星球、城市到街景地标的多尺度生成。
据了解,该模型可在一块消费级GPU上,用约10分钟生成公里级三维城市场景,结果采用3DGS(三维高斯泼溅)格式,相关能力已用于飞行街景2.0等民用产品。

这些不同的探索都在回答同一个问题:人工智能能否从生成内容,继续走向理解环境、预测变化和支持行动。
空间理解因而不再是某项孤立的技术命题,而将成为智能汽车、机器人、低空飞行和工业制造等领域共同需要的基础能力。
没有时空基准,就没有空间智能
空间智能要理解现实世界,首先需要一把统一的时空标尺。
道路、建筑、车辆和设备来自不同数据源。只有被放在同一坐标和时间基准下,模型才能判断距离、先后、速度与运动关系,进而把感知转化为行动。
没有自主的时空基准,空间智能就如同一座建在他人地基上的房子:可以向上搭建,但稳定性与主动权并不掌握在自己手中。
北斗为中国提供了自主可靠的时空基准。2020年6月23日,北斗三号全球卫星导航系统星座部署全面完成,可提供定位、导航、授时和短报文通信等服务。中国由此成为世界上第三个独立拥有全球卫星导航系统的国家。
中国卫星导航系统管理办公室2026年3月公布的数据显示,北斗系统在轨运行卫星达到50颗,全球定位精度优于10米,测速精度优于每秒0.2米,授时误差小于20纳秒。自主运行、连续服务和全球覆盖,使相关技术与应用可以建立在稳定、可持续的时空基准之上。
这种基础能力正通过产业终端和应用网络进入现实世界。《2026中国北斗时空产业发展白皮书》显示,截至2025年底,具有北斗功能的各类终端产品社会总保有量超过22亿台(套),在国内重点行业的综合应用渗透率约为90%。
今年全国两会期间,国家发展改革委主任郑栅洁明确表示,“十五五”时期,中国将继续实施北斗规模应用工程,推动产业规模五年内突破1万亿元。
从汽车、手机到无人机和行业设备,北斗所提供的统一时空基准,正在连接越来越多的物理终端和应用场景。规模化使用又进一步放大了这一基础设施的价值。
据高德公布的信息,其调用北斗卫星日定位量近万亿次,支撑日导航总里程90亿公里。
由卫星导航系统确立基准,产业终端接入并传递时空信息,应用平台连接具体场景,北斗由此形成了从国家基础设施到现实应用的完整链条,为中国空间智能研发和规模化落地提供支撑。

场景是最好的裁判
当北斗能回答“在哪里、什么时间”,空间智能还要回答“正在发生什么、接下来怎么办”。
与主要依靠离线数据训练的语言模型不同,空间智能必须在不断变化的环境中运行。现实场景既是模型接受检验的地方,也是技术产生实际价值的地方。
中国高密度的城市空间、复杂的交通网络和多样的产业形态,为相关技术提供了丰富的实践条件。
道路通行、客流分布和设备状态持续变化之下,真实需求提出问题,运行数据检验判断,产品反馈推动迭代。三维空间表达、动态感知和时空推演等能力,就在这样的往复中逐步完善。
高德提供了一个观察样本。其空间智能系统用二维路网描述道路、节点和可达关系,用三维信息呈现建筑、楼层以及室内外空间,再结合不同时段的人流、车流、搜索、导航和到访等信息,推演现实状态的变化。
在道路交通场景中,中国安全生产科学研究院与高德共同推出“鹰眼守护”预警系统。该系统把车辆速度、位置变化和路网关系放入同一时空框架,可识别前车急刹、弯道会车等多类潜在风险,并向可能受到影响的车辆发出秒级提醒。目前,该系统日均预警次数近2亿次。
在城市立体空间中,深圳龙岗“空中高德”项目已构建覆盖全区388平方公里、600米以下空域的三维时空底座,汇聚地理、通信、导航、监视和气象等信息,支持航线规划、碰撞预警与空域事件管理。
在生活服务领域,高德扫街榜依据真实导航到店行为,将专程前往、重复到访和本地人选择等信号转化为生活决策参考。上线一年,榜单累计服务用户超过8.8亿,导航到上榜商家的总里程达到366亿公里。
相关应用也随中国企业进入海外市场。高德世界地图服务已覆盖200多个国家和地区,支持78种语言;海外中文打车服务覆盖47个国家、1000多座城市。不同国家和地区的道路结构、地理信息与语言环境,使这些能力在跨地域服务中继续接受检验。
从道路交通、低空治理到生活服务和海外市场,中国空间智能正在形成一条可辨认的路径:场景提出问题,技术作出判断,应用检验效果,反馈再推动迭代。
相关技术路线、评价标准和应用边界仍在演进。以北斗系统为基础,中国正通过基础设施、产业协同和应用实践推动空间智能进入现实场景,也为全球人工智能拓展现实应用提供参考。
作为建设成熟、功能完备、性能优越的全球卫星导航系统,目前,服务全球140多个国家和地区的北斗系统及相关技术,凭借“厘米级定位”“毫秒级感知”“纳秒级授时”的卓越性能,将服务场景从大地拓展到太空。
技术发展史一再提醒人们:实验室里的突破当然重要,但一项技术最终能走多远,要看它能否在现实世界中找到用武之地。
空间智能的竞争,表面上是算法和模型的竞争,实质上也是基础设施、应用场景与产业生态的竞争。北斗在天,提供自主时空基准;场景在地,检验并锤炼技术;产业协同,则要打通研发与落地之间的链条。
这条路没有捷径可走,但方向已经清晰。
来源:《瞭望东方周刊》
记者:张静
