生图3D类

高德发布全球首个3D原生城市世界模型 ABot-Earth 0.7,消费级显卡10分钟生成公里级城市场景

2026年9月15日1 次阅读
高德发布全球首个3D原生城市世界模型 ABot-Earth 0.7,消费级显卡10分钟生成公里级城市场景
2026-09-14 · 生图3D类

9月10日,阿里集团旗下高德正式发布全球首个3D原生城市世界模型 ABot-Earth 0.7。这款模型的核心目标只有一个:让计算机真正理解真实世界的三维结构,而不是简单地把现实照片拼到屏幕上。

高德CEO郭宁将其定位为"AI理解真实世界的入口"。他坦言:"大模型理解语言,高德空间智能理解世界。世界不只存在于语言里,它更存在于二维的网络拓扑、三维的空间结构、真实世界的'流动'以及时间的变化中。"

从"拍照贴图"到"直接生成":一次范式转变

过去二十年,数字地球的构建方式几乎没有本质变化——卫星影像、航拍照片和点云数据被拍摄、拼接后呈现在屏幕中,本质上仍是把现实"拍下来再贴上去"。用户能看到什么、从哪里看,往往受既有素材和采集路径限制。

ABot-Earth 0.7 走的是另一条路:3D原生技术架构。用涵盖空间、时间等信息的时空数据训练模型,使其建立对三维空间的原生理解,从而端到端一次性生成3DGS(三维高斯泼溅)格式的城市场景。

最直观的对比是效率:输入一张卫星图像或一段文字描述,模型仅用10分钟即可在一块消费级GPU上生成公里级3D城市场景,效率比传统模式提升1000倍。并且,ABot-Earth 0.7能自主补全并生成完整、连续的三维空间,用户不再受限于既定路线,而是可以连续进入、自由探索。

从星球到街景:全尺寸连续生成

与聚焦小尺寸场景或游戏画面生成的3D模型不同,ABot-Earth 0.7能在单一模型中完成从星球到城市、再到街景地标的全尺寸AI连续生成

在城市级生成中,模型需要保持路网、街区和建筑群的整体关系;进入地标近景后,则要进一步还原单体建筑的几何轮廓、立面层次和材质纹理。ABot-Earth 0.7使用3D原生表征,使视角从城市全貌推进到地标细节时,空间结构与视觉信息仍保持一致,并达到照片级视觉效果

目前,ABot-Earth 0.7体验官网已上线,覆盖超过196个国家和地区

三层能力:空间表达 → 动态感知 → 时空推演

高德将ABot-Earth 0.7的能力框架归纳为三层递进:

  • 三维空间表达:从地球到城市、从道路到建筑、从室外到室内,还原真实世界的细节与层次,形成亲临的在场感
  • 动态感知:从车流到人流、从路况到商户、从白天到黑夜,捕捉世界每一刻的变化与脉动
  • 时空推演:从出发到到达、从单点到全局、从现在到未来,看透真实的上下文关联,给出环环相扣的最优解

这三层能力由空间表达向动态感知、再向时空推演层层递进,共同构成高德的空间智能。在这一框架下,ABot-Earth 0.7将卫星图像、文字描述等信息表达为可进入、可交互的三维世界,为预测、模拟与真实场景中的决策提供支持。

已落地应用:飞行街景2.0

ABot-Earth 0.7的能力并非停留在实验室。目前,相关能力已应用于飞行街景2.0——用户可通过飞行街景2.0进入复杂建筑、大型景区,操控摇杆漫游3D场景,获得实时的交互反馈。

这意味着,普通用户在手机上就能看到自己所在城市的3D化版本,而不是只能看一张静态的卫星地图或二维街景照片。

生态布局:从手机到具身机器人

高德空间智能正在通过多种物理终端进入真实生活:手机、车机、具身机器人、智能眼镜、智能手表。生态伙伴已在多个终端方向展开合作。

其中,高德扫街榜宣布梅赛德斯-奔驰成为全球首个汽车合作伙伴,成为这一生态在出行场景中的最新落点。

高德方面表示,未来空间智能的能力将持续向全行业开放,与开发者及生态伙伴共同推动空间智能在真实世界落地。

对于普通用户而言,这意味着未来出行导航可能不再是一张平面地图——而是一个你可以"走进"、可以预览目的地、可以感受城市氛围的三维世界。

本文基于多家媒体转述整理。

来源:中国日报(2026-09-14)证券时报(2026-09-13)观点网(2026-09-11)

评论

0 条已公开
登录注册后可以参与评论。

正在加载评论...