谷歌的精灵世界模型现在能够通过街景模拟真实街道。
谷歌DeepMind正在将街景与Project Genie结合,开发沉浸式、可交互的世界模拟技术。该技术面向机器人训练、游戏开发及旅游探索等领域,使用户能够在模拟环境中自由交互,体验动态天气与罕见场景,为虚拟环境
深度分析
当Google把街景数据接入DeepMind的Project Genie时,他们想做的已经不是优化地图,而是直接批发平行宇宙。这个整合听起来像科幻电影桥段——用十亿张街景照片当原材料,搭配能模拟天气、季节和罕见场景的生成式模型,为机器人训练、游戏开发甚至虚拟旅行制造“高保真世界模拟器”。但剥开技术包装,核心逻辑简单得令人不安:把现实世界打包成可随意编辑的3D沙盒,然后卖给需要“虚拟练车场”的所有人。
这本质上是Google在用自己最大的数据霸权,建造一座数字孪生工厂。街景团队花了十几年拍摄的全球影像,过去只是谷歌地图的背景板,现在突然成了生成式AI的训练矿。Project Genie的野心在于它不只是渲染静态场景,而是让世界“活起来”——可以模拟一场暴雨如何冲刷东京街道,或者让雅典卫城在虚拟晨光中投影出游客永远拍不到的空镜。对于自动驾驶公司,这等于拥有无限“边缘场景生成器”;对游戏开发商,这意味着再也不会被“开放世界开发成本”卡脖子。
但这里的傲慢同样明显。DeepMind似乎假设世界可以被简化为可计算的几何模型加光影方程。他们忽略了最微妙的变量:那些街景里偶然闯入镜头的流浪狗、街角面包店刚出炉时玻璃窗上的雾气、雨天积水倒映的扭曲霓虹——这些“噪声”恰恰是真实感的灵魂,而现有生成模型在捕捉这类随机诗意时往往露怯。更值得怀疑的是商业化路径:当保险公司能生成任意车祸场景理赔,当情报机构能伪造“实地侦察影像”,这种无限制造现实的能力,其社会成本显然还没被纳入技术评估。
看看Project Genie演示中那些过于整洁的街道就知道,Google还在用“数据洁癖”理解世界。真正的进步或许恰恰在相反方向:接受模拟世界永远会有像素噪点和逻辑裂缝,就像《盗梦空间》里那些细微的“图腾”标记。如果DeepMind只想做精致的“超级PS”,那不过是重复了游戏引擎过去二十年的老路。他们必须回答一个问题:当世界可以被任意复制,什么东西才是不可复制的?
或许这才是危机所在。当科技巨头开始贩卖“世界模版”,我们离《黑客帝国》又近了一步——只不过这次我们心甘情愿把现实交给算法优化。而那些无法被数据化的晨雾与尘埃,最终会在模拟的太阳下慢慢蒸发。
免责声明:以上内容由 AI 生成,仅供参考。
相关文章
每天接收最值得关注的 AI 信号
加入 1000+ 创始人、投资人和技术从业者。每天早上直达邮箱:精选 AI 动态、深度分析、值得关注的二阶变量。
无垃圾邮件,随时退订。