提到Google的AI,很多人首先想到的是Gemini。
但如果把视角拉高,你会发现Gemini只是Alphabet整个AI战略中的一部分。
从最新公布的产品版图来看,Alphabet已经构建起业内最完整的AI矩阵:
- 上层是覆盖文本、图像、视频、音频和代码生成的数字AI模型;
- 下层则是自动驾驶、无人机配送和机器人等现实世界应用。
在数字AI领域,Gemini是整个生态的核心。除了面向用户的大模型产品外,Google还拥有GenMedia内容生成体系,包括图像、视频、音乐和语音生成模型;拥有面向开发者的开源模型家族Gemma;以及面向未来的World Model和Embodied AI体系。
其中最值得关注的是Google正在重点投入的两大方向——Genie 3和Gemini Robotics。
Genie 3被称为世界模型(World Model),它不只是生成视频,而是能够实时生成一个可交互、可探索、可运行的虚拟世界。用户可以在其中驾驶、行走、操作物体,而环境会实时反馈。某种意义上,它正在构建数字版的现实世界。
而Gemini Robotics则让AI从“会说话”走向“会行动”。机器人不仅能够理解语言,还能够理解环境并完成具体任务。
相比其他AI公司,Alphabet最大的优势在于其拥有完整的现实世界入口。
自动驾驶公司Waymo每天积累海量真实道路数据;Wing运营无人机配送网络;Intrinsic则专注于工业机器人和智能制造。
这些业务不仅是独立产品,更是Google训练下一代AI的重要数据来源。
因此,Alphabet正在形成一个独特闭环:
数字世界数据 → 大模型训练 → 世界模型构建 → 自动驾驶、机器人等现实应用 → 更多真实世界数据反馈。
这也是为什么越来越多业内人士认为,Google未来最重要的产品未必是Gemini,而是连接Gemini、Genie、Waymo、Wing和机器人体系的Physical AI平台。
如果说过去二十年Google定义了信息时代,那么未来十年,Alphabet真正想参与定义的,或许是AI驱动的物理世界。
那么留给汽车行业或着机器人等物理AI行业创业公司的问题就是:数字AI的巨头是不是会很容易降维到你的行业?你有没有护城河抵挡?你能不能向上生长?









