93:12:1000|谷歌I/O 2026:AI团队协作,世界模型,主动智能体

旺晓通:深入浅出,轻松通晓

当我看到谷歌I/O 2026发布会的那个演示时,我手里的咖啡差点洒在键盘上。

93个智能体,12小时,不到1000美元,从零写出了一个能跑《毁灭战士》的完整操作系统。

我们解读最新技术,文末有相关信息。

作者:张长旺,图源:旺知识

这不是科幻电影里的情节,而是刚刚发生在现实世界的事情。我反复看了三遍这段演示,不是为了确认技术细节,而是为了说服自己:这真的不是特效。

为什么93这个数字比任何参数都更震撼

过去几年,我们已经习惯了科技巨头们在发布会上比拼"谁的模型更大"。1万亿参数,10万亿参数,100万亿参数……数字越来越大,普通人却越来越无感。

但这次谷歌没有这么做。他们甚至没有发布大家期待已久的Gemini 4.0,而是推出了一个"更小更快更便宜"的Gemini 3.5 Flash。

这个模型有多离谱?它的推理速度是同级别产品的4倍,成本却不到一半。更让人惊讶的是,它在几乎所有基准测试上都超越了谷歌自己三个月前才发布的旗舰模型Gemini 3.1 Pro。

这就像一个学生,用了更少的时间,花了更少的钱,却考出了比学霸更好的成绩。

但真正让我感到震撼的,不是单个模型的性能提升,而是谷歌展示的"智能体集群"能力。93个智能体分工协作,有的负责写内核,有的负责写驱动,有的负责测试,有的负责整合。它们像一个真正的软件开发团队一样工作,而不是一个单打独斗的超级程序员。

这让我突然想到了人类文明的发展史。人类之所以能成为地球的主宰,不是因为我们个体有多强壮,而是因为我们学会了分工协作。一个人再厉害,也造不出一艘航空母舰;但几千上万人分工协作,就能创造出奇迹。

AI的发展似乎也在遵循同样的规律。过去我们追求"一个无所不能的超级AI",现在我们发现,"一群各有所长的AI团队"可能才是更高效的解决方案。

世界模型:AI终于从"看图说话"变成了"理解世界"

如果说Antigravity 2.0展示了AI的"社会能力",那么Gemini Omni则展示了AI的"物理直觉"。

这是谷歌定义的第一个"世界模型"。什么是世界模型?简单来说,就是AI不再只是处理像素和文字,而是真正理解了物理世界的运行规则。

在现场演示中,有人输入了这样一句话:"把这座玻璃建筑换成肥皂泡,然后让一辆卡车撞上去。"

几秒钟后,我们看到了一段完美符合物理规律的视频:肥皂泡建筑在卡车的撞击下破裂,水滴四溅,阳光在水滴上折射出彩虹。

这不是简单的视频生成。如果是以前的模型,它可能会生成一个看起来很美的画面,但卡车可能会穿过肥皂泡而不破裂,或者水滴会向上飞。但Gemini Omni知道,肥皂泡是脆弱的,卡车有质量,重力会让水滴下落。

这让我想起了皮亚杰的认知发展理论。儿童在2-7岁时处于"前运算阶段",他们只能通过表象来认识世界;而到了7-11岁的"具体运算阶段",他们开始理解物体的守恒性、因果关系和物理规律。

AI似乎正在经历同样的认知发展过程。过去的AI就像一个2岁的孩子,只能"看图说话";而现在的Gemini Omni,已经成长为一个能够理解物理世界的7岁孩子。

这一突破的意义远超视频特效制作。为什么?因为如果AI不理解一个玻璃杯掉在地上会碎,它就无法替你收拾房间;如果不理解重力,它无法控制机器人抓取物体;如果不理解因果关系,它无法做出合理的决策。

世界模型是AI从"数字世界"迈向"物理世界"的桥梁。

Spark:当AI学会了"主动做事",人机关系彻底改变了

发布会的最后一个重磅产品,是Gemini Spark。

这是一个运行在谷歌云端虚拟机上的个人智能体。它最特别的地方是什么?它是"主动的"。

过去的AI助手,无论是Siri还是小爱同学,都是"被动的"。你必须先唤醒它们,然后发出指令,它们才会执行任务。

但Gemini Spark不一样。当你合上电脑,当你手机锁屏,当你进入梦乡时,它依然在后台运行。它会替你翻阅邮件,筛选重要信息;它会追踪你的银行账单,提醒你异常扣费;它会协调你的日程,帮你安排会议;它甚至会帮你预订机票和酒店。

第二天早上,你醒来时,它会给你一份简洁明了的简报,告诉你昨天发生了什么重要的事情,今天有哪些任务需要完成。

这是人机交互范式的根本性颠覆。

过去,人是执行者,机器是工具。你必须告诉机器每一步该怎么做,它才会照做。

现在,人是指挥官,机器是执行者。你只需要告诉机器你想要什么结果,它会自己想办法完成。

我突然想到了《钢铁侠》里的贾维斯。我们曾经以为那是遥远的未来,但现在看来,它离我们只有一步之遥。

但这已经足够了。想象一下,你再也不用花几个小时处理邮件,再也不用为了订机票而对比十几个网站,再也不用为了安排一个聚会而在微信群里反复沟通。

这些琐碎的、重复性的、消耗我们精力的事情,终于可以交给AI去做了。

不是结束,而是开始

看完整个发布会,我最大的感受不是"AI太厉害了",而是"AI终于变得有用了"。

过去几年,AI给我们的感觉更像是一个"玩具"。它能写诗,能画画,能聊天,但很难真正帮我们解决实际问题。我们会惊叹于它的能力,但很少会依赖它。

但这次谷歌I/O 2026展示的技术,让AI第一次真正走进了我们的日常生活。它不再是一个只能在对话框里聊天的机器人,而是一个能够替我们做事的"数字助手"。

当然,这项技术还处于早期阶段。Gemini Omni生成的视频还有提升空间,Antigravity 2.0还只能处理相对简单的编程任务,Gemini Spark也只能完成一些基础的个人事务管理。

但方向已经很明确了。AI的未来不是"一个无所不能的超级大脑",而是"一群各有所长的智能体",它们分工协作,替我们处理那些琐碎的、重复性的工作,让我们有更多的时间去做那些真正重要的事情——思考、创造、陪伴家人、享受生活。

这让我想起了凯文·凯利在《必然》里写的一句话:"未来已经到来,只是尚未流行。"

参考资料:

• Google I/O '26 Keynote

作者声明:作品含AI生成内容
举报/反馈
分享到: 微博 QQ 空间
对本文内容有合作意向?
我们将在 1 个工作日内与您联系
留言咨询