2026-05-20#
Data: 2026-05-20 21:33:07
谷歌IO 2026炸场!AI产品集体爆发,多模态+Agent能力双线冲刺#
兄弟们,沉寂已久的谷歌终于来炸街了!就在刚刚结束的谷歌IO大会上,发布了一众让人眼花缭乱的AI产品,但真正的核心重点就两个——独一档的多模态能力和强势追赶的Agent能力。
1. 多模态王者:Gemini Omni(杰米尼欧米尼)#
最狠的大招,当属谷歌全新发布的世界模型 Gemini Omni(杰米尼欧米尼)!你可以将任何形态的文件作为输入,比如文字、视频、图片、音频,一次性发给它,Omni能按照你的要求,以任意形式输出结果。从此,视频剪辑、内容创作就像P图一样简单高效。
2. 代码&Agent利器:Gemini 3.5 Flash#
如果说Omni是“无敌感官”,那同步发布的 Gemini 3.5 Flash 就是专为代码和Agent能力优化的“效率猛兽”。它的输出速度达到同类前沿模型的4倍,每秒狂飙1500个token。
谷歌在现场通过全新AI开发平台 Anti-Gravity 2.0(反重力2.0) 展示了它的逆天实力:Gemini 3.5 Flash仅用12小时,就从零手写完成了一个完整的操作系统!更惊人的是,开发过程中后台自动派生出93个AI子代理,总计算成本还低于1000美元。要知道,同类任务交给人类团队,至少需要数月时间。更硬核的是,这个AI手写的操作系统,居然能直接加载《毁灭战士》,现场就流畅运行起来了!
3. 全自动管家:Gemini Spark#
随后,谷歌顺势推出 Gemini Spark!你可以把它理解为:谷歌为你远程部署了一台7×24小时在线、搭载Gemini全套能力的专属服务器。它能跨越各类应用,直接打通第三方软件,你只需给出一个目标,它会自动拆解步骤、全自动完成任务——比如自动检查信用卡账单里的隐藏订阅费,把会议记录整理成规范文档并群发,全程无需手动操作。
4. 压轴黑科技:谷歌智能眼镜#
最后,压轴亮相的 谷歌智能眼镜 直接拉满期待!戴上它,Gemini就变成了你现实世界里的专属管家:路过咖啡店,眼镜自动识别店铺,你只需动动嘴,AI就帮你完成点单;出门时能提供实时AR导航,遇到外语交流场景,还能实现同声传译,彻底打破沟通和场景壁垒。
5. 谷歌的AI布局:从模型到产品落地#
这次IO大会不难看出,谷歌正在疯狂将AI模型的能力产品化。毕竟用户真正需要的是能解决实际问题的产品,而不是单纯的AI模型本身。
6. 追赶与期待:Gemini 3.5 Pro能否逆袭?#
不过客观来说,谷歌之前在多模态领域发力过猛,导致在Agent能力上略落后于Anthropic和OpenAI。如今眼看Agent赛道全面爆发,谷歌也奋起直追。但即便刚发布的Gemini 3.5 Flash表现亮眼,和这两家头部公司的核心模型仍有差距。那么,后续的Gemini 3.5 Pro会不会带来惊艳全场的突破?大家可以狠狠期待一下!
好了,我是阿朱,关注我,让我们一起在AI潮头冲浪~
昨天,谷歌 2026 IO 大会结束了。
我们知道,过去的一个月,claude 和 chatgpt ,还有 deepseek ,还有 小米模型 等等各大模型厂商,争先用新产品惊艳了我们各位。
而御三家的 谷歌 一直静悄悄的。这次大会,终于算是有了一点新闻可写。这个大会还挺值得说说!
主要的产品有这 5 个。我期待的 gemini 3.5 Pro 这次倒没说,但是这 5 个还是可以的:
第一,是视觉盛宴 多模态王者 ,Gemini Omni !
就是一句话生成任何媒体内容,换言之,将任何形态的文件作为输入,比如文字、视频、图片、音频,一次性发给它,然后你想让它输出什么,它就输出什么,输出视频、三维模型、图片等等…
第二个就是 快速写代码的的速度模型 Gemini 3.5 Flash !
这个是专为写代码优化的。但是速度极快!输出速度达到同类前沿模型的 4 倍,每秒竟然能输出 1500 个token!(我自己实测下来,加上推理,比 gemini 3.1 Pro 还聪明)
第三个是 Anti-Gravity 2.0 , 你可以理解为是 谷歌 的 claude code 或者 codex 。但是很尴尬,Antigravity 基本没人用…. 但谷歌,却把所有东西塞到 Antigravity 哈哈!(有点像美国豆包)
使用 Gemini 3.5 Flash 仅仅 12 小时就手搓了个操作系统!现场还能启动《毁灭战士》这个游戏,AI 消耗只是1000 美元以内的成本,让人类团队写,得好几个月!额…. 应该能比得上我的 codex + chatgpt 5.5 x 吧。但我没那么多额度哈哈。
第四个,看起来是一个新事物 Gemini Spark,其实就是一个类似于部署到云端的「龙虾机器人」。我都听腻了。就是远程帮你查邮件、查账单….
第五个,是 谷歌智能眼镜 。 这个没什么可说的。
总的来说,谷歌的大模型,过去一直是在智商上很强的,但是最近俩月花费大量精力在多模态上,导致智商落后,幻觉严重。现在智商依然略落后 Anthropic 和 openai 。但是 Gemini 3.5 Flash 在解决我的难题上,还是能力不错。其实也理解,之前谷歌的会员是不限制流量的,现在开始限制了,降智肯定会好很多。
希望谷歌奋起直追!等它的秋季发布会,看看 Pro 模型会不会像去年那样,碾压级领先!哦对了,nano banana 呢?