Google 在 I/O 2026 开场主题中把今年的 AI 更新概括为 “agentic Gemini era”。 官方博客由 Sundar Pichai 署名,发布时间为 2026 年 5 月 19 日,页面标题直接指向 “Welcome to the agentic Gemini era”。这条主线把 Gemini 模型、Google Search、开发者工具、Workspace、Android 和消费端应用放在同一叙事里,重点从对话式助手转向能执行任务、使用工具和跨产品协作的 AI 系统。 Google I/O 的更新集中在三条线上:Gemini 3.5 模型、AI Search、以及面向开发者和消费端的 Agent 产品。Gemini 3.5 Flash 被描述为面向长周期 agentic workflows 的模型,Google Search 也把 AI Mode 用户的默认模型切到 Gemini 3.5 Flash。Gemini Spark、Antigravity 2.0、视频模型等内容也在发布讨论中出现,但完整参数和开放节奏仍待后续文档补齐。
#02Google I/O 与 Gemini
Gemini 3.5 Flash 发布,3.5 Pro 预告下月推出
Google 发布 Gemini 3.5,标题为 “frontier intelligence with action”,首发重点是 Gemini 3.5 Flash。 Google 人员称 3.5 Flash 面向复杂、长周期 agentic workflows,并已开始全球推出。Gemini 账号同时预告,Gemini 3.5 Pro 将在下个月推出。 公开讨论中还出现了 Gemini 3.5 Flash 的价格、上下文和评测信息:上下文保持 1M token,输入价格为每百万 token 1.5 美元、输出价格为每百万 token 9 美元,并提到 ArtificialAnalysis 分数、API 和聊天渠道上线节奏。Google 还称 Gemini 3.5 Flash 已成为 AI Mode 用户的默认模型,并将随 Search 更新面向全球用户逐步推出。
#03Google I/O 与 Gemini
Gemini Omni 主打照片、视频、音频输入和新场景生成
Google DeepMind CEO Demis Hassabis 在 X 上介绍 Gemini Omni,称其面向 world understanding 与 multimodal editing。 这条社媒消息写到,Gemini Omni 可以接收照片、视频和音频,并基于这些输入构建新场景;未来会处理任意输入和任意输出,当前从视频开始。帖子还称用户可以上传自己的视频并迭代创意。 Google I/O 相关整理也把 Gemini Omni 与视频编辑、多模态输入输出和新版 Search 放在一起。Gemini Omni 目前还没有完整模型卡、API 价格、视频时长、分辨率或开放地区说明,这部分后续需要等 Google 补充文档。
#04Google I/O 与 Gemini
Search、AI Studio 与 Antigravity 2.0 同步更新
Google Search 发布 “A new era for AI Search”,Google 称这是搜索框 25 年来最大升级之一。 Google 将 Gemini 3.5 Flash 设为 AI Mode 用户默认模型,并围绕 AI Mode、Search Live、多模态输入和更长链路任务更新 Search。 开发者工具侧,Google AI Studio 和 Gemini API 更新包括 Gemini 3.5 Flash、managed agents、Antigravity harness、原生 Android app creation、workspace integrations 和一键导出到 Antigravity。Antigravity 2.0 的 Demo 讨论集中在“96 个 agents、12 小时、不到 1,000 美元 token 成本生成可运行操作系统并运行 Doom”;相关任务定义、复现步骤和成本拆分尚未完整公开。
#05算力、开发工具与社区实测
Cerebras 称 Kimi K2 企业版推理达到 1,000 tokens/s
Cerebras 官方博客发布 Kimi K2 企业版支持,称其在 Cerebras Inference 上达到 1,000 tokens/s。 Reddit 帖把该消息概括为 Cerebras 正在以 1,000 tokens/s 运行万亿参数 Kimi K2.6,并附 Cerebras X 帖和官方博客链接。Cerebras 博客标题为 “Cerebras brings instant AI inference to the new Kimi K2 Thinking enterprise model”,发布时间为 2026 年 5 月 19 日。 Cerebras 把这次发布定位为面向企业推理的高速服务更新。围绕 “frontier model” 表述、量化方式和与 Google 3.5 Flash 的速度对比,社区已有讨论;芯片部署数量、量化等级和第三方复现实测尚未公开。
Hugging Face 研究者发布 Carbon,一组面向 DNA 的 open foundation models。 发布信息称 Carbon-3B 在若干任务上接近当前 SOTA Evo2-7B,同时速度快 275 倍。项目同时提供 GitHub 技术报告和 Hugging Face demo。 技术路线方面,Carbon 没有直接把自然语言 LLM 训练配方搬到 DNA 上。帖子写到,项目使用 deterministic 6-mer tokens,把序列长度缩短约 6 倍;训练中从普通 cross-entropy 切换到更灵活的 factorized loss,以缓解 6-mer token 预测中的脆弱性和 loss spikes;数据侧则强调对重复、稀疏 genomic background 做分阶段筛选。
#10模型、研究与公司快讯
Karpathy 加入 Anthropic;Demis Hassabis 再谈 AGI 时间表
Andrej Karpathy 发 X 称,他已经加入 Anthropic。 Karpathy 写到,未来几年会是 LLM frontier 发展中很有形成性的阶段,他很高兴加入 Anthropic 并回到 R&D;他也提到仍然关心教育,之后会恢复相关工作。 Demis Hassabis 在 Google I/O 上也再次谈到 AGI 时间表,相关标题称 “Artificial General Intelligence is just a few years away”。这句话被放在 Google I/O 的大背景下讨论,但还没有完整文字稿可对照。