返回日报索引

AI DAILY / 2026-06-03

06·03 - AI 午报:微软 Build 放出 7 款自研模型与量子芯片,Agent 治理框架密集落地

微软 Build 2026 一天之内发布了自研推理模型 MAI-Thinking-1、量子芯片 Majorana 2、Agent 治理规范 ACS 和个人 Agent Microsoft Scout,把"自研模型 + Agent 基础设施 + 量子计算"三条线同时推到了台前。Anthropic 将 Claude Mythos Preview 扩展到 15 国关键基础设施领域,Google DeepMind 发布 Co-Scientist 多 Agent 科研系统。工具侧,OpenAI 为 Codex 推出六款业务插件,Windsurf 正式更名 Devin Desktop。

15 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01模型与基础设施

微软发布 7 款 MAI 自研模型,旗舰 MAI-Thinking-1 进入私有预览

微软在 Build 2026 上一次发布了 7 款 MAI 系列自研模型。 旗舰推理模型 MAI-Thinking-1 采用稀疏 MoE 架构,总参数量 1T、活跃参数 35B,从零训练而非第三方蒸馏。官方数据显示,该模型在 SWE-Bench Pro 上与 Claude Opus 4.6 持平,在盲测中超过 Claude Sonnet 4.6。微软同步推出"Frontier Tuning"企业强化学习方案,并宣布与 Mayo Clinic 合作开发医疗 AI 应用。

#02模型与基础设施

微软发布 Majorana 2 量子芯片,目标 2029 年交付量子计算系统

微软发布基于拓扑量子比特的 Majorana 2 芯片。 相比上一代,可靠性提升 1000 倍,量子比特平均寿命达到 20 秒(峰值超 1 分钟),操作速度 1 微秒,芯片尺寸仅 0.01 毫米。该芯片由 AI Agent 辅助设计,已进入 DARPA 量子基准测试决赛。微软计划 2029 年交付实用量子计算系统。

Microsoft Blog · 2026-06-02原文
#03模型与基础设施

微软推出 MAI-Voice-2 语音模型,支持 15 种语言与零样本克隆

MAI-Voice-2 支持 15 种语言(含中文),可从 5-60 秒参考音频零样本克隆语音。 在偏好测试中以 72% 胜率超过前代模型,官方声称生成语音与真人录音难以区分。内置同意机制(consent guardrails)防止滥用。该模型已在 Azure Foundry 上线,正在集成到 VSCode 和 Dynamics 365 中。

#04模型与基础设施

微软推出 MAI-Image-2.5 图像模型,Arena 图像编辑排名第二

MAI-Image-2.5 是微软自研图像模型,在 Arena 图像编辑排行榜中排名第二。 该模型支持高质量图像生成与编辑,已集成到微软产品线中。 ---

#05Agent 平台与治理

微软发布 Project Solara,基于 Android 的 Agent 优先设备平台

Project Solara 是微软面向 Agent 优先设备推出的边缘-云平台。 基于 Android 开源项目(MDEP)构建,包含 Agent Shell、即时 UI 和企业安全层。已与高通和联发科合作推出"badge"和"desktop"参考设计,降低专用硬件开发成本。目前处于内部测试阶段,企业试点计划后续启动。

#06Agent 平台与治理

微软发布 ACS 规范,统一 AI Agent 运行时治理

Agent Control Specification(ACS)是开源、厂商中立的可移植策略文件标准。 在 Agent 生命周期的 8 个拦截点评估策略,解决跨框架治理碎片化问题。MIT 许可证发布,CrewAI 已支持,与微软 AGT 集成。

#07Agent 平台与治理

微软发布 Microsoft Scout 个人 Agent,基于 OpenClaw 构建

Scout 是微软推出的"Autopilot Agent"类别的首个产品,基于 OpenClaw 构建。 深度集成 Teams、Outlook、OneDrive 和 SharePoint,可主动协调跨时区会议、标记重要日程、识别停滞决策。通过 Work IQ 学习用户工作习惯,企业级安全由 Entra 身份验证和 Purview DLP 保障。

Microsoft 365 Blog · 2026-06-02原文
#08Agent 平台与治理

Anthropic 向超 15 国扩展 Claude Mythos Preview 访问权限

Anthropic 将 Project Glasswing 下的 Claude Mythos Preview 扩展到 15 国以上约 150 个新组织。 受邀领域包括电力、供水、医疗和电信等关键基础设施。此前约 50 个合作伙伴已使用该模型发现超过 10,000 个高严重性安全漏洞。 ---

#09编程与开发工具

OpenAI 为 Codex 推出六款业务插件与 Sites 和 Annotations 功能

OpenAI 为 Codex 平台推出六款面向不同业务角色的插件,覆盖数据分析、创意制作、销售、产品设计、公开股权投资和投行。 目前已有 62 个应用和 110 项技能集成。Sites 功能可将 Codex 输出转化为可交互的网站,Annotations 支持精确局部编辑。Codex 周活跃用户超过 500 万,知识工作者用户增速是开发者的 3 倍。

#10编程与开发工具

Windsurf 更名为 Devin Desktop,支持 ACP 协议

Cognition 将旗下 IDE 产品 Windsurf 更名为 Devin Desktop。 该产品现已支持 Agent Communication Protocol(ACP),与 Devin 平台的其他工具实现互通。更名后产品定位更明确——面向开发者的桌面端 AI 编程环境。

#11编程与开发工具

Anthropic 发布 ant 命令行工具覆盖 Claude Platform API 全端点

Anthropic 推出 ant CLI 工具,覆盖 Claude Platform API 的全部端点。 开发者可通过命令行完成模型调用、管理和调试,无需编写额外代码。

#12编程与开发工具

GitHub Copilot App 预览版扩大范围,SDK 正式发布

GitHub Copilot App 预览版已向所有 Pro/Pro+/Business/Enterprise 用户开放,覆盖 Windows、macOS 和 Linux。 Copilot SDK 同步正式发布,提供稳定 API 供第三方嵌入 Agent Engine。新增本地+云端安全沙箱用于 Agent 工作流,"Canvases"功能支持人机协作画布。此外还增加了语音对话、云端会话和 Agent 浏览等能力。 ---

#13研究与开源

Google DeepMind 发布 Co-Scientist 多 Agent 科研系统

Google DeepMind 发布基于 Gemini 的多 Agent 科研系统 Co-Scientist。 该系统可生成、辩论和演化假设,通过"锦标赛"机制筛选最有价值的科学假设,并能对照文献和数据验证结论。已在肝纤维rosis 新靶点发现、ALS 研究新路径探索和数十年文献综合分析中完成评估。现通过 Gemini for Science 向个人研究者开放"假设生成"功能。

Google DeepMind · 2026-06-02原文
#14研究与开源

Google DeepMind 开源科研工具包 Science Skills

Science Skills 工具包集成 30 多个科学数据库和模型(包括 AlphaGenome、AFDB、UniProt 等)作为结构化 Agent 工具。 覆盖基因组学、结构生物学和化学信息学。Apache 2.0 许可证发布,可将文献综合任务从数小时压缩到数分钟。 ---

Google DeepMind · 2026-06-02原文
#15安全与行业

黑客利用 Meta AI 漏洞劫持 Instagram 账号,官方确认已修复

攻击者利用 Meta 于 2026 年 3 月上线的 AI 客服聊天机器人,通过简单提示词劫持 Instagram 账号。 受害者包括 @obamawhitehouse、美国太空军、Sephora 以及安全研究员 Jane Manchun Wong。Meta 已确认漏洞已修复。 ---