返回日报索引

AI DAILY / 2026-07-10

07·10 - AI 午报:GPT-5.6 发布,ChatGPT Work 上线

今天的主线是 OpenAI 和 Meta 同时把模型能力推进到日常生产入口:OpenAI 正式发布 GPT-5.6 系列并上线 ChatGPT Work,把 Agent、Codex 和新版桌面应用打包进同一工作流;Meta 发布 Muse Spark 1.1,首次面向开发者开放多模态推理 API。开发生态里,Google Cloud 的 AlphaEvolve、ElevenAgents Spotlight、腾讯 BrowserSkill、Bun 的 Rust 重写和 TypeScript 7.0 的 Go 原生移植同时出现,说明基础设施和工具链正在加速翻新。行业侧,Anthropic 任命 Ben Bernanke、Cerebras 扩张欧洲、Meta 在加拿大建 1GW 数据中心、Ollama 完成 8800 万美元融资,资本与算力仍在向头部集中。

25 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01模型与发布

OpenAI 发布 GPT-5.6 系列模型,Sol/Terra/Luna 三档定价同时上线

OpenAI 正式发布 GPT-5.6 系列,包含旗舰 Sol、均衡 Terra 和高性价比 Luna 三个模型,面向不同成本与延迟需求分层。 官方博客称,Sol 在编码、知识工作和网络安全等基准上达到 SOTA;Terra 和 Luna 以更低价格提供相应性能。API 定价按每百万 token 计算:Sol 输入 5 美元 / 输出 30 美元,Terra 输入 2.5 美元 / 输出 15 美元,Luna 输入 1 美元 / 输出 6 美元。ChatGPT 各订阅层对 Sol、Terra、Luna 和 ultra 设置拥有不同访问权限, ultra 设置默认协调四个 Agent 并行处理复杂任务。 安全方面,官方称 Sol 的网络防御机制阻止的潜在有害活动约为此前模型的十倍,网络安全高级防御能力仅限受信任访问项目。发布节奏上,GPT-5.6 正逐步向全球上线,各类用户在不同产品中的可用时间表存在差异。

#02模型与发布

Meta 发布 Muse Spark 1.1 推理模型,首次开放 Model API

Meta Superintelligence Labs 发布 Muse Spark 1.1 多模态推理模型,并首次通过 Meta Model API 向开发者开放。 官方博客称,该模型具备 100 万 token 上下文窗口,支持主动上下文管理与压缩,原生处理视频、音频和图像输入。在涉及大型复杂代码库的真实任务上,Muse Spark 1.1 在诊断修复、功能实现和代码迁移等场景有显著改善;官方评估报告称其 Terminal-Bench 2.1 得分达到 80.0%。 模型已上线 Meta AI 应用与网站,开发者可申请 Meta Model API 公开预览。Muse Spark 1.1 的发布意味着 Meta 首次把前沿推理模型以 API 形式开放给外部构建,与 OpenAI 的 GPT-5.6 在同一天形成直接竞争。 补充报道:https://ai.meta.com/static-resource/muse-spark-1-1-evaluation-report

#03模型与发布

OpenAI 推出 ChatGPT Work,由 GPT-5.6 和 Codex 驱动

OpenAI 发布 ChatGPT Work,一个整合 ChatGPT 与 Codex 的 Agent,用于跨应用、文件和项目完成复杂工作流。 官方页面称,它可以理解用户目标,在后台调用工具、生成文档、创建交互式站点,并支持定时任务和计算机使用能力。网页与移动端正逐步向 Pro、Enterprise 和 Edu 用户推出,Plus 和 Business 用户将在随后几天获得;桌面端则面向所有套餐用户(包括免费套餐)开放。 Enterprise 和 Edu 工作区有两周默认关闭的预览期。原有的独立 Codex 应用并入新版桌面应用,应用目录也已统一为插件目录。ChatGPT Work 的推出意味着 OpenAI 不再把聊天、编程和 Agent 能力分成独立产品,而是试图合并成一个“工作入口”。

#04模型与发布

OpenAI 新版 ChatGPT 桌面应用合并 Chat、Work 与 Codex 三种模式

OpenAI 发布新版 ChatGPT 桌面应用,把 Chat、Work 和 Codex 三个模式整合进同一个客户端,支持 macOS 与 Windows。 官方帮助文档称,现有 Codex 应用更新后可变为新版应用,现有任务与项目保留;用户也可在设置中把 Codex 保持为默认启动界面。原 ChatGPT 桌面应用将保留为 ChatGPT Classic,继续获得模型与安全更新,但新的 Agent 功能仅在新版应用提供。 这一合并与 ChatGPT Work 的发布配套:OpenAI 希望减少用户在不同应用之间的切换,把日常对话、Agent 任务和编码工作放在同一入口。对开发者来说,这意味着 Codex 不再是一个独立应用,而是成为 ChatGPT 桌面应用中的一个模式。 补充报道:https://help.openai.com/en/articles/6825453-chatgpt-release-notes ---

OpenAI Help Center · 2026-07-10原文
#05开发生态与工具

Codex 升级:文件编辑、PR 审查、Pro 与 Ultra 模式

OpenAI 为 ChatGPT Codex 增加文件编辑、GitHub Pull Request 审查、Pro 与 Ultra 执行模式,并改进了 Computer Use 速度。 官方更新说明称,开发者现在可直接在应用内编辑 Markdown 和代码文件,通过内联注释让 Codex 修订选中内容;GitHub PR 及其反馈差异可以在侧边栏查看和审查。Pro 模式用于常规任务,Ultra 模式用于高复杂度任务,同时支持跨多个仓库工作。 这套更新把 Codex 从“代码补全/生成工具”进一步推向“工程工作控制台”:编辑、审 PR、跨仓库、追踪任务进度都在一个界面里。但 Codex 本身已被整合进新版 ChatGPT 桌面应用,独立 Codex 应用将退出。

OpenAI Help Center · 2026-07-10原文
#06开发生态与工具

ClaudeDevs 重置所有用户的 5 小时和每周速率限制

Anthropic 官方账号 ClaudeDevs 宣布,已于今日重置所有用户的 5 小时和每周速率限制。 该消息来自 Anthropic 在 X 上的官方账号,未附详细博客说明。对于 Claude 用户而言,这意味着此前被消耗的速率配额被一次性清零,但后续配额规则是否长期调整尚待官方进一步说明。 参考资料:https://x.com/ClaudeDevs/status/2075279141352706215

X @ClaudeDevs · 2026-07-10
#07开发生态与工具

Google Cloud 正式推出基于 Gemini 的 Agent AlphaEvolve

Google Cloud 与 DeepMind 联合开发的 AlphaEvolve 已在 Google Cloud 上全面可用,所有客户可通过 Gemini Enterprise Agent Platform 使用。 官方博客称,AlphaEvolve 不是从头重写代码,而是作为“进化协作者”,根据用户提供的基线算法和目标自动搜索更优解,并返回人类可读的优化代码。它面向代码、算法和系统设计优化场景,与通用代码生成工具定位不同。 补充报道:https://cloud.google.com/blog/products/ai-machine-learning/alphaevolve-is-available-for-everyone

Google Blog / Google Cloud Blog · 2026-07-10原文
#08开发生态与工具

ElevenLabs 推出 ElevenAgents Spotlight 语音与聊天对话监控层

ElevenLabs 发布 ElevenAgents Spotlight,作为 ElevenAgents 的观察与改进层,提供实时对话监控和主动建议。 官方博客称,Spotlight 实时审查语音与聊天对话,跟踪成功率、延迟和异常,自动分组对话并评分情感;用户可用自然语言编写评估标准对对话自动评分。Spotlight 还基于 Agent 配置和对话历史提供主动改进建议,并支持把数据流式传输到 Datadog、Grafana 等监控工具。 补充报道:https://elevenlabs.io/docs/eleven-agents/dashboard/spotlight

ElevenLabs Blog · 2026-07-10原文
#09开发生态与工具

腾讯开源 BrowserSkill,让 Agent 操作用户已登录浏览器

腾讯在 GitHub 开源 BrowserSkill,允许支持 Shell 的 AI Agent 通过本地桥接层操作用户已登录的浏览器。 项目由 bsk CLI/daemon 与浏览器扩展组成,Agent 任务在独立窗口运行,需显式借用用户标签页并内置 human-in-loop 机制。BrowserSkill 目前支持 macOS、Linux 和 Windows x64,兼容 Chrome 与 Edge,并对 Cursor、Claude Code 等多种 Agent 提供一键安装支持。 代码:https://github.com/Tencent/BrowserSkill 补充报道:https://chromewebstore.google.com/detail/hhcmgoofomhgciiibhipgmgkgnoenaoi

GitHub · 2026-07-10
#10开发生态与工具

Bun 完成从 Zig 到 Rust 的运行时重写

Bun 官方宣布已将运行时核心从 Zig 全面重写为 Rust,相关代码已合并至主分支,v1.4.0 将成为首个 Rust 版本。 官方博客称,此次重写由项目作者使用预发布版 Claude Fable 5 与 Claude Code 的 64 个并行工作流在 11 天内完成。Rust 的所有权机制被用来从编译器层面系统性消除原有 Zig 代码中频发的 use-after-free、double-free 和内存泄漏问题。官方数据显示,Bun v1.4.0 修复了此前版本的 128 个 bug,Linux 与 Windows 二进制体积缩减约 20%,部分 HTTP 吞吐量与应用构建速度提升 2% 至 5%。该版本目前处于 canary 阶段。

#11开发生态与工具

TypeScript 7.0 发布 Go 原生移植版

TypeScript 团队发布 TypeScript 7.0,这是使用 Go 语言重写的原生移植版,官方称完整构建通常可实现 8 至 12 倍提速。 新版引入共享内存多线程、实验性 --checkers 并行配置、基于 Parcel 的 --watch 模式重写,并默认开启 TS 6.0 严格模式与多项破坏性变更。目前可通过 npm 获取并支持主流编辑器,但程序化 API 仍未就绪,导致 Vue、Svelte 等嵌入式语言工作流无法使用其语言服务,官方建议相关项目继续使用 TS 6.0 兼容包。 ---

Microsoft TypeScript Blog · 2026-07-10原文
#12产品应用

OpenAI 将 Atlas 能力转入 ChatGPT 桌面端与 Chrome 扩展

OpenAI 宣布弃用 Atlas 浏览器,将基于浏览器的 Agent 能力整合至 ChatGPT 和 Codex,Atlas 计划于 2026 年 8 月 9 日停止工作。 官方帮助文档称,ChatGPT 桌面应用将支持更强大的浏览器式 Agent 工作流,同时推出 ChatGPT Chrome 扩展提供网页辅助。现有 Atlas 的书签、打开的标签页及浏览器历史记录均不会自动转移。 补充报道:https://help.openai.com/en/articles/6825453-chatgpt-release-notes

OpenAI Help Center · 2026-07-10原文
#13产品应用

OpenAI 停止 ChatGPT 群聊创建与加入功能

OpenAI 宣布从当地时间 7 月 9 日起停止 ChatGPT 群聊相关功能。 官方更新说明称,届时 Web、iOS 和 Android 用户将无法创建新群聊、将现有对话转为群聊或通过邀请链接加入群聊。现有群聊暂时可继续使用,后续转为只读状态后用户仍可访问历史消息、文件与图像,独立对话不受影响。

OpenAI Help Center · 2026-07-10原文
#14产品应用

OpenAI 推出 ChatGPT Sites 公开测试版

OpenAI 发布 ChatGPT Sites 公开测试版,允许用户在 ChatGPT Work 网页端或桌面端生成交互式网站或轻应用。 官方帮助文档称,Pro、Pro Lite、Enterprise 及 Edu 用户率先获得访问权限,Plus 和 Business 用户将在随后几天推出,Free 和 Go 计划不可用。Enterprise 工作区默认关闭公开发布,需管理员启用;公开测试期间不支持数据驻留和推理驻留,也不支持自定义域名。 补充报道:https://help.openai.com/en/articles/6825453-chatgpt-release-notes

OpenAI Help Center · 2026-07-10原文
#15产品应用

Anthropic 推出测试版 Claude Reflect

Anthropic 推出测试版 Claude Reflect,帮助用户追踪和审视其使用 Claude 的方式。 官方博客称,Reflect 提供月度回顾,展示使用高峰时段、主题和协作模式,支持设置免打扰和休息提醒,并基于 4D AI Fluency Framework 提供建议。该功能要求开启 Memory 才能生成报告,不包含无痕对话及健康工具关联内容。 补充报道:https://anthropic.skilljar.com/ai-fluency-framework-foundations

Anthropic Blog · 2026-07-10原文
#16产品应用

1X Technologies 为 NEO 机器人推出 25 自由度手部

1X Technologies 宣布推出专为 NEO 人形机器人平台设计的 25 自由度绳索驱动手部。 官方页面称,该手部包含手指与手掌的 22 个完全驱动自由度及腕部 3 个自由度,采用约 5:1 至 15:1 低齿轮比与 1X Tendon Drive,具备原生力控、完全反向驱动能力与 ±0.2 mm 定位精度。指尖与表面配备高分辨率触觉感应,手部通过 IP68 防水与食品安全材质认证。该手部将随每台 NEO 出货,1X 称其专有产线今年产能可达 1 万只。 补充报道:https://x.com/BerntBornich/status/2075253825494237660 ---

1X Technologies · 2026-07-10原文
#17模型发布(小模型与开源)

MOSI 开源 MOSS-Transcribe-Diarize 0.9B 端到端音频理解模型

MOSI 官方开源 MOSS-Transcribe-Diarize 0.9B 模型,采用 Whisper 编码器与 Qwen3-0.6B 解码器架构,以端到端方式替代传统级联系统。 官方仓库称,该模型一次性输出包含时间戳与说话人标签的结构化转录文本,支持 128k 长上下文、最长约 90 分钟音频输入、多语言转录及热词提示。官方称其在 NVIDIA RTX 4090 上推理速度约 100 token/s,并在多项基准测试中取得领先指标。更强的 Pro 版本尚未开源,计划通过 API 访问。 代码:https://github.com/OpenMOSS/MOSS-Transcribe-Diarize

GitHub · 2026-07-10
#18模型发布(小模型与开源)

Reve 推出 Reve 2.1 图像模型

Reve 官方发布图像模型 Reve 2.1,距 Reve 2.0 发布仅一个月。 官方 X 账号称,该模型视觉智能与推理能力显著提升,以结构化布局替代纯文本提示实现更细致的规划与精确渲染;Reve 2.1 在 Arena.ai 与 Design Arena 评测中均列第二并刷新分数。官方称其仍为全球顶级 4K 模型且训练算力少于常规十倍。但有社区用户指出其 API 尚不可用。 参考资料:https://x.com/reve/status/2075248950756716747 补充报道:https://x.com/arena/status/2075251593277300787 ---

X @reve · 2026-07-10
#19技术与洞察

Artificial Analysis 发布 EnterpriseOps-Gym-AA 排行榜

Artificial Analysis 与 ServiceNow 联合发布 EnterpriseOps-Gym-AA 排行榜,测试 AI Agent 在实时企业系统中执行多步骤操作的能力。 官方页面称,该基准要求 Agent 通过实时 MCP 服务器调用 512 个工具,在 8 个业务领域执行不可逆的有状态多步骤操作,并以 SQL 验证最终数据库状态。官方数据显示,在 1117 项 oracle 模式任务中,Claude Fable 5 (max) 以 51% 完成率居首;模型必须通过所有验证检查才算任务成功。 代码:https://github.com/ServiceNow/EnterpriseOps-Gym

Artificial Analysis · 2026-07-10原文
#20技术与洞察

谷歌发布 LiteRT.js,支持浏览器本地 ML 推理

谷歌发布 LiteRT.js,将端侧推理库 LiteRT 的 JavaScript 绑定引入网页,使开发者能在浏览器中本地运行 .tflite 模型。 官方开发者博客称,该工具通过 WebAssembly 提供原生跨平台运行时,支持基于 XNNPACK 的 CPU 加速、ML Drift 与 WebGPU 的 GPU 加速,以及实验性 WebNN 的 NPU 加速。初始版本已发布 npm 包及示例,官方称其在经典模型上较其他 Web 运行时性能最高提升 3 倍。 ---

Google Developers Blog · 2026-07-10原文
#21行业动态

Anthropic 发起 AI “hard questions” 公开倡议

Anthropic 发起“hard questions”新倡议,邀请公众提交关于 AI 影响的难题,并承诺公开追踪报告针对这些问题的具体应对行动及未达目标领域。 官方博客称,公众可通过专属网站提交问题;Anthropic 此前已通过 Anthropic Public Record 调查 5.2 万名美国人,并借助 Anthropic Interviewer 访问 159 个国家的 8.1 万名 Claude 用户,为该倡议奠定基础。 补充报道:https://claude.com/hard-questions

Anthropic Blog · 2026-07-10原文
#22行业动态

Anthropic 任命 Ben Bernanke 为长期利益信托成员

Anthropic 宣布任命前美联储主席 Ben Bernanke 为其长期利益信托(LTBT)新成员。 官方博客称,Bernanke 的加入为 LTBT 带来经济学专业视角,将为 Anthropic 评估 AI 对经济的影响及相关研究提供洞察。LTBT 成员独立于公司管理层和投资者,不持有股权且不分享利润,有权任命 Anthropic 董事会成员并对关键决策提供建议。

Anthropic Blog · 2026-07-10原文
#23行业动态

Meta 宣布在加拿大建设 1GW 数据中心

Meta 宣布将在加拿大阿尔伯塔省斯特金县建设一个 1GW 数据中心,官方称投资将超过 130 亿加元。 官方数据中心页面称,该数据中心建设高峰期需约 3000 名工人,运营后支持超 300 个岗位;Meta 另将投资约 6000 万加元用于当地基建。据媒体报道,这是 Meta 在加拿大的首个数据中心,且将主要由天然气发电提供动力;但 Meta 官方称计划增加足够清洁能源以匹配该中心 100% 用电量。该中心还将采用闭路循环液冷加干冷系统,无运行用水。 补充报道:Bloomberg(via Juya 整理)

Meta Data Centers · 2026-07-10原文
#24行业动态

Cerebras 宣布欧洲扩张,2027 年底算力扩至 200MW

Cerebras Systems 宣布扩大欧洲基础设施规模,计划在法国和北欧地区建设数据中心。 新闻稿称,首批欧洲数据中心容量将于 2026 年底上线,并计划在 2027 年底将总容量扩展至 200 MW,其中部分容量预计将用于支持 OpenAI 的工作负载。此次扩张旨在把 Cerebras 的高速 AI 推理基础设施部署到离欧洲用户更近的位置,以降低复杂工作负载的响应时间。

Cerebras Press Release · 2026-07-10原文
#25行业动态

Ollama 完成 8800 万美元融资

Ollama 官方宣布完成 8800 万美元融资,投资方包括 Benchmark、Theory Ventures、8VC 等机构及多名个人投资者。 官方页面称,Ollama 目前服务 890 万开发者,财富 500 强中 85% 的公司使用其产品;其云服务已上线 GLM、Nemotron、DeepSeek、Kimi、MiniMax 等模型,Token 容量平均每月翻倍。Ollama 计划推进无缝混合推理、新开源模型发布当天的同步支持以及面向团队的云服务。 ---