返回日报索引

AI DAILY / 2026-08-04

08·04 - AI 午报:Qwen3.8权重下周开放,GPT-Live API即将推出

今天最值得关注的不是又一张模型榜单,而是两个仍在等待开放的节点:Qwen3.8-Max 正式版已经接替 Preview,Max 与 27B 权重计划下周公开;OpenAI 则把 GPT-Live 先部署到 ChatGPT Voice,并预告 API 即将推出。与此同时,Kiro、Cloudflare 和 OpenRouter 分别在统一 Agent 架构、运行环境与项目级评测上补齐工程底座,模型的可用性竞争正在从“能不能回答”转向“能不能持续完成、运行和验证”。

7 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01模型与开放节点

Qwen3.8-Max Preview 将于 8 月 5 日下线,Max 与 27B 权重仍计划下周开放

Qwen3.8-Max 的正式版已经上线,阿里云百炼公告称原 Preview 版本将于 8 月 5 日下线。 这意味着今天值得关注的不是重复“Qwen3.8-Max 发布”,而是服务状态已经进入切换节点:个人版 Token Plan 已支持正式版,原先订阅过的用户还将获得一次 7 天额度重置权益。 Qwen 官方公告仍确认,Qwen3.8-Max 的开放权重将在下周发布,Qwen3.8-27B 也会同步开放。官方给出的规模是 2.4T 总参数、95B 激活参数;但开放权重计划不等于权重已经可以下载。我在今天下午重新核对 Hugging Face 与 ModelScope 的 Qwen 官方路径时,尚未看到对应的公开 checkpoint,因此目前应写成“宣布下周开放”,不能提前写成“已经开源可用”。 这条新闻相较昨日的新增信息,是 Preview 下线时间、正式版切换和用户额度安排。真正值得继续跟踪的下一个节点,是下周两个模型是否按计划出现在官方模型仓库,以及模型卡最终给出的许可证、架构和部署要求。

Qwen 官方公告、阿里云百炼公告 · 2026-08-04原文
#02模型与开放节点

GPT-Live 已用于 ChatGPT Voice,专属 API 计划即将推出

OpenAI 已开始向 ChatGPT 用户推出 GPT-Live,并明确表示会把 GPT-Live 带到 API,时间表暂未公布。 官方产品公告称,GPT-Live-1 和 GPT-Live-1 mini 正在全球 ChatGPT Voice 中推出;开发者和企业可以登记 API 开放通知。 GPT-Live 的产品思路是把连续语音交互和复杂任务委派拆开:全双工语音模型可以同时听和说,需要搜索、深度推理或工具调用时,再把任务交给后端模型处理,而不中断当前的语音流。OpenAI 的工程文章还解释了这套系统如何用持续推理、独立媒体通路和异步 RPC 保持响应连贯;在当前 ChatGPT Voice 中,后台可以调用 GPT-5.5 等前沿模型。 目前能确认的是 ChatGPT Voice 已先行,API 只是“即将推出”,没有具体发布日期,也不能写成开发者已经可以直接调用 GPT-Live API。

OpenAI · 2026-07-08;OpenAI Engineering · 2026-08-03原文
#03Agent 与运行环境

Kiro 统一 Agent Harness,四个客户端共享一套运行底座

Kiro 将 IDE、CLI、Web 和 iOS 客户端背后的代理架构收敛为一套统一的 Agent Harness。 Kiro 官方解释,过去不同客户端各自维护会话格式、工具集、配置和权限系统,导致同一项工作无法顺畅地在不同入口之间迁移。 新架构把 Harness 做成独立服务进程,通过 Agent Client Protocol 及扩展与客户端通信。官方同时引入基于 Cedar 的能力权限模型,用统一方式管理文件读写、Shell、网页抓取、MCP 和子代理等能力。Web 与 iOS 版本仍有预览或早期访问边界,不能把“架构已统一”理解成所有客户端的功能都已经完全同等开放。

#04Agent 与运行环境

Cloudflare 发布 @cloudflare/computer 早期预览,把 Agent 的工作区与执行环境拆开

Cloudflare 发布开源的 @cloudflare/computer 早期预览版,为 Agent 提供一个带持久文件系统和多种执行后端的工作区。 官方介绍称,同一份工作区文件可以在 isolate 中完成轻量操作,也可以按需交给 Linux 容器处理需要原生二进制、npm 或完整 Linux 环境的任务。 这个包还提供读、写、编辑和命令执行等工具,操作可以被控制、审计和观察。它目前仍是早期预览,重点不是把“容器”换成另一个名称,而是把 Agent 的状态、文件系统和执行后端放到一个统一抽象里,再按任务选择速度、能力和成本不同的运行环境。

Cloudflare Blog · 2026-08-04原文
#05Agent 与运行环境

OpenRouter 推出 Ori Eval,在真实项目提示词上比较模型

OpenRouter 推出 Ori Eval,用项目自己的提示词、测试材料和 Agent Harness 比较不同模型。 官方文档称,开发者可以让编程 Agent 扫描代码库、生成评估文件、运行跨提供商的模型比较,再根据分数、耗时和成本选择模型。 Ori Eval 的关键不只是“再做一个榜单”,而是固定一次运行中的 Harness 和模型配置,让同一组测试可以复跑。评测会真实调用模型并产生费用,因此它更接近项目选型工具,而不是免费的离线排行榜。对于 Agent 场景,固定任务、工具和验收条件,往往比直接引用通用榜单更能说明一个模型是否适合自己的项目。

OpenRouter Docs · 2026-08-04原文
#06工具与成本治理

Hermes Agent v0.20.0 更新实时语音、A2A 协议与桌面插件能力

Nous Research 发布 Hermes Agent v0.20.0,更新重点覆盖实时语音、Agent-to-Agent 协议和桌面扩展。 发布说明列出可流式合成、可中途打断的实时对话语音模式,并将能力扩展到 CLI、桌面应用和飞书等入口;同时加入 Agent-to-Agent v1.0、出站 Webhook、事实检查技能、桌面插件 SDK 与 artifacts 沙盒预览。 相较 8 月 1 日已公布的桌面插件 SDK,这次版本级进展的新增重点是实时语音、A2A、Webhook 与 artifacts 沙盒;同时还调整了工具调用上限和上下文管理方式。由于具体能力仍取决于通道适配、模型提供方和本地配置,升级时应以自身部署环境的实际支持情况为准。

Nous Research · GitHub Release · 2026-08-03原文
#07工具与成本治理

Cloudflare 推出 Billable Usage API,让 Agent 产生的云成本可以被程序读取

Cloudflare 为自助服务账户推出 Billable Usage API,用一个接口返回账户按产品和计费周期拆分的用量与成本。 官方说明称,接口覆盖 Workers、R2、D1、Workers AI、Vectorize、Images 和 Stream 等按量计费产品,字段设计参考 FinOps 的 FOCUS 规范。 数据目前按日更新,API 提供的是成本可见性,不是新的计费规则。对于会自动部署 Worker、调用模型或创建基础设施的 Agent,这种接口的意义在于可以把预算、异常告警和成本归因接入自动化流程,而不是等人手动打开账单页面后再发现用量已经超出预期。 ---