#01今日动态
DeepSeek V4 Pro 正式版更新至 DeepSeek-V4-Pro-0813,调用名保持不变
DeepSeek 官方 API 文档已将 deepseek-v4-pro 的模型版本更新为 DeepSeek-V4-Pro-0813,调用方法不变,用户继续使用 deepseek-v4-pro 即可访问最新版本。 同一页还列出 deepseek-v4-flash 对应的 DeepSeek-V4-Flash-0731。这表示 V4-Pro 正式版已经进入 API 文档的最新模型映射,调用名仍保持不变。 对使用 OpenAI/Anthropic 兼容接口的用户,base URL 和调用名不需要改写;只需继续使用 deepseek-v4-pro,即可调用最新版本。官网公告栏与 API 文档的同步可能存在时间差,具体模型版本以最新 API 文档为准。
#02OpenAI 与 Agent 产品
ChatGPT 桌面应用进入 Linux 预览,ChatGPT、Work 与 Codex 合并到一个原生客户端
OpenAI 宣布 ChatGPT 桌面应用的 Linux 版本进入预览阶段,ChatGPT、ChatGPT Work 和 Codex 被放进同一个原生桌面体验。 官方社区公告列出的支持范围包括 Ubuntu 24.04 LTS 与 26.04 LTS、Debian 13、Fedora 43 与 44,覆盖 x64 和 ARM64 架构,并提供 .deb 与 .rpm 安装包。 这不是把网页简单套进一个窗口:OpenAI 将桌面应用描述为处理项目、文件、浏览器工作流,并让 Codex 与 ChatGPT 并行工作的工作区。Linux 版本目前仍是 preview,具体功能与稳定性应按预览版看待,但它让 Codex 桌面路径第一次覆盖了 Linux 用户。
#03OpenAI 与 Agent 产品
OpenAI 支持从 Claude Code、Claude Cowork 和 Cursor 导入 Agent 工作
ChatGPT 桌面应用新增从其他 Agent 导入工作流的功能,桌面端可从 Claude Code、Claude Cowork 和 Cursor 导入,Codex CLI 可从 Claude Code 和 Cursor 导入。 官方文档列出的可迁移内容包括指令文件、设置、Skills、插件、项目目录、项目记忆、MCP 配置、Hooks、Subagents,以及最近 30 天的聊天记录。 桌面端还支持打开自动更新,让导入的工作与原 Agent 保持同步;Codex CLI 每次最多导入最近 30 天的 50 条聊天记录。官方特别说明,导入不会删除原有 Agent 配置,但 MCP 认证、权限、Hooks 和插件仍需要用户逐项复核,不能把“迁移完成”理解为安全设置已经自动等价。
#04OpenAI 与 Agent 产品
Workspace Agents 面向企业方案开放研究预览,可跨工具运行长期任务
OpenAI 将 Workspace Agents 开放给 ChatGPT Business、Enterprise、Edu 和 Teachers 方案的研究预览。 用户可以创建一个 Agent,让它跨 Slack、Google Drive、Microsoft 应用等工具获取上下文,执行线索研究、支持请求总结、报告生成等长期、多步骤工作,并把同一个 Agent 分享给团队。 这项功能的重点不只是“能执行”:官方页面同时列出了角色权限、审计日志、活动监控和敏感动作审批门槛。也就是说,OpenAI 正在把 Agent 从个人对话能力推向企业工作流管理;但目前仍是 research preview,适用范围和实际可靠性要以企业方案中的可用状态为准。
#05OpenAI 与 Agent 产品
SpaceXAI 发布 Grok Bot 早期测试版,多 Bot 可共享云端计算机并协作
SpaceXAI 发布 Grok Bot 早期测试版:每个 Bot 都拥有自己的云端计算机,可以登录用户现有的工具和应用,端到端完成多步骤工作。 官方将它描述为一组“始终在线的 AI 队友”,用户可以像给同事发消息一样分派任务,多个 Bot 还能互相传递工作、共享上下文,在群聊中协调执行。 Grok Bot 目前面向 SuperGrok Heavy、Cursor Ultra 和 Cursor Teams Premium 用户开放桌面端和 iOS 版本,企业用户可以加入候补名单。它的卖点是直接操作没有干净 API 的网站和工具,但这也意味着权限、账号安全和异常操作控制会比普通问答更重要。Elon Musk 另称 Grok 4.6 计划于本周晚些时候推出,属于后续预告,不应与本次 Bot 测试混为一谈。
#06模型与国产生态
NVIDIA 开放 Nemotron 3.5 Lightning:30B MoE,3B 激活参数
NVIDIA 发布并开放 Nemotron 3.5 Lightning:总参数 30B、每次推理激活 3B 的混合专家模型,定位是长期运行 Agent 的高频执行层。 它面向工具调用、结果校验和子 Agent 委托等大量重复步骤,试图把不需要前沿推理的任务交给更小、更快、更容易部署的模型。 官方说明同时提供 BF16 与 NVFP4 权重,训练中加入推测解码和面向 Agent harness 的优化,并以 OpenMDW-1.1 方式开放权重、数据与配方。配套的 NeMo Switchyard 是一个模型路由库,可把规划步骤交给前沿模型,把高频执行步骤路由给 Lightning。NVIDIA 给出的速度与效率数字属于其发布页的测试口径,实际部署仍需按硬件、框架和任务验证。
#07模型与国产生态
商汤 SenseNova 6.8 Flash Lite 进入 Token Plan 公测
商汤 Token Plan 页面目前将 SenseNova 6.8 Flash Lite 与 SenseNova U1 Fast 列入免费公测方案,按模型提供每 5 小时 1500 次调用额度。 页面将这套产品定位为原生多模态 Agent:既能处理文档、图片和表格,也能从理解任务一路生成交付物,并标注支持 Hermes Agent 与 OpenClaw 快速接入。 这条信息的价值不只在模型名称,还在于它把国产模型的使用门槛直接放进了“额度和接入方式”里。官方页面同时提醒特殊模型可能有不同限制,公测期间免费不等于长期价格,实际调用仍应以平台控制台和文档为准。
#08模型与国产生态
Bilibili IndexTeam 发布 IndexTTS 2.5,支持五语零样本语音克隆
Bilibili 旗下 IndexTeam 发布 IndexTTS 2.5 开放权重语音模型,支持使用一段参考音频进行中文、英文、日文、西班牙文和阿拉伯文的零样本语音克隆。 Hugging Face 模型页显示,该版本还支持跨语言声音迁移和情感控制,模型规模为 0.8B,并提供代码、权重和 ModelScope 下载方式。 技术报告把升级归因于语义 Codec 压缩、Zipformer 架构、跨语言建模和强化学习后训练;报告称,在保持相近 WER 与说话人相似度的同时,IndexTTS 2.5 的实时率比 IndexTTS 2 提升 2.28 倍。语音克隆涉及肖像和声音授权,模型页也明确把未经同意的冒充和欺骗列为不适用场景。
#09模型与国产生态
LTX 发布 LTX-2.5 开放权重世界模型,最低 16GB 显存本地运行
LTX 发布 LTX-2.5 开放权重世界模型,可从文本、图像和视频输入生成同步的高保真音视频。 新版本加入原生多镜头生成、扩散保真渲染、新的视频解码器、自动时长预测和定制 Gemma 4 12B 文本编码器,重点解决镜头连续性、提示词遵循和画面细节问题。 官方模型页列出 16GB 显存的最低配置标记,并提供拆分后的 Transformer、文本编码器、VAE 和时长头 checkpoint。模型采用开放权重和社区许可,年收入低于 1000 万美元的商业和生产使用可按社区许可免费使用;这类许可条件与“所有场景无条件免费”不同,部署前仍需阅读完整 LICENSE。
#10模型与国产生态
MAI-Code-1.1-Flash 进入 GitHub Copilot,效率与价格继续下探
Microsoft AI 发布 MAI-Code-1.1-Flash,官方称其在 GitHub Copilot 生产环境中提供更高代码质量、25% 的 token 效率提升和四分之一的成本。 发布页给出的测试结果包括 Terminal-Bench 2.1 提升 22%、.NET 任务提升 15%,Copilot 中的 token 流式传输速度提升 25%,完成同类任务的 token 用量减少 25%。 GitHub Changelog 的可用性说明更具体:Copilot Free 与 Student 用户通过自动模型选择获得,Pro、Pro+、Max、Business 和 Enterprise 可手动选择;企业管理员需要先打开相应策略。它不是“所有用户立即默认切换”,而是分层 rollout。
#11工具、平台与基础设施
Unsloth Desktop 开放 Beta,同时覆盖本地运行、训练与 Agent 接入
Unsloth Desktop Beta 以开源桌面应用形式提供本地运行和训练模型的入口,支持 macOS、Windows 和 Linux。 官方文档列出的范围包括 LLM、扩散图像与视频、MLX、GGUF 和音频模型;用户可以从模型中心下载适合设备的量化版本,也可以连接 Claude Code、Codex、MCP 和其他工具。 它的定位更像“本地模型工作台”而不只是聊天客户端:同一应用里包含训练、推理、Web 搜索、深度研究和 Agent 工具调用。官方还说明应用可完全离线运行,并支持多种 CPU、GPU 和 Apple Silicon;但不同模型、量化格式和显卡的速度与兼容性仍需具体测试。
#12工具、平台与基础设施
NVIDIA JetPack 7.2.1 加入 Agentic Video Skills 与 T3000 性能仿真
NVIDIA 在 JetPack 7.2.1 中加入面向 Jetson 视频流水线的 Agentic Video Skills,并支持在 Jetson T5000 上仿真 Jetson T3000 的性能。 新版本同时提供 PyNvVideoCodec 2.2 和统一的 jetson-videosdk 技能层,帮助开发者发现设备能力、选择编解码配置、生成配方并对吞吐、延迟和利用率进行验证。 这类功能的边界也很清楚:官方说明当前技能主要覆盖 Video Codec SDK 和 PyNvVideoCodec,并没有替代 GStreamer、V4L2 或应用层 AI 模型。它更像是把“查设备—配参数—跑测试—保留证据”这段工程流程交给 Agent 辅助完成。
#13工具、平台与基础设施
Mistral Regional Endpoints 正式可用,平台首批接入 Z.ai GLM-5.2
Mistral 宣布 Regional Endpoints 正式可用,客户可以选择把推理运行在欧洲或美国,并把数据驻留、监管和延迟要求纳入部署选择。 同一公告还宣布,Mistral 平台将支持第三方开放模型,首批接入 Z.ai 的 GLM-5.2;这些模型使用与 Mistral 自有模型相同的基础设施、区域控制和服务承诺。 这不是 GLM-5.2 在今天才发布,而是它进入了一个欧洲模型平台的正式模型选择范围。对国产模型而言,重要变化是模型不只存在于单一厂商控制台,也开始被纳入第三方平台的区域部署和企业采购语境。
#14工具、平台与基础设施
Gemini 月活与 Gemma 下载量同时突破 10 亿
Google CEO Sundar Pichai 宣布 Gemini 应用月活跃用户超过 10 亿;Google Gemma 账号随后确认,Gemma 模型家族下载量也超过 10 亿。 这两个数字分别对应消费端产品使用和开放模型生态传播,不能简单相加为同一种用户规模。 这是本期少数主要依赖官方账号发布的里程碑信息。由于原始 X 页面不提供稳定的完整正文抓取,正文只保留账号明确发布的两个数字,不进一步扩展到未能独立复核的增长率或因果判断。
#15企业治理、研究与应用
Anthropic Compliance API 扩展到 Claude Cowork 与 Claude Code
Anthropic 宣布 Compliance API 的覆盖范围扩展到 Claude Cowork 和 Claude Code,企业客户可以通过统一接口获取相关会话内容与元数据。 官方说明覆盖 Cowork 的桌面、网页和移动端,以及 Claude Code 的 CLI 和桌面端,当前向 Claude Enterprise 客户提供 Beta 能力。 它补上的是企业审计链条的一段:团队可以把 Cowork 和 Coding Agent 的活动纳入现有合规与电子取证流程,而不必为每一种入口重新搭建一套采集方式。官方文档仍要求使用企业权限和访问密钥,普通个人用户不能把这项 Beta 当成默认开放的日志接口。
#16企业治理、研究与应用
研究称加密隐藏推理可被跨模型提取,公开 Agent 轨迹中发现凭据
arXiv 论文《Stealing Reasoning Traces from Proprietary LLM APIs》称,一些提供商把隐藏推理以客户端回传的加密块形式处理,而这些块在不同会话、用户和模型之间可能具有可互换性。 研究者据此构造跨模型解密越狱,让较弱模型输出另一个模型的隐藏推理,并在 Anthropic、OpenAI 和 Google 的系统上展示攻击路径。 论文摘要还称,研究团队从公开仓库收集的 6708 条 Agent 轨迹中重建了 315320 个推理块,发现 367 件个人身份信息和 182 件凭据。这里的数字来自论文摘要;项目宣传页还给出了另一组统计口径,不能混合使用。对普通用户来说,最直接的结论不是“隐藏推理一定会泄露”,而是:公开上传包含加密推理块的 Agent 日志,仍然需要先脱敏、清理密钥和检查上下文。
#17企业治理、研究与应用
Google AMIE 展示实时视频问诊研究结果,但仍不是临床产品
Google Research 与 Google DeepMind 表示,研究型医疗 AI 系统 AMIE 已能在实时视频问诊中理解视觉和听觉线索、引导虚拟体格检查并进行诊断推理。 AMIE 基于 Gemini 和 Project Astra 的多 Agent 架构构建。 在使用患者演员和初级保健医生的模拟问诊随机研究中,临床评估者在病史采集、诊断准确性、管理建议和沟通质量等维度对 AMIE 给出正面评价,患者演员也更偏好视频而不是文字聊天。Google 同时强调 AMIE 仍是研究系统,距离负责任的现实临床部署还需要更多研究。
#18企业治理、研究与应用
Manus 恢复独立运营,部分用户需要在 8 月 23 日前备份数据
Manus 官方称公司将恢复独立运营,并提醒部分用户:因特定司法辖区的监管要求,2025 年 12 月 29 日及之后生成的数据将在 2026 年 8 月 23 日至 24 日(新加坡时间)删除。 受影响用户可以在 8 月 23 日 7:59(新加坡时间)前使用备份工具,8 月 25 日 8:00 起恢复已备份的数据;不受影响的用户无需操作。 这不是安全事件,官方明确将原因归结为与 Meta 分离以及相关监管要求。对 Manus 用户来说,关键动作是先确认账号是否受影响、尽快备份,再等待恢复窗口;对其他 Agent 产品来说,这也是一个提醒:长期工作流的可迁移性和数据导出能力,已经是产品稳定性的一部分。 ---