返回日报索引

AI DAILY / 2026-08-14

08·14 - AI 午报:Gemini 3.7 Flash 登场,MiniMax Music 3.0 与 dots3 开放权重

今天的模型新闻从“更强”转向“更容易接入”:Gemini 3.7 Flash 把编码与 Agent 能力放进更低的价格档,MiniMax Music 3.0 和 dots3-note preview 分别把音乐生成与多模态长上下文模型开放给开发者;Cerebras 则把 GPT-5.6 Sol 的 API 生成速度推到每秒 750 个输出 token。另一条线是工具开始接管长任务:Claude Code 支持额度重置后自动续跑,Hermes Agent Bot Mode、Optima 和 Sheets canvas 都在把模型能力嵌进具体工作流。

8 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01模型与开放权重

Gemini 3.7 Flash 发布:编码与 Agent 能力升级,年底前输入输出价格为 0.75/3.75 美元

Google 发布 Gemini 3.7 Flash,并将它定位为面向编码和 Agent 的工作马模型。 官方文章称,这一版本距离 Gemini 3.6 Flash 约三周,重点覆盖软件工程、知识工作和复杂的 Agent 工作流;模型已通过 Gemini API、Google AI Studio、Antigravity、Android Studio 等入口提供。 Google 给出的限时价格是每百万输入 token 0.75 美元、每百万输出 token 3.75 美元,优惠持续到 2026 年底。价格属于发布方的 API 计费口径,实际费用仍取决于输入输出量和具体入口。 模型卡:https://deepmind.google/models/model-cards/gemini-3-7-flash

#02模型与开放权重

MiniMax Music 3.0 开放权重:8B+0.6B 混合架构,最长生成 5 分钟歌曲

MiniMax 发布并开放 Music 3.0 模型权重,输入歌词和音乐描述后,可以生成最长 5 分钟、包含人声与编曲的完整歌曲。 模型由 8B Global LLM 和 0.6B Local LLM 组成:前者负责较长范围的音乐结构,后者处理帧级声学细节;模型卡还列出 Flow Matching、Flow-VAE 等连续隐藏状态合成组件。 Music 3.0 输出 32 kHz、16-bit 立体声 WAV,模型仓库提供 Diffusers 和 SGLang-Omni 等使用路径。开放权重意味着开发者可以自行部署和修改,但音乐生成的版权、声音授权和商用范围仍需按仓库与许可证核对。 模型文件:https://huggingface.co/MiniMaxAI/MiniMax-Music3 代码:https://github.com/MiniMax-AI/MiniMax-Music3

MiniMax Research、Hugging Face · 2026-08-13原文
#03模型与开放权重

dots3-note preview 开放权重:280B 总参数、16B 激活参数,支持 512K 上下文和多模态输入

dots studio 发布 dots3-note preview,这是 dots3 系列首个开放权重模型。 官方仓库写明,模型采用 MoE 架构,总参数 280B、激活参数 16B,最长上下文为 512K;它能够理解文本、图像、视频和音频,输出文本,并覆盖工具调用、多步 Agent、文档和图表理解等任务。 项目采用 Apache 2.0 许可证,仓库提供部署说明和不同推理框架的接入信息。280B 总参数并不等于普通个人电脑可以直接运行;实际部署仍受权重精度、显存、推理框架和上下文长度影响。 模型文件:https://huggingface.co/dots-studio/dots3-note-prev

dots studio / GitHub · 2026-08-13原文
#04推理服务与开发工具

GPT-5.6 Sol Ultrafast 进入有限预览:Cerebras 提供算力,最高 750 output tokens/s

OpenAI 与 Cerebras 展示了 GPT-5.6 Sol 的 Ultrafast 服务层级,官方给出的最高生成速度为每秒 750 个输出 token。 这一模式首先作为 OpenAI API 的新服务层级提供,由 Cerebras 的 Wafer-Scale Engine 提供算力;Cerebras 称它面向时间敏感、对延迟要求高的任务。 Ultrafast 目前是有限预览,只向部分客户开放,后续随容量增加扩大访问。750 output tokens/s 是发布方测试口径,不代表所有请求、模型入口和任务都能达到同一速度。

#05推理服务与开发工具

Claude Code desktop 增加 auto-continue:额度重置后自动从中断处继续

Claude Code desktop 新增 auto-continue 选项,用户达到使用限额后,额度重置时可以让任务自动继续。 ClaudeDevs 的公开说明把它描述为一个复选框:开启后,任务会从中断位置恢复,不需要用户手动重新启动。 这项功能解决的是长任务被额度窗口打断的问题,实际恢复位置和上下文保留情况仍以桌面端版本和账户状态为准。公开说明没有列出更细的配额规则,因此不把它扩写成新的额度政策。 参考资料:https://x.com/ClaudeDevs/status/2088014831605702937

ClaudeDevs · 2026-08-14
#06推理服务与开发工具

Hermes Agent Bot Mode 公测:把 Agent profile 变成独立 Bot,支持 Bot 间通信

NousResearch 发布 Hermes Agent 的 Bot Mode 桌面插件,把原有 Agent profile 转成具名 Bot。 每个 Bot 有独立聊天记录、头像、SOUL.md 人设、技能和记忆,用户可以在侧边栏直接切换;项目说明还列出例行任务和 Bot 间通信能力。 Bot Mode 是桌面插件,不需要修改 Hermes 核心代码,但要求使用最新桌面应用。它把“切换配置文件”变成了多个长期存在的工作角色,具体可用范围以插件版本和本地安装结果为准。 相关讨论:https://github.com/NousResearch/hermes-agent/issues/64182#issuecomment-5275487630

NousResearch / GitHub · 2026-08-14原文
#07基准与产品应用

Artificial Analysis 推出 Optima:用自己的任务比较模型质量、成本和耗时

Artificial Analysis 推出 Optima 自定义基准平台,允许用户围绕自己的任务建立测试集,再比较多个模型的质量、成本和耗时。 平台支持上传文件、导入 Agent 轨迹、安装编程环境插件或直接描述用例,随后用标准评分或配对评分运行比较。 Optima 的定位不是再提供一张通用排行榜,而是把评测对象换成用户自己的任务。平台按 token 使用量计费,并向限时注册的新用户提供 10 美元体验额度;费用和额度规则以产品页面当前说明为准。

Artificial Analysis · 2026-08-14原文
#08基准与产品应用

Google Sheets 上线 Sheets canvas:用提示词把表格数据变成交互式小应用

Google 在 Sheets 中推出 Sheets canvas,用户可以用自然语言提示词,把表格数据转成交互式仪表板、学习追踪器或座位表等小应用。 Google 的产品介绍称,生成的界面会与原始表格实时同步,用户不需要编写公式或代码,也可以像普通表格一样协作分享。 Sheets canvas 由 Gemini 提供能力,目前向 Google AI Pro 和 Ultra 订阅者全球提供英文版本,并向部分 Google Workspace 和教育版用户逐步开放。可用性受套餐、地区和 rollout 节奏影响,不能把产品页的全球描述理解为所有账户已同时获得入口。 ---