返回日报索引

AI DAILY / 2026-08-05

08·05 - AI 午报:FLUX 3 Video 上线,LFM2.5 端侧 Agent 开放权重

今天的重点是模型开始连同运行入口一起交付:FLUX 3 Video 接入 API,Ling-3.0-flash、Maple-Preview 与 LFM2.5-2.6B 放出权重,后者主打端侧 Agent。Shieldstral、Alpamayo 2 Super 和 Ori Harness 则把安全审核、自动驾驶训练与 Agent 配置落到可调用的模型或工具上。

8 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01视频与开放模型

FLUX 3 Video 通过 BFL API 与指定合作伙伴开放,支持最长 20 秒原生音频视频

Black Forest Labs 宣布,FLUX 3 Video 的首个生成版本已通过 BFL API 和指定合作伙伴正式可用。 官方页面写明,模型支持从文本和图像生成最长 20 秒的 HD 视频,并同步生成原生音频;Full HD 输出通过超分辨率获得。 这次开放还带来 Draft Mode:先以较低成本生成预览,确认后再渲染成全质量版本。官方称,最终渲染会保留已确认预览中的主体、构图和动作。当前公告讲的是视频生成入口,不应把网站导航中出现的“Open Weights”栏目理解为 FLUX 3 Video 权重已经开放。

Black Forest Labs · 2026-08-04原文
#02视频与开放模型

蚂蚁百灵开放 Ling-3.0-flash 权重,提供 BF16 与 FP8 版本

蚂蚁百灵发布 Ling-3.0-flash,并在 Hugging Face 与 ModelScope 提供官方 BF16、FP8 权重。 模型页标注它采用混合线性架构与稀疏 MoE 设计,规模为 124B 总参数、5.1B 激活参数,定位是编码、通用任务和深度研究等 Agent 工作流。 发布材料称,Ling-3.0-flash 纳入了超过一万个交互式训练环境,并给出 SGLang、vLLM 等推理入口。这里的“开放权重”以两个官方模型页可下载为准;性能结论仍应以模型卡的测试条件和后续独立复现为界。

蚂蚁百灵 · Hugging Face、ModelScope · 2026-08-05原文
#03视频与开放模型

DeepGrove 发布 Maple-Preview:20B-A1B 三元权重推理模型以 MIT 许可证开放

DeepGrove 发布 Maple-Preview,模型页与 Hugging Face 仓库显示其为 20B-A1B 的三元权重推理模型,并以 MIT 许可证提供。 发布说明列出 20.2B 总参数、1.49B 激活参数、24 层与 256 个专家(每次激活 8 个)的配置。 官方把它定位为预览阶段的推理模型,并明确提示当前 Agent 方向的后训练规模有限,不能把其数学推理宣传直接外推成通用 Agent 能力。Mac mini M4 上的每秒 200 token 以上属于官方给出的特定测试描述,部署时还需看量化、上下文长度和任务设置。

DeepGrove、Hugging Face · 2026-08-05原文
#04视频与开放模型

Liquid AI 开放 LFM2.5-2.6B,主打端侧工具调用与多步 Agent 工作流

Liquid AI 发布并开放 LFM2.5-2.6B,强调在笔记本和手机等端侧设备运行工具调用与多步 Agent 工作流。 官方文章称,该模型在中期训练阶段扩展到 128K 上下文,后训练包括工具使用、网页搜索和 Harness 轨迹,并提供基础版与 Agent 版模型。 官方报告的效率数据是在 Apple M5 Max 达到 220 token/s、AMD Ryzen CPU 达到 113 token/s,内存低于 2.5GB;这些是厂商测试结果。模型页还写明可与 llama.cpp、vLLM 等推理栈配合,实际速度取决于量化、硬件和上下文长度。

Liquid AI · Hugging Face · 2026-08-04原文
#05安全与自动驾驶

Mistral 发布 3B 开放权重多模态安全分类器 Shieldstral

Mistral 发布 Shieldstral:这是一个 3B 参数、开放权重的多模态安全分类器,采用 Apache 2.0 许可证。 它把内容审核转为可用自然语言策略描述的问答任务:运行时可以按具体政策判断文字或图像,而不必为每套规则重新训练一个分类器。 官方称模型能输出校准后的安全分数,并可在单张 16GB NVIDIA GPU 上运行;其“超过体量高至七倍的模型”等表现属于发布方基准口径。模型是否适合某个产品的内容政策,仍要以本地策略、阈值和实际误判率测试为准。

#06安全与自动驾驶

NVIDIA 发布 34B 开放推理视觉—语言—动作模型 Alpamayo 2 Super

NVIDIA 发布 Alpamayo 2 Super,一款面向自动驾驶工作流的 34B 开放推理视觉—语言—动作模型。 它由 32B Cosmos 3 Super Reasoner 与 2B Action Expert 组成,可将轨迹生成、推理轨迹、元动作预测、带 2D 定位的视觉问答和自动标注放进同一模型。 官方说明称,模型可接收最多七路摄像头的 360 度感知输入,并输出未来轨迹和结构化推理标注,用于离线策略教学、评测、数据整理和任务定制。页面列出的轨迹预测、自动驾驶推理和问答成绩均为 NVIDIA 发布的测试结果;训练数据和部署条件仍需结合模型卡核对。

NVIDIA Technical Blog · 2026-08-04原文
#07Agent 与基础设施

OpenRouter 推出 Ori Harness,为 Claude Code、Codex、OpenCode 与 Hermes 生成配置

OpenRouter 发布 Ori Harness:安装 ori CLI 并登录后,可为 Claude Code、Codex、OpenCode 和 Hermes 等 Harness 生成面向 OpenRouter 的配置。 官方给出的调用方式是分别运行 ori claude、ori codex、ori opencode 或 ori hermes,用以减少不同工具之间重复填写环境变量和模型路由配置的工作。 这是一层配置与接入工具,而不是新的 Agent 模型或统一执行运行时。不同 Harness 的权限、工具调用和订阅能力依然由原工具与所选模型提供方决定;Ori 的作用是将 OpenRouter 的接入过程收敛成命令行步骤。

#08Agent 与基础设施

Cloudflare 发布 Wallets,为 Agent 场景提供可编程的钱包与支付能力

Cloudflare 发布 Wallets,将钱包管理、余额与支付能力封装为面向 Agent 场景的可编程服务。 官方将它描述为 agentic Internet 的钱包组件,并把支付能力与 Cloudflare 的开发者平台、x402 等生态连接起来。 这不是面向所有 Agent 的通用支付标准。发布信息主要讲的是 Cloudflare 的产品入口与集成方向,具体支持的链、账户类型、费用与地区可用性仍应以控制台和后续产品文档为准。 ---