返回日报索引

AI DAILY / 2026-06-23

06·23 - AI 午报:OpenAI 安全矩阵出击 · 大额融资集中落地 · 百川/TMax/豆包密集发布

今日主线:安全能力体系化升级与资本市场集中落定。OpenAI Daybreak 一口气发布 GPT-5.5-Cyber、Codex Security 和 Patch the Planet,将 AI 安全从漏洞扫描推向自动修复合规。融资侧,DeepSeek 完成 74 亿美元、智谱市值突破万亿港元、Groq 获 6.5 亿美元、SpaceX 与 Reflection AI 签下最高 63 亿美元算力合同——资金加速涌入模型、推理和基础设施。模型与工程端密集更新:字节豆包多模型齐发,百川医疗大模型 M4 登顶 HealthBench,Ai2 开源 TMax 终端 Agent 训练方案,Sakana AI 推出 Fugu 多 Agent 编排。

24 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01安全与监管

OpenAI Daybreak 安全矩阵齐发:GPT-5.5-Cyber、Codex Security、Patch the Planet

Sam Altman 宣布 OpenAI Daybreak 项目全面扩展,一次性向安全领域投入三个核心产品。GPT-5.5-Cyber 完整版在 CyberGym 基准上达到最先进水平,可追踪漏洞代码、验证问题、开发补丁并准备证据供人工审查。Codex Security 插件让开发者在 Codex 内直接完成发现、验证和修复漏洞的闭环,支持深度扫描、攻击路径追踪、威胁建模和代码库专属补丁生成。Patch the Planet 计划联合 Trail of Bits、HackerOne 等安全研究机构,使用前沿 AI 帮助开源维护者将安全发现转化为已合并的修复补丁。同期启动的 Cyber Partner Program 允许合作伙伴在其安全产品中集成 GPT-5.5 with Trusted Access for Cyber。 ---

#02安全与监管

Chat Template 成提示词注入新攻击面:开源模型系统提示、Tool 调用区域均可嵌入恶意 Payload

开源大模型的 Chat Template(对话模板)被发现是提示词注入攻击的新突破口。攻击者利用已知的 Jinja2 模板结构,在系统提示词区域、Tool 调用标签、think 标签等位置嵌入恶意 payload,可绕过模型的安全对齐。以 DeepSeek-R1 为例,bostoken 后的系统提示词区域、tool 调用前后的标记位均可被注入,且注入效果在对话上下文中持续存在。该攻击手法对商业部署的开源模型同样有效,研究者在腾讯元宝、深度求索等在线服务上完成了验证。 ---

#03安全与监管

EU AI Act 自 8 月 2 日起要求 AI 生成文本必须添加机器可读水印

欧盟 AI 法案将于 2026 年 8 月 2 日正式生效文本水印条款。所有生成合成文本的 AI 系统提供商必须确保输出可被机器标记和检测为 AI 生成,使用技术方案使文本"machine-readable and detectable"。违规罚款最高 3200 万美元。该条款影响范围远超音频水印要求——所有优质开源模型都需要适配。Reddit LocalLLaMA 社区讨论指出,该法案适用全球范围,不限欧盟境内用户。 ---

Reddit r/LocalLLaMA · 2026-06-23原文
#04融资与战略

DeepSeek 完成 74 亿美元融资、估值 600 亿,梁文锋个人出资 30 亿美元

DeepSeek 完成新一轮 74 亿美元融资,估值达到 600 亿美元。创始人梁文锋个人出资 30 亿美元,成为本轮最大单一投资者,其持股比例和公司控制权进一步增强。该轮资金将用于扩大 AI 模型训练集群和全球推理基础设施部署。此轮估值相比上一轮大幅跃升,反映市场对 DeepSeek 模型能力的认可,也加剧了国内大模型赛道的资本竞争烈度。 ---

Reddit r/LocalLLaMA · 2026-06-22原文
#05融资与战略

字节豆包多模型集中发布:Seed 2.1 Pro、视频/生图模型,Arena 现身神秘 code 模型 groudon

火山引擎大会于 6 月 22 日正式发布豆包系列新模型:豆包 Seed 2.1 Pro(语言)、豆包视频模型 2.1、生图模型 5.0 正式版。其中 Seed 2.1 Pro 此前已在火山方舟 coding plan 中灰度测试——约 1/3 用户被路由到该模型,社区实测 1M 上下文窗口、maxtokens 131K、tps 约 100,在 one-shot SVG 生成测试中被评为接近 GPT-5.6 和 Fable 5。与此同时,Arena 平台还出现了一个代号 groudon 的神秘 code 模型,未出现在官方公告中,具体参数和能力不明。此外豆包视频生成模型 Seedance 2.5 预计 7 月初开放 API,支持最长 30 秒视频生成和 4K 分辨率。 ---

Linux Do · 2026-06-22
#06融资与战略

SK Hynix 将部分 HBM 产能转向通用 DRAM,利润导向调整

据韩媒 biz.chosun 报道,SK Hynix 正在推迟原计划转换为 HBM4 的部分第五代 HBM3E 生产线,转而用于增加通用 DRAM 产能。原因是当前通用 DRAM 的运营利润率高于 HBM。这一调整可能缓解消费级 DRAM 的供应紧张——此前 TrendForce 已预警 AI 挤占产能导致 DDR2/DDR3 价格暴涨 60%。但同时也可能影响 HBM4 的供应节奏,对依赖高带宽内存的下一代 AI 训练芯片构成潜在约束。 ---

#07融资与战略

智谱市值突破万亿港元,较发行价上涨 2076%

智谱总市值首次突破 1 万亿港元,达 11,253 亿港元,较年初发行价上涨 2076%。 此前智谱发布并开源旗舰模型 GLM-5.2,在 Code Arena 排名总榜第二、全球可用模型第一。马斯克评论称中国或许 2027 年 Q1 可达到 Fable 级别,智谱创始人唐杰回应「用不了那么久」。 ---

#08融资与战略

Groq 完成 6.5 亿美元增长融资,目标 2027 年底扩展至 200MW

AI 推理云公司 Groq 获 6.5 亿美元增长融资,由 Disruptive 和 Infinitum 领投。 Groq 目前全球运营 13 个数据中心,覆盖北美、欧洲、中东和亚太,服务超 500 万开发者。新资金将用于部署最新推理技术(含 NVIDIA LPX 系统),目标 2027 年底扩展至 200MW。管理层新增 COO Alan Rice,CTO Sinclair Schuller 和 CPO Rakesh Malhotra 将于 7 月就任。 ---

#09融资与战略

亚马逊开始商谈对外直接出售自研 Trainium 芯片

亚马逊 AI 主管彼得·德桑蒂斯透露,公司已开始商谈向外部公司直接出售自研 AI 芯片 Trainium。 目前 Trainium 芯片主要通过 AWS 以云服务形式提供,最新 Trainium3 接近售罄,Trainium4 引起广泛关注。德桑蒂斯表示外售不会影响 AWS 的 AI 云业务。 ---

#10融资与战略

SpaceX 向 Reflection AI 出租算力,合同最高 63 亿美元

开源 AI 公司 Reflection AI 与 SpaceX 签署算力协议,7 月起每月支付 1.5 亿美元获取 Nvidia GB300 AI 芯片使用权。 合同持续至 2029 年,总价值最高 63 亿美元,但三个月后任一方可提前 90 天终止。这是迄今宣布的规模最大的开放 AI 基础设施承诺之一。 ---

#11融资与战略

美光与 Anthropic 宣布战略合作,涵盖内存、存储、Claude 应用与投资

美光与 Anthropic 宣布战略合作,涵盖 AI 内存与存储架构设计、HBM/DRAM/SSD 供应协议、Claude 企业级应用和美光对 Anthropic H 轮战略投资四大领域。 这是 Anthropic 首次与内存厂商建立如此广泛的战略合作关系。 ---

Micron Investors · 2026-06-23原文
#12模型与工程

Microsoft 开源 FastContext-1.0:4B 参数子代理,SWE-bench 最高提升 5.5%、Token 节省 60%

Microsoft 正式开源 FastContext-1.0,一个专为 LLM 编码代理设计的轻量级仓库探索子代理。它将仓库探索与任务解决解耦,通过并行只读工具(READ、GLOB、GREP)返回紧凑的文件路径和行范围。在 SWE-bench Pro 上,GPT-5.4 准确率提升 5.5%,GLM-5.1 提升 5.0%;最大 Token 节省达 60.3%(GPT-5.4 on SWE-QA)。核心亮点是仅 4B 参数的 RL 探索器在 GLM-5.1 上拿到 22.5 分,超越 30B SFT 探索器的 20.0 分,且使用更少 Token。模型权重和代码已在 GitHub(microsoft/fastcontext)和 Hugging Face 上开源。 ---

Reddit r/LocalLLaMA · Hugging Face · GitHub
#13模型与工程

Grok Build 推出 /goal 自主代理命令,从对话助手升级为任务执行引擎

xAI 在 Grok Build 中推出 /goal 命令,用户只需描述目标,系统自动规划并多轮调用子代理执行任务并验证结果。该功能将 Grok 从增强型聊天机器人升级为可独立完成复杂工作流的自主代理。Elon Musk 转发确认该更新,社区反应积极。该功能上线后,Grok Build Composer 2 曾短暂出现服务中断,可能与 /goal 模式带来的负载激增有关。 ---

#14模型与工程

GLM-5.2 接入 Perplexity Agent API,搭配 Search SDK 实现检索增强推理

智谱 GLM-5.2 已正式接入 Perplexity 的 Agent API,经社区测试,与 Perplexity Search SDK 配对使用时可实现检索增强推理。GLM-5.2 的推理能力在需要实时信息检索的场景中获得了新的应用空间。 ---

#15模型与工程

Sakana AI 推出多 Agent 编排系统 Fugu,通过单一 API 动态协调多个闭源模型

Sakana AI 推出多 Agent 编排系统 Fugu,通过单一 OpenAI 兼容 API 动态协调多个闭源模型。 包含 Fugu 和 Fugu Ultra 两个版本,官方称其在编程、推理等基准中超越公开前沿模型,与 Fable 5 和 Mythos Preview 齐肩,且无出口管制风险。社区质疑该系统在闭源模型之上叠加闭源编排器,用户无法控制具体使用了哪些模型及用量,且未公布 token 消耗和成本。 论文:https://github.com/SakanaAI/fugu/blob/main/Fugutechnicalreport.pdf ---

Sakana AI · arXiv · 2026-06-23原文
#16模型与工程

百川智能与清华发布医疗大模型 Baichuan-M4,HealthBench 三项榜单世界第一

百川智能与清华大学联合发布医疗增强大模型 Baichuan-M4。 官方数据显示,在 HealthBench 及其 Hard、Professional 三个子榜单得分均列世界第一,综合得分 68.6,事实性幻觉率降至 3.3%。该模型具备深度问诊、全病程记忆、证据锚定和基于 Baichuan-Harness 架构的自主调度四项核心能力,多项医疗评测表现超过 GPT-5.5。 ---

微信公众号 · 百川智能 · 2026-06-23原文
#17模型与工程

Ai2 开源 TMax 终端 Agent 训练方案,TMax-27B 接近 Kimi K2.5

Ai2 与华盛顿大学联合发布 TMax 开源终端 Agent 强化学习训练方案。 含 14,600 个 RL 环境的数据集 TMax-15k 和基于 DPPO 的纯结果导向训练配方,训练了 2B 到 27B 五个参数规模的开源模型。TMax-9B 在 Terminal Bench 2.0 上达到 27.2%,是已知 10B 以下最强开源权重模型;TMax-27B 得分 42.7%,接近 Kimi K2.5(43.2%)。全部数据、权重及代码以 Apache 2.0 开源,为终端 Agent 研究提供了完整的开源基准和训练方案。 代码:https://github.com/hamishivi/tmax ---

#18模型与工程

京东开源 JoyAI-VL-Interaction:8B 视觉语言交互模型,胜率优于豆包和 Gemini

京东开源 8B 参数视觉语言交互模型 JoyAI-VL-Interaction。 该模型能持续观察视频流并在一秒内主动响应,在 58 个真实场景评测中胜率 77.6%-87.9%,优于豆包和 Gemini 视频通话助手。Apache 2.0 开源,含模型权重、400 万条对齐数据和五大可插拔系统服务。 ---

GitHub jd-opensource · 2026-06-23原文
#19模型与工程

百度发布 Unlimited-OCR:3B 参数单次长篇文档解析模型

百度发布 3B 参数 OCR 模型 Unlimited-OCR,主打单次长篇文档解析。 支持单张图像及多页 PDF,代码与权重已在 GitHub 和 Hugging Face 开放,支持 Transformers 和 SGLang 部署。 模型:https://huggingface.co/baidu/Unlimited-OCR ---

GitHub · Hugging Face · 2026-06-23原文
#20产品与基础设施

OpenAI Interactions API 正式 GA:跨模型、跨 Agent 的统一编排接口,成为新的默认 API

OpenAI 开发者关系负责人 Logan Kilpatrick 宣布 Interactions API 进入通用可用阶段(GA),并成为 OpenAI 新的默认 API。该 API 允许开发者在统一接口中编排多个模型和 Agent,实现跨模型协同。Interactions API 被定位为"Agent 新时代的基础设施"。目前具体技术细节和定价尚未披露,但已面向开发者和企业客户开放。 ---

X @logankilpatrick · 2026-06-22原文
#21产品与基础设施

NVIDIA 发布 Halos:为 Physical AI 机器人打造的 AI 驱动全栈功能安全系统

NVIDIA 正式发布 Halos 全栈功能安全系统,专为 Physical AI 机器人设计,解决传统安全方案在非结构化环境中的不足。Halos 利用 AI 驱动安全逻辑,使机器人能在工厂、仓库、医院等场所与人类安全协作,无需物理隔离。该系统覆盖从芯片到应用的全栈安全链路,结合 NVIDIA 已有的 Isaac 和 Metropolis 平台,形成从感知到执行的完整安全闭环。 ---

NVIDIA Developer Blog · 2026-06-22原文
#22产品与基础设施

Codex CLI 0.142.0 修复磁盘写入 Bug,新增 multi-agent delegation

OpenAI 发布 Codex CLI 0.142.0 版本,修复此前社区热议的 SQLite 日志疯狂写入磁盘问题。 该 Bug 导致年写入量约 640TB,严重损耗 SSD 寿命。Codex 员工 Vaibhav Srivastav 确认用户需通过 npm 或 bash 安装器手动升级。新版本还引入了可配置 rollout token 预算、索引 web 搜索模式、multi-agent delegation 配置,启动和会话延迟也有所降低。 参考资料:https://x.com/reachvb/status/2069202270168772997 ---

X @reach_vb · GitHub · 2026-06-23原文
#23产品与基础设施

Claude Desktop 增加多云完整支持,覆盖 AWS、Google Cloud 和 Microsoft Foundry

Anthropic 宣布通过 AWS、Google Cloud 和 Microsoft Foundry 使用 Claude Desktop 的企业已获得完整体验(Chat、Claude Cowork、Claude Code),Beta 阶段。 支持按用户 SSO、MDM 策略模板及离线安装程序,推理保持在自有云环境中,不离开企业边界。 ---

#24产品与基础设施

豆包 App 开启打车服务灰度测试,底层运力由曹操出行提供

豆包 App 灰度测试打车服务,底层运力由曹操出行提供。 用户可在对话界面用自然语言叫车,无需跳转第三方 App。 ---