#01 安全与监管
OpenAI Daybreak 安全矩阵齐发:GPT-5.5-Cyber、Codex Security、Patch the Planet Sam Altman 宣布 OpenAI Daybreak 项目全面扩展,一次性向安全领域投入三个核心产品。GPT-5.5-Cyber 完整版在 CyberGym 基准上达到最先进水平,可追踪漏洞代码、验证问题、开发补丁并准备证据供人工审查。Codex Security 插件让开发者在 Codex 内直接完成发现、验证和修复漏洞的闭环,支持深度扫描、攻击路径追踪、威胁建模和代码库专属补丁生成。Patch the Planet 计划联合 Trail of Bits、HackerOne 等安全研究机构,使用前沿 AI 帮助开源维护者将安全发现转化为已合并的修复补丁。同期启动的 Cyber Partner Program 允许合作伙伴在其安全产品中集成 GPT-5.5 with Trusted Access for Cyber。 ---
#02 安全与监管
Chat Template 成提示词注入新攻击面:开源模型系统提示、Tool 调用区域均可嵌入恶意 Payload 开源大模型的 Chat Template(对话模板)被发现是提示词注入攻击的新突破口。攻击者利用已知的 Jinja2 模板结构,在系统提示词区域、Tool 调用标签、think 标签等位置嵌入恶意 payload,可绕过模型的安全对齐。以 DeepSeek-R1 为例,bostoken 后的系统提示词区域、tool 调用前后的标记位均可被注入,且注入效果在对话上下文中持续存在。该攻击手法对商业部署的开源模型同样有效,研究者在腾讯元宝、深度求索等在线服务上完成了验证。 ---
#03 安全与监管
EU AI Act 自 8 月 2 日起要求 AI 生成文本必须添加机器可读水印 欧盟 AI 法案将于 2026 年 8 月 2 日正式生效文本水印条款。所有生成合成文本的 AI 系统提供商必须确保输出可被机器标记和检测为 AI 生成,使用技术方案使文本"machine-readable and detectable"。违规罚款最高 3200 万美元。该条款影响范围远超音频水印要求——所有优质开源模型都需要适配。Reddit LocalLLaMA 社区讨论指出,该法案适用全球范围,不限欧盟境内用户。 ---
Reddit r/LocalLLaMA · 2026-06-23 原文 #04 融资与战略
DeepSeek 完成 74 亿美元融资、估值 600 亿,梁文锋个人出资 30 亿美元 DeepSeek 完成新一轮 74 亿美元融资,估值达到 600 亿美元。创始人梁文锋个人出资 30 亿美元,成为本轮最大单一投资者,其持股比例和公司控制权进一步增强。该轮资金将用于扩大 AI 模型训练集群和全球推理基础设施部署。此轮估值相比上一轮大幅跃升,反映市场对 DeepSeek 模型能力的认可,也加剧了国内大模型赛道的资本竞争烈度。 ---
Reddit r/LocalLLaMA · 2026-06-22 原文 #05 融资与战略
字节豆包多模型集中发布:Seed 2.1 Pro、视频/生图模型,Arena 现身神秘 code 模型 groudon 火山引擎大会于 6 月 22 日正式发布豆包系列新模型:豆包 Seed 2.1 Pro(语言)、豆包视频模型 2.1、生图模型 5.0 正式版。其中 Seed 2.1 Pro 此前已在火山方舟 coding plan 中灰度测试——约 1/3 用户被路由到该模型,社区实测 1M 上下文窗口、maxtokens 131K、tps 约 100,在 one-shot SVG 生成测试中被评为接近 GPT-5.6 和 Fable 5。与此同时,Arena 平台还出现了一个代号 groudon 的神秘 code 模型,未出现在官方公告中,具体参数和能力不明。此外豆包视频生成模型 Seedance 2.5 预计 7 月初开放 API,支持最长 30 秒视频生成和 4K 分辨率。 ---
#06 融资与战略
SK Hynix 将部分 HBM 产能转向通用 DRAM,利润导向调整 据韩媒 biz.chosun 报道,SK Hynix 正在推迟原计划转换为 HBM4 的部分第五代 HBM3E 生产线,转而用于增加通用 DRAM 产能。原因是当前通用 DRAM 的运营利润率高于 HBM。这一调整可能缓解消费级 DRAM 的供应紧张——此前 TrendForce 已预警 AI 挤占产能导致 DDR2/DDR3 价格暴涨 60%。但同时也可能影响 HBM4 的供应节奏,对依赖高带宽内存的下一代 AI 训练芯片构成潜在约束。 ---
biz.chosun · 2026-06-23 原文 #07 融资与战略
智谱市值突破万亿港元,较发行价上涨 2076% 智谱总市值首次突破 1 万亿港元,达 11,253 亿港元,较年初发行价上涨 2076%。 此前智谱发布并开源旗舰模型 GLM-5.2,在 Code Arena 排名总榜第二、全球可用模型第一。马斯克评论称中国或许 2027 年 Q1 可达到 Fable 级别,智谱创始人唐杰回应「用不了那么久」。 ---
#08 融资与战略
Groq 完成 6.5 亿美元增长融资,目标 2027 年底扩展至 200MW AI 推理云公司 Groq 获 6.5 亿美元增长融资,由 Disruptive 和 Infinitum 领投。 Groq 目前全球运营 13 个数据中心,覆盖北美、欧洲、中东和亚太,服务超 500 万开发者。新资金将用于部署最新推理技术(含 NVIDIA LPX 系统),目标 2027 年底扩展至 200MW。管理层新增 COO Alan Rice,CTO Sinclair Schuller 和 CPO Rakesh Malhotra 将于 7 月就任。 ---
Groq Newsroom · 2026-06-23 原文 #09 融资与战略
亚马逊开始商谈对外直接出售自研 Trainium 芯片 亚马逊 AI 主管彼得·德桑蒂斯透露,公司已开始商谈向外部公司直接出售自研 AI 芯片 Trainium。 目前 Trainium 芯片主要通过 AWS 以云服务形式提供,最新 Trainium3 接近售罄,Trainium4 引起广泛关注。德桑蒂斯表示外售不会影响 AWS 的 AI 云业务。 ---
TechCrunch · 2026-06-18 原文 #10 融资与战略
SpaceX 向 Reflection AI 出租算力,合同最高 63 亿美元 开源 AI 公司 Reflection AI 与 SpaceX 签署算力协议,7 月起每月支付 1.5 亿美元获取 Nvidia GB300 AI 芯片使用权。 合同持续至 2029 年,总价值最高 63 亿美元,但三个月后任一方可提前 90 天终止。这是迄今宣布的规模最大的开放 AI 基础设施承诺之一。 ---
TechCrunch · 2026-06-22 原文 #11 融资与战略
美光与 Anthropic 宣布战略合作,涵盖内存、存储、Claude 应用与投资 美光与 Anthropic 宣布战略合作,涵盖 AI 内存与存储架构设计、HBM/DRAM/SSD 供应协议、Claude 企业级应用和美光对 Anthropic H 轮战略投资四大领域。 这是 Anthropic 首次与内存厂商建立如此广泛的战略合作关系。 ---
Micron Investors · 2026-06-23 原文 #12 模型与工程
Microsoft 开源 FastContext-1.0:4B 参数子代理,SWE-bench 最高提升 5.5%、Token 节省 60% Microsoft 正式开源 FastContext-1.0,一个专为 LLM 编码代理设计的轻量级仓库探索子代理。它将仓库探索与任务解决解耦,通过并行只读工具(READ、GLOB、GREP)返回紧凑的文件路径和行范围。在 SWE-bench Pro 上,GPT-5.4 准确率提升 5.5%,GLM-5.1 提升 5.0%;最大 Token 节省达 60.3%(GPT-5.4 on SWE-QA)。核心亮点是仅 4B 参数的 RL 探索器在 GLM-5.1 上拿到 22.5 分,超越 30B SFT 探索器的 20.0 分,且使用更少 Token。模型权重和代码已在 GitHub(microsoft/fastcontext)和 Hugging Face 上开源。 ---
Reddit r/LocalLLaMA · Hugging Face · GitHub #13 模型与工程
Grok Build 推出 /goal 自主代理命令,从对话助手升级为任务执行引擎 xAI 在 Grok Build 中推出 /goal 命令,用户只需描述目标,系统自动规划并多轮调用子代理执行任务并验证结果。该功能将 Grok 从增强型聊天机器人升级为可独立完成复杂工作流的自主代理。Elon Musk 转发确认该更新,社区反应积极。该功能上线后,Grok Build Composer 2 曾短暂出现服务中断,可能与 /goal 模式带来的负载激增有关。 ---
#14 模型与工程
GLM-5.2 接入 Perplexity Agent API,搭配 Search SDK 实现检索增强推理 智谱 GLM-5.2 已正式接入 Perplexity 的 Agent API,经社区测试,与 Perplexity Search SDK 配对使用时可实现检索增强推理。GLM-5.2 的推理能力在需要实时信息检索的场景中获得了新的应用空间。 ---
X @ZixuanLi_ · 2026-06-23 原文 #15 模型与工程
Sakana AI 推出多 Agent 编排系统 Fugu,通过单一 API 动态协调多个闭源模型 Sakana AI 推出多 Agent 编排系统 Fugu,通过单一 OpenAI 兼容 API 动态协调多个闭源模型。 包含 Fugu 和 Fugu Ultra 两个版本,官方称其在编程、推理等基准中超越公开前沿模型,与 Fable 5 和 Mythos Preview 齐肩,且无出口管制风险。社区质疑该系统在闭源模型之上叠加闭源编排器,用户无法控制具体使用了哪些模型及用量,且未公布 token 消耗和成本。 论文:https://github.com/SakanaAI/fugu/blob/main/Fugutechnicalreport.pdf ---
Sakana AI · arXiv · 2026-06-23 原文 #16 模型与工程
百川智能与清华发布医疗大模型 Baichuan-M4,HealthBench 三项榜单世界第一 百川智能与清华大学联合发布医疗增强大模型 Baichuan-M4。 官方数据显示,在 HealthBench 及其 Hard、Professional 三个子榜单得分均列世界第一,综合得分 68.6,事实性幻觉率降至 3.3%。该模型具备深度问诊、全病程记忆、证据锚定和基于 Baichuan-Harness 架构的自主调度四项核心能力,多项医疗评测表现超过 GPT-5.5。 ---
微信公众号 · 百川智能 · 2026-06-23 原文 #17 模型与工程
Ai2 开源 TMax 终端 Agent 训练方案,TMax-27B 接近 Kimi K2.5 Ai2 与华盛顿大学联合发布 TMax 开源终端 Agent 强化学习训练方案。 含 14,600 个 RL 环境的数据集 TMax-15k 和基于 DPPO 的纯结果导向训练配方,训练了 2B 到 27B 五个参数规模的开源模型。TMax-9B 在 Terminal Bench 2.0 上达到 27.2%,是已知 10B 以下最强开源权重模型;TMax-27B 得分 42.7%,接近 Kimi K2.5(43.2%)。全部数据、权重及代码以 Apache 2.0 开源,为终端 Agent 研究提供了完整的开源基准和训练方案。 代码:https://github.com/hamishivi/tmax ---
Ai2 · GitHub · 2026-06-23 原文 #18 模型与工程
京东开源 JoyAI-VL-Interaction:8B 视觉语言交互模型,胜率优于豆包和 Gemini 京东开源 8B 参数视觉语言交互模型 JoyAI-VL-Interaction。 该模型能持续观察视频流并在一秒内主动响应,在 58 个真实场景评测中胜率 77.6%-87.9%,优于豆包和 Gemini 视频通话助手。Apache 2.0 开源,含模型权重、400 万条对齐数据和五大可插拔系统服务。 ---
GitHub jd-opensource · 2026-06-23 原文 #19 模型与工程
百度发布 Unlimited-OCR:3B 参数单次长篇文档解析模型 百度发布 3B 参数 OCR 模型 Unlimited-OCR,主打单次长篇文档解析。 支持单张图像及多页 PDF,代码与权重已在 GitHub 和 Hugging Face 开放,支持 Transformers 和 SGLang 部署。 模型:https://huggingface.co/baidu/Unlimited-OCR ---
GitHub · Hugging Face · 2026-06-23 原文 #20 产品与基础设施
OpenAI Interactions API 正式 GA:跨模型、跨 Agent 的统一编排接口,成为新的默认 API OpenAI 开发者关系负责人 Logan Kilpatrick 宣布 Interactions API 进入通用可用阶段(GA),并成为 OpenAI 新的默认 API。该 API 允许开发者在统一接口中编排多个模型和 Agent,实现跨模型协同。Interactions API 被定位为"Agent 新时代的基础设施"。目前具体技术细节和定价尚未披露,但已面向开发者和企业客户开放。 ---
X @logankilpatrick · 2026-06-22 原文 #21 产品与基础设施
NVIDIA 发布 Halos:为 Physical AI 机器人打造的 AI 驱动全栈功能安全系统 NVIDIA 正式发布 Halos 全栈功能安全系统,专为 Physical AI 机器人设计,解决传统安全方案在非结构化环境中的不足。Halos 利用 AI 驱动安全逻辑,使机器人能在工厂、仓库、医院等场所与人类安全协作,无需物理隔离。该系统覆盖从芯片到应用的全栈安全链路,结合 NVIDIA 已有的 Isaac 和 Metropolis 平台,形成从感知到执行的完整安全闭环。 ---
NVIDIA Developer Blog · 2026-06-22 原文 #22 产品与基础设施
Codex CLI 0.142.0 修复磁盘写入 Bug,新增 multi-agent delegation OpenAI 发布 Codex CLI 0.142.0 版本,修复此前社区热议的 SQLite 日志疯狂写入磁盘问题。 该 Bug 导致年写入量约 640TB,严重损耗 SSD 寿命。Codex 员工 Vaibhav Srivastav 确认用户需通过 npm 或 bash 安装器手动升级。新版本还引入了可配置 rollout token 预算、索引 web 搜索模式、multi-agent delegation 配置,启动和会话延迟也有所降低。 参考资料:https://x.com/reachvb/status/2069202270168772997 ---
X @reach_vb · GitHub · 2026-06-23 原文 #23 产品与基础设施
Claude Desktop 增加多云完整支持,覆盖 AWS、Google Cloud 和 Microsoft Foundry Anthropic 宣布通过 AWS、Google Cloud 和 Microsoft Foundry 使用 Claude Desktop 的企业已获得完整体验(Chat、Claude Cowork、Claude Code),Beta 阶段。 支持按用户 SSO、MDM 策略模板及离线安装程序,推理保持在自有云环境中,不离开企业边界。 ---
Claude Blog · 2026-06-23 原文 #24 产品与基础设施
豆包 App 开启打车服务灰度测试,底层运力由曹操出行提供 豆包 App 灰度测试打车服务,底层运力由曹操出行提供。 用户可在对话界面用自然语言叫车,无需跳转第三方 App。 ---