返回日报索引

AI DAILY / 2026-06-27

06·27 - AI 午报:GPT-5.6 Sol/Terra/Luna 三档首发,Mythos 5 部分解禁

今天的主线是 OpenAI 正式发布 GPT-5.6 系列:旗舰 Sol、中端 Terra、入门 Luna 三档齐发,Sol 在 Terminal-Bench 2.1 刷新最先进成绩,但受美国政府要求,目前仅通过 Codex 和 API 向少数可信合作伙伴提供有限预览。与此同时,Anthropic 宣布 Mythos 5 获得美国政府批准,可重新部署给一批运营和防御关键基础设施的美国组织——两周前因出口管制被叫停的模型开始部分解禁。NVIDIA 则连续放出 Nemotron-3-Super 混合架构实测和 DFlash 推测解码,从模型架构和推理基建两侧推进。

8 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01模型与新发布

OpenAI 发布 GPT-5.6 系列:Sol/Terra/Luna 三档,仅向受信任合作伙伴开放有限预览

OpenAI 于 6 月 26 日发布 GPT-5.6 系列,包含三档模型:旗舰 Sol、中端 Terra 和入门 Luna。 Sol 被定位为 OpenAI 当前最强模型。在编码、生命科学和网络安全任务上相比 GPT-5.5 有显著提升,新增 max 推理强度(更深度推理)和 ultra 模式(多个子智能体协同处理复杂任务)。Sol 在 Terminal-Bench 2.1 上取得新的最先进成绩。由于能力增强带来更高滥用风险,OpenAI 采取了分阶段发布策略:目前仅通过 Codex 和 API 向少数可信合作伙伴提供有限预览,计划未来几周逐步扩大范围。 Terra 面向日常工作场景,性能对标 GPT-5.5 但成本降低约一半。Luna 为快速低成本模型,适合高频、成本敏感任务。 定价(每百万 token):Sol 输入 $5 / 输出 $30,Terra 输入 $2.50 / 输出 $15,Luna 输入 $1 / 输出 $6。Cerebras 计划 7 月提供最高约 750 tokens/s 的 Sol 访问。 安全方面,OpenAI 为 GPT-5.6 配备了迄今最严密的安全防护栈:模型自身拒绝违规网络安全请求、实时检测生成内容、必要时暂停输出并交由更强模型复核、账号级风险审查等。官方表示 Sol 未达到「Cyber Critical」门槛,但单一基准无法覆盖模型组合使用后的全部风险。

#02模型与新发布

NVIDIA Nemotron-3-Super 混合 Mamba+MoE:社区实测 504K token 针检索全对

Reddit 用户 ImportantQuote1180 在 4×RTX 3090 上实测了 NVIDIA Nemotron-3-Super-120B-A12B(i1-Q4KS 量化,71 GB),展示出混合 Mamba2+MoE 架构在长上下文场景的显著优势。 该模型在 504,482 token 的针检索测试中各项深度均完美召回,无一次遗漏。解码速度随上下文增长平缓下降:短上下文 72 t/s → 30K 时 67 t/s → 504K 时 23 t/s。相比之下,同等体量的全注意力 MoE 模型 MiniMax-M2.7-REAP 在 30K 时仅 24.5 t/s——Nemotron 在 504K 的解码速度与它在 30K 时相当,相当于长上下文效率提升约 20 倍。 关键机制:Mamba 层使用固定大小的循环状态替代增长的 KV 缓存,仅少量注意力层保留 KV(仅 2 个 KV 头)。代价是存在近因偏差——测试中埋藏在上下文前部的指令会被后部矛盾指令覆盖,建议将硬性规则放在末尾或 system prompt 中。 ---

Reddit r/LocalLLaMA · 2026-06-27原文
#03政策与人事

Anthropic Mythos 5 获美国政府批准部分解禁

Anthropic CEO Dario Amodei 于 6 月 27 日在 X 平台宣布,经过两周与美国政府的密切合作,Mythos 5——Anthropic 最强的网络安全模型——已获批准重新部署给一批运营和防御关键基础设施的美国组织。 自 6 月 12 日起,Mythos 5 和 Fable 5 因出口管制被叫停。此次部分解禁仅覆盖 Mythos 5 且限定美国关键基础设施领域,Fable 5 状态尚未明确。

X @AnthropicAI · 2026-06-27原文
#04政策与人事

DeepSeek 因 Mythos 压力寻求 74 亿美元融资

据 The Information 报道,DeepSeek 计划进行 74 亿美元融资,直接触发因素是 Anthropic 在 4 月发布的 Mythos 预览版。DeepSeek 创始人梁文峰认为,若无更雄厚资金,公司无法在同等水平上竞争。这一融资规模反映了 AI 大模型军备竞赛中资本门槛的持续攀升。

The Information(via Linux Do)· 2026-06-27原文
#05政策与人事

《纽约时报》更新诉状,指控微软定制超算助 OpenAI 训练

《纽约时报》在针对 OpenAI 的版权诉讼中更新诉状,新增指控微软为 OpenAI 定制超级计算机,专门用于训练其 AI 模型。诉状认为微软通过提供定制化算力基础设施深度参与了侵权模型的开发,可能改变案件的法律责任认定。微软和 OpenAI 尚未回应。 ---

#06基础设施与工具

NVIDIA 发布 DFlash 推测解码,Blackwell 推理性能提升最高 15 倍

NVIDIA 推出 DFlash 推测解码技术,在 Blackwell GPU 上可将 LLM 推理性能提升最高 15 倍。该技术利用轻量级草稿模型并行生成多个候选 token,再由目标模型批量验证,突破自回归生成的序列化瓶颈,显著提高 GPU 利用率。DFlash 特别适用于多智能体工作流等对延迟敏感的场景。

NVIDIA Technical Blog · 2026-06-26原文
#07基础设施与工具

ContextForge 开源:本地 LLM 长期记忆 SDK

开发者 Betanu701 发布 ContextForge,一个面向本地 LLM 的长期记忆 SDK。核心思路是将上下文窗口视为工作集而非记忆:通过 SQLite 存储全部历史、构建轻量索引、每步重建最小工作集,实现近乎无限的上下文而不膨胀 prompt。 在 180 天和 500 天模拟运行中,该方法比 MemPalace 等方案更稳定、更快、更一致。SDK 兼容 GPT 类模型。

Reddit r/LocalLLaMA · 2026-06-27原文
#08基础设施与工具

NVIDIA AI-Q Blueprint 登陆 Oracle Cloud

NVIDIA 发布 AI-Q Blueprint 开源参考架构,支持在 Oracle Cloud Infrastructure 上部署生产级 AI 智能体。该蓝图面向长周期任务智能体,可规划多步骤、拆分子任务、保持上下文并在安全沙箱中运行工具。OCI 用户可通过 NVIDIA GPU 实例快速部署。 ---