返回日报索引

AI DAILY / 2026-06-25

06·25 - AI 午报:Anthropic 指控阿里蒸馏攻击;GPT-5.5 Instant 更新;Gemini Computer Use 上线

今天最大的新闻是 Anthropic 致信美国参议院,指控阿里巴巴通过 2.5 万个欺诈账户与 Claude 进行 2880 万次交互,构成"迄今已知最大规模的蒸馏攻击"。同一时间,OpenAI 为其使用量最大的模型 GPT-5.5 Instant 推送了新版本,谷歌在 Gemini 3.5 Flash 上线了 Computer Use 能力但将 3.5 Pro 推迟至 7 月。开源社区方面,Gemma4 无审查版发布并集成 MTP 投机解码加速,Gefen 优化器宣称可将训练内存降低 8 倍。国产模型中,GLM-5.2 陆续接入 Cursor 和 Devin Desktop,M3 成为 Kimchi Coding 的默认构建模型。

9 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01模型与新发布

Anthropic 指控阿里巴巴发动大规模"蒸馏攻击"窃取 Claude 能力

Anthropic 于 6 月 10 日致信美国参议院银行委员会主席 Tim Scott 和资深成员 Elizabeth Warren,指控阿里巴巴通过近 2.5 万个欺诈账户,在 2026 年 4 月 22 日至 6 月 5 日期间与 Claude 进行了超过 2880 万次交互,非法提取 Claude AI 模型能力。Anthropic 称这是"迄今已知最大规模的蒸馏攻击",参与方包括阿里巴巴及其 AI 实验室 Qwen。 蒸馏技术指用弱模型学习强模型输出以复制其能力。Anthropic 认为这一行为可能帮助中国加速追赶其 Mythos Preview 等先进模型。该信正值国会 AI 听证会前夕发出,阿里巴巴尚未回应。 事件背景包括:白宫 4 月指责中国大规模窃取美国 AI 知识产权;6 月 12 日美国商务部以国家安全为由限制 Anthropic 的 Mythos 和 Fable 模型出口;本月阿里巴巴还被列入五角大楼"中国军事公司"清单,公司正在起诉挑战。

CNBC / Reuters · 2026-06-24原文
#02模型与新发布

GPT-5.5 Instant 推送新版本,对话更有趣

OpenAI 于 6 月 24 日通过官方 X 账号宣布,GPT-5.5 Instant 已推出新版本,称其"对话体验更有趣、理解能力更强"。GPT-5.5 Instant 是 OpenAI 目前使用量最大的模型,此次更新聚焦于对话自然度和理解准确性的提升。OpenAI 未在公告中提供具体技术细节或 benchmark 数据,仅邀请用户试用体验。

#03模型与新发布

Gemini 3.5 Flash 上线 Computer Use 能力

Google DeepMind 宣布在 Gemini 3.5 Flash 中引入"Computer Use"能力,使模型能够像人类一样操作计算机界面——包括移动光标、点击按钮、填写表单等。该功能基于模型对屏幕截图的理解和动作生成,目标是推动 AI Agent 从对话式交互向实际环境操作演进。目前该功能处于早期预览阶段,仅通过 API 提供,且存在操作准确性和安全性方面的限制。实际测试中,模型在部分复杂 UI 场景中仍会出现定位偏差和误操作。

Google DeepMind Blog · 2026-06-24原文
#04模型与新发布

谷歌 Gemini 3.5 Pro 发布日期推迟至 7 月

据 Business Insider 报道,谷歌下一代前沿 AI 模型 Gemini 3.5 Pro 的发布日期已从 6 月推迟至 7 月。谷歌需要更多时间收集早期测试用户的反馈并优化模型。该模型已在谷歌 Antigravity 平台和基准测试网站 LMArena 向部分用户开放试用,预计在长周期任务处理和 Agent 驱动方面表现更优。 谷歌在 5 月 I/O 大会上预告了该模型,CEO 皮查伊曾表示 6 月发布。但在 Anthropic 和 OpenAI 在代码生成领域持续领先的压力下,谷歌选择延后以确保质量。谷歌发言人对此拒绝置评。 ---

Business Insider · 2026-06-24原文
#05开源与工具

Gemma4 无审查版 + MTP 加速发布:26B-A4B 和 31B 版本

社区开发者 HauhauCS 在 HuggingFace 发布了 Gemma4-26B-A4B 和 Gemma4-31B 的 QAT 无审查平衡版(Balanced),两个版本均集成了多令牌预测(MTP)投机解码头,分别带来约 35% 和 53% 的推理速度提升,且输出质量无损。 两个模型在 465 个测试提示上实现零拒绝。26B-A4B 为 MoE 架构(128 专家,每令牌激活约 4B 参数),31B 为稠密模型,均支持 262K 上下文和视觉输入。仅提供 Q4KM 量化——因 Gemma 4 为量化感知训练(QAT),更高精度收益有限。模型可通过 llama.cpp 的 --spec-type draft-mtp 参数启用 MTP 投机解码。

HuggingFace / Reddit r/LocalLLaMA · 2026-06-25原文
#06开源与工具

Gefen 优化器:训练内存降低 8 倍,AdamW 即插即用替代

一个新优化器 Gefen 作为 AdamW 的即插即用替代方案,声称在训练大模型时可减少 8 倍内存占用。该优化器通过改进梯度统计的存储方式显著降低显存需求,同时保持模型收敛质量。论文已发布在 arXiv(2606.13894),开源代码可在 GitHub(ndvbd/Gefen)获取。但论文尚未提供大规模基准测试结果,实际效果有待社区进一步验证。

arXiv / GitHub · 2026-06-24原文
#07开源与工具

GLM-5.2 接入 Cursor、Devin Desktop 和 Windsurf

智谱 AI 的 GLM-5.2 模型在开发者工具生态中持续扩展。继此前接入 Cursor 后,GLM-5.2 现已同时支持 Devin Desktop(Windsurf)及其 CLI 版本。开发者可在这些主流 AI 编程环境中直接调用该模型进行代码生成和辅助编程。据 OpenRouter 的 Cursor 使用量排名,GLM-5.2 在过去一周表现强劲。目前信息来自社交媒体转发,缺乏官方公告和详细性能数据。

#08开源与工具

MiniMax M3 成为 Kimchi Coding 默认构建模型

MiniMax 宣布其开源模型 M3 已成为智能代码生成平台 Kimchi Coding 的默认构建模型。Kimchi Coding 由 CAST AI 开发,可根据任务复杂度、成本和部署需求自动路由到不同模型。M3 凭借开放权重、100 万 token 上下文窗口和编码能力被选为默认选项。开发者使用 Kimchi Coding 时将默认获得 M3 的编码能力,平台同时支持按需切换其他模型。 ---

X @MiniMax / @cast_ai · 2026-06-24原文
#09资本与人事

谷歌两名 Gemini 核心骨干转投 Anthropic

谷歌两名 Gemini 核心骨干研究人员于 2026 年 6 月离职,加入 Anthropic。这是谷歌近期 AI 人才流失的又一案例。Anthropic 借此增强团队实力,加速 Claude 模型的迭代。此前媒体报道,谷歌已有多名 AI 研究人员流向 Anthropic 和 OpenAI 等竞争对手。具体离职人员姓名和原因尚未披露。 ---