返回日报索引

AI DAILY / 2026-06-18

06·18 - AI 午报:GLM-5.2 登顶开源榜,Shazeer 加盟 OpenAI

GLM-5.2 在 LiveBench 和 Vals Index 双双登顶开源 SOTA,社区对国产模型刷榜与否存在争论。Noam Shazeer 正式加盟 OpenAI 领导架构研究。GPT-5.4 与 Maria AI 协作完成药物化学端到端实验,耗时 2.5 个月获得实验室验证。美国暂缓将 DeepSeek 列入出口管制黑名单。

12 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01模型与新发布

GLM-5.2 登顶 LiveBench 与 Vals Index

智谱 GLM-5.2 在 LiveBench 上取得与 Claude 4.6 Opus high 持平的成绩,考虑国产模型语言平均偏后,有用户认为性能对标 GPT-5.4 xhigh 甚至 GPT-5.5 xhigh。同时,ValsAI 确认 GLM-5.2 在 Vals Index、Vibe Code Bench 和 Terminal Bench 上取得开源权重模型 SOTA,全部模型(含闭源)排名第五。 LiveBench 被视为目前未被系统性刷榜的基准之一,但用户指出国产模型存在语言平均偏低、Gemini 首发版不反映降智后水平、测试链路偏短等局限。社区对 GLM-5.2 是真实进步还是针对性刷榜存在分歧,缺乏来自官方 coding plan 的大规模实测反馈。

#02模型与新发布

xAI 发布 Grok Imagine 1.5

Elon Musk 在 X 宣布推出 Grok Imagine 1.5,系 xAI 旗下图像生成模型最新版本。消息仅通过一条推文发布并附带视频预览,未提供技术细节、性能数据或可用性说明。

#03模型与新发布

DeepSeek 识图模式全量推送

DeepSeek 识图模式结束灰度测试,已向全量用户推送。该功能支持上传图片并基于图像内容问答。目前官方未发布正式公告,亦未说明该模式基于 v4 还是传闻中的 v4.1 模型。此前社区对 v4.1 发布的猜测持续升温,但无实锤。

#04模型与新发布

Inflect-Nano:仅 4.63M 参数的 TTS 模型

开发者发布 Inflect-Nano-v1,一个仅 4.63M 参数的极小型 TTS 模型。其中 3.46M 为声学模型、1.17M 为声码器,支持 24kHz 音频输出,仅限英语单男声。相比 Kokoro 小约 17 倍,比 Fish Audio S2 Pro 小近 1000 倍。质量有限,可能带有机械感,但为嵌入式设备和离线助手场景提供了极轻量基线。 ---

#05资本与人事

Noam Shazeer 加盟 OpenAI

OpenAI 研究员 Noam Brown 在 X 宣布,Transformer 架构共同发明人 Noam Shazeer 加入 OpenAI,出任架构研究负责人。Shazeer 曾参与 Google LaMDA 项目,联合创办 Character.AI 并担任 CEO,其加盟被社区视为 OpenAI 在基础模型和对话 AI 方向的重要人才引进。 多条 OpenAI 员工推文交叉印证了该消息,但公司层面尚未发布官方公告。

#06资本与人事

林俊阳 AI 实验室完成新一轮融资

原 Qwen 系列大模型负责人林俊阳(Lin Junyang)创立的 AI 实验室已完成新一轮融资,估值达到 20 亿美元。林俊阳在阿里巴巴期间主导了 Qwen 系列模型的研发,其新实验室被开源社区寄予厚望——期待新一代高性能开源大模型的诞生。该消息来自 Reddit 社区披露,尚未获得官方确认。

Reddit r/LocalLLaMA(社区转述,未获官方确认)原文
#07资本与人事

泄露文件显示 OpenAI 年亏损数十亿美元

Reddit 用户泄露的财务文件显示,OpenAI 每年亏损数十亿美元。尽管 ChatGPT 等产品收入增长迅速,但高昂的算力成本和研发投入导致持续巨额亏损。该消息未得到 OpenAI 官方证实,数据来源和真实性存疑。 ---

Reddit r/LocalLLaMA(未经独立核实)原文
#08治理与生态

美国暂缓将 DeepSeek 列入出口管制黑名单

据消息人士透露,美国政府暂缓将 DeepSeek 及超过 100 家其他中国企业列入出口管制黑名单。目前这些企业被认定构成安全风险但尚未正式制裁。该消息仅来自社交媒体,缺乏官方确认,可能影响全球 AI 供应链及中美科技竞争格局。

Reddit r/LocalLLaMA(引用匿名消息源,未经独立核实)原文
#09治理与生态

Anthropic 与 DeepMind CEO 在 G7 呼吁建立 AI 联盟

Anthropic CEO Dario Amodei 与 Google DeepMind CEO Demis Hassabis 在 G7 会议期间联合呼吁建立美国主导的 AI 联盟,以协调 AI 安全标准并应对中国在 AI 领域的竞争。该提议的目标是推动 G7 国家在 AI 治理上形成统一阵线,但具体机制和参与范围尚未明确。 ---

#10研究与工具

GPT-5.4 驱动药物化学端到端研究

OpenAI 宣布其 GPT-5.4 模型与 Maria AI 及专用实验室协作,完成了一个药物化学项目的端到端流程——从文献调研到实验验证。模型提出了一种改进 Cha-Lam 偶联反应的方法,该方法被药物化学家广泛用于构建药物分子。整个流程耗时约 2.5 个月,另加半月由人类化学家撰写结果报告。 Cha-Lam 偶联是药物发现中的核心反应,其中一个变体此前因产率低从未被文献报道。GPT-5.4 分析文献后提出了一种非直觉性的反应条件优化方案,并最终通过了实验室验证。

#11研究与工具

Fable 5 遗作:Gemma 4 E2B 浏览器内推理

社区团队在 Fable 5 关闭前利用其 WebGPU 内核优化,在 M4 Max 上实现 Gemma 4 E2B 模型的浏览器内推理,速度约 255 tok/s。代码已开源,可在 Hugging Face 上直接体验。Fable 5 关闭后该项目后续维护存在不确定性。

#12研究与工具

llama.cpp 新增模型管理 API

llama.cpp 合并 PR #23976,新增通过 API 管理模型生命周期的能力,包括按需加载/卸载本地模型及按需下载模型。UI 尚未就绪但即将推出。此功能让用户仅通过 API 即可完成 llama.cpp 的部署和模型全生命周期管理,简化了本地推理服务的运维。