返回日报索引

AI DAILY / 2026-06-19

06·19 - AI 午报:DeepSeek 识图上线 · Laguna M.1 开源 · GPT-5.5 医疗升级

今天的主线是模型能力继续向真实入口下沉:DeepSeek 把识图模式推到网页端和 App,OpenAI 把 GPT-5.5 Instant 的健康问答能力推向免费用户,腾讯 Agently Mail、Kimi Work、Perplexity Brain 都在补 Agent 的工作流入口。模型侧,Laguna M.1、GLM-5.2、豆包实时语音 3.0、LOGOS 和 Boogu-Image-0.1 继续把开源、语音、多模态和科学模型往可部署方向推。工具侧更明显:Codex Record & Replay、Claude Code Artifacts、Project Fetch 都在把“会做事的模型”变成可记录、可分享、可验证的工作系统。

16 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01产品与入口

DeepSeek 识图模式在网页端和 App 上线

DeepSeek 员工陈小康在 X 上宣布,DeepSeek 的 Vision 识图模式已在网页端和 App 端上线。 该功能面向图片理解场景,用户可以上传图片测试识别、描述和问答能力。社区反馈显示,功能可能仍在分批推送,尚未看到入口的用户需要等待或刷新客户端。 这条消息本身不等同于新大模型发布。社区有人把它和 DeepSeek 4.1 联系起来,但目前没有官方公告说明模型版本、参数、上下文或多模态训练细节。 图:DeepSeek Vision 模式界面截图。

X @PKUCXK;linux.do 社区 · 2026-06-19
#02产品与入口

OpenAI 称 GPT-5.5 Instant 健康问答能力达到 Thinking 模型水平

OpenAI 称 GPT-5.5 Instant 在健康相关问题上的表现已达到其前沿 Thinking 模型水平,并已面向 ChatGPT 免费用户开放。 官方页面写到,每周有超过 2.3 亿人向 ChatGPT 咨询健康和身心健康问题;新版模型更擅长识别可能需要紧急护理的情况,也会询问背景并解释不确定性。 OpenAI 同时发布了有益行为强化学习研究,称在 12 个领域的真实对话中加入少量有益特征数据后,模型在 53 项独立评估中有 44 项优于计算量匹配基线,覆盖欺骗、奖励黑客、安全、健康和心理等方向。医疗场景仍应由专业人士判断,官方也没有把这些结果表述为临床诊断替代。 图:OpenAI 健康问答能力更新页面截图。

OpenAI · 2026-06-19;OpenAI Alignment Research · 2026-06-19
#03产品与入口

ChatGPT 更新发音指导、世界杯赛事追踪和连接应用权限控制

OpenAI 在 ChatGPT Release Notes 中记录了 Web、iOS 和 Android 端的新功能,包括发音指导、世界杯赛事追踪和连接应用权限控制。 发音指导支持 60 多种语言,可以在对话里返回文本和音频形式的发音帮助。世界杯功能允许用户查询赛程、对阵、球队、球员和赛事预测。 连接应用权限控制是更偏管理侧的更新。用户可以设置 ChatGPT 在调用已连接应用前何时询问授权,减少后台自动访问外部应用时的不确定性。

OpenAI Help Center · 2026-06-19
#04产品与入口

腾讯 QQ 邮箱团队内测 Agently Mail,面向 Agent 的专属邮箱服务

腾讯 QQ 邮箱团队推出 Agently Mail,定位为面向 Agent 的专属邮箱服务,目前处于内测阶段。 该服务域名为 agent.qq.com,强调与个人邮箱隔离,并通过 Agently Mail CLI 接入 Agent 工作流。用户需要微信扫码登录和授权。 从入口设计看,Agently Mail 解决的是 Agent 收发邮件时的身份、授权和隔离问题,而不是把个人邮箱直接暴露给自动化代理。社区反馈提到,一个用户可能创建多个 Agent 邮箱地址,但服务额度和授权边界仍需以官方页面为准。

腾讯 Agently Mail · 2026-06-19原文
#05产品与入口

Kimi Work 与 Perplexity Brain 分别补上长程自主工作和 Agent 记忆

月之暗面升级 Kimi Work 电脑客户端,Perplexity 则为其 Computer Agent 推出 Brain 记忆系统。 Kimi Work 新增「目标模式」与「插件中心」,官方称目标模式支持 Agent 在无需人工干预下连续工作 24 小时,插件中心可连接飞书、Notion、百度网盘、钉钉等应用。 Perplexity Brain 更偏 Agent 自我改进。官方博客称,Brain 会记录 Agent 的工作过程,并在夜间审查上下文图以减少模型调用、改善输出质量。早期测试数据显示任务正确率提升 25%,目前以 Research Preview 形式面向 Max 和 Enterprise Max 用户开放。 ---

月之暗面 Kimi Work;Perplexity · 2026-06-19
#06模型与开源

poolside 开源 Laguna M.1,225B MoE、Apache 2.0、面向智能体编程

poolside 发布并开源 Laguna M.1,总参数量 225B,每 token 激活 23B 参数,许可证为 Apache 2.0。 模型采用 MoE 架构,面向智能体编程和长周期任务,支持 262K 上下文窗口。官方博客和 Hugging Face 模型卡片已上线。 公开指标显示,Laguna M.1 在 SWE-bench Verified 上达到 74.6%,SWE-bench Multilingual 为 63.1%,SWE-bench Pro 为 49.2%,Terminal-Bench 2.0 为 45.8%。官方称模型已获得 vLLM、SGLang 和 TensorRT-LLM 的上游支持,并可配合 poolside 自家的 agent 工具 pool 部署。 图:Laguna M.1 发布信息图。

poolside · 2026-06-19;Hugging Face;Reddit r/LocalLLaMA
#07模型与开源

GLM-5.2 本地部署突破,4×3090 运行 744B 量化版,AA-Briefcase 跑分靠前

GLM-5.2 本周在本地部署和知识工作评测上同时出现新进展。 llama.cpp 和 Unsloth Studio 已支持 GLM-5.2 的 GGUF 量化格式,社区用户在 4 块 RTX 3090、96GB VRAM 和 192GB DDR5 内存配置上,通过专家卸载运行 744B 参数 2-bit 量化版,解码速度约 7.3 tok/s。 社区测试还发现,将量化从 IQ2M 降至 IQ1M 对速度无明显提升,而 CPU 线程数从 6 增至 12 带来约 22% 加速,说明卸载专家后的瓶颈更接近 CPU 计算。Artificial Analysis 新发布的 AA-Briefcase 知识工作基准中,GLM-5.2 (max) 位列前排;Hugging Face 也限时免费提供 GLM-5.2 API 调用。

Reddit r/LocalLLaMA;Artificial Analysis;linux.do;X @ZixuanLi_ · 2026-06-19
#08模型与开源

火山引擎上线豆包实时语音模型 3.0 API 并开启邀测

火山引擎上线豆包实时语音模型 3.0 API 服务,并开启邀测。 官方称这是原生全双工端到端语音模型,支持持续倾听、动态判断对话节奏,并能在实时交互中调用用户自定义工具完成任务。 官方材料提到,该模型面向汽车智能座舱、AI 智能硬件终端和智能呼叫中心等企业级场景;复杂场景下抢话比例下降 40%,整体对话流畅度提升 12%。这些数字来自官方发布,尚未看到第三方独立评测。

#09模型与开源

LOGOS 与 Boogu-Image-0.1 开源,补上科学模型和多模态图像模型两条线

阿里 ATH-Token Foundry 联合中国人民大学开源统一科学大模型 LOGOS,Boogu 团队则开源 Boogu-Image-0.1 图像生成与编辑模型系列。 LOGOS 使用统一的“科学语法”把蛋白质、小分子等对象转成离散 Token 序列,官方称 LOGOS-1B 以约 1/56 的参数量在多个任务上超过 NatureLM,并在逆合成预测、口袋位点识别等任务中减少对 3D 坐标的依赖。 Boogu-Image-0.1 是 10B 参数多模态图像模型家族,包含 Base、Turbo、Edit 等变体,支持文生图、快速生成和中英双语文字渲染。项目采用 Apache-2.0 协议开源,但官方说明当前仅供研究使用,并列出了复杂姿势、图生图细节和世界知识方面的限制。 ---

ATH-Token Foundry;Boogu Team · 2026-06-19
#10智能体与开发工具

Codex 推出 Record & Replay,录制操作生成可复用 Skill

OpenAI 为 Codex 推出 Record & Replay,允许用户在 Mac 上录制重复性操作,并由 Codex 生成可复用 Skill。 官方文档称,Skill 会包含触发条件、所需输入、执行步骤和验证结果,用户之后可以在新会话中调用同一个 Skill 处理类似任务。 该功能依赖 Computer Use,目前仅限 macOS 端,且不面向欧洲经济区、英国和瑞士开放。它的重点不是“宏录制”本身,而是把一次人工演示转换成可检查、可编辑、可复用的自动化说明。 图:Codex Record & Replay 官方演示首帧,已从 GIF 转为 PNG。

OpenAI Developers · 2026-06-19;OpenAI Codex Changelog;X @OpenAIDevs
#11智能体与开发工具

Claude Code 推出 Artifacts,把编码过程转成团队可查看的交互页面

Anthropic 为 Claude Code 推出 Artifacts 功能,可把编码会话上下文生成实时更新的交互式网页。 官方称 Artifacts 默认私有,分享范围限制在同一组织内的认证成员,不能公开发布。内部测试中最高频的场景是调试,也可用于 PR 走查和代码审计。 该功能以 Beta 形式面向 Claude Team 和 Enterprise 组织开放,支持通过 CLI 和桌面应用生成。个人用户暂不可用。

Anthropic · 2026-06-19;Claude Docs;X @claudeai
#12智能体与开发工具

Anthropic Project Fetch 第二阶段:Claude 控制机器狗快过人类团队,但仍未完成取球

Anthropic 发布 Project Fetch 第二阶段,测试 Claude Opus 4.7 自主控制四足机器人取回沙滩球。 官方称,在 Claude Code 中全自主运行的 Opus 4.7,在连接传感器、编写控制程序等任务上比去年最快人类团队配合 Opus 4.1 快约 18.9 倍。 实验没有完成最终取球任务。Anthropic 的结论更谨慎:模型已经能更快生成和迭代机器人控制代码,但端到端物理操控仍没有被完全解决。 图:Project Fetch 第二阶段实验截图。

Anthropic Research · 2026-06-19;X @AnthropicAI
#13智能体与开发工具

2-bit GGUF 校准让 9.74 GiB 模型在智能体编程任务上接近更大体积量化版本

社区开发者基于 Qwopus3.6-27B-Coder 发布 2-bit GGUF 量化模型,在 SWE-rebench 智能体编程基准上达到 63% 通过率。 该模型大小为 9.74 GiB,测试结果与 19.5 GiB 的 Q5KM 量化版本接近。 这次校准使用 Claude Code、Qwen Code 等真实智能体编程日志构建重要性矩阵,并配合 MTP 投机解码保护工具调用通道。作者报告的 10 个真实编程问题中,IQ2M 量化平均步数 51.6,平均 token 784K,工具错误率 12.6%。该结果来自社区单点测试,仍需更多任务和硬件配置复现。 ---

Reddit r/LocalLLaMA · 2026-06-19原文
#14公司、医疗与风险

Midjourney Medical 成立,Grok 进入 Databricks Agent Bricks 和 Word 插件

Midjourney 宣布成立 Midjourney Medical,xAI 则把 Grok 接入 Databricks Agent Bricks,并推出 Word 插件。 Midjourney Medical 的公开信息仍少,公开材料提到其计划探索超声波全身扫描服务,但实际产品、临床验证和上线时间仍需等待更多正式披露。 Grok 侧的更新更接近企业和办公入口。Databricks Agent Bricks 用户可把 Grok 与企业数据结合构建 AI 智能体;Word 插件支持文档起草、研究总结和图表生成。Grok TTS 也在官方账号中被强调为接近人类的语音合成模型。

X @midjourney;Databricks;X @grok · 2026-06-19
#15公司、医疗与风险

OpenAI 同步补企业支出控制和前沿政策团队,Dean Ball 将加入 Strategic Futures

OpenAI 为 ChatGPT Enterprise 推出使用分析和支出控制,同时前白宫 AI 政策顾问 Dean W. Ball 宣布将加入 OpenAI。 企业功能允许管理员设置月度预算上限、按部门分配额度并监控使用量,面向的是企业内部 AI 成本透明度和管控。 Dean Ball 将于 7 月 6 日加入 OpenAI,领导新成立的 Strategic Futures 团队,并向首席战略官 Jason Kwon 汇报。根据 Ball 自述和媒体报道,该团队会处理前沿 AI 政策、内部治理、灾难性风险、递归自我改进以及实验室与政府关系等议题。

OpenAI Blog;Dean W. Ball;Axios · 2026-06-19
#16公司、医疗与风险

Opus 4.8 周限异常与第三方 API 恶意提示词暴露工具链风险

linux.do 用户报告 Anthropic Opus 4.8 周限异常飙升,也有用户报告第三方 API 中转站返回恶意清理系统提示词。 Opus 4.8 事件中,有用户称单次调用后周限从 60% 拉到 95%,另有相关 GitHub 或论坛反馈,但官方尚未给出统一解释。 第三方 API 事件中,用户看到模型返回清理系统目录的恶意指令,无法确定来源是工具、上游模型还是中转站返回内容。两件事都不适合扩写成官方结论,但足以提醒:智能体工具链中的额度、上下文、供应链和提示注入风险需要在发布和执行前单独检查。 ---