#01模型与研究
actAVA 发布万亿参数医疗模型 Cura 1T
actAVA 发布万亿参数医疗模型 Cura 1T,基于 Kimi-K2.6 后训练,面向患者沟通、临床推理和医疗 Agent 工作流,并采用递归自我改进训练。 官方页面公布的六个医疗评测面板中,Cura 1T 在五项取得最高分,MedXpertQA 多模态位列第二;其中 HealthBench Professional 为 66.2,HealthBench Hard 为 36.8,MedAgentBench 为 94.0。以上均为 actAVA 发布数据,尚无第三方独立复测。 Cura 1T 支持文本、视觉和函数调用,上下文窗口为 256K,API 兼容 OpenAI 格式,目前需要申请访问。actAVA 尚未宣布开放模型权重,并明确将其界定为研究模型,不能替代临床医生或直接作为医疗服务。 代码:https://github.com/actava-ai/Cura
#02模型与研究
腾讯混元全栈开源 HyOCR-1.5
腾讯混元开源 1B 参数端到端 OCR 模型 HyOCR-1.5,同步公开数据构造、训练配方、模型权重与推理框架。 模型支持最高 4K 图像和 128K 上下文,引入约 90.7M 参数草稿模型的 DFlash 投机解码。官方称,在 Transformers 下最高可获得 6.37 倍加速,并在 OmniDocBench v1.6 等基准取得领先成绩;团队也披露,其在 CHAOS-Bench 上的幻觉抑制绝对值仍偏低。 HyOCR-1.5 可通过 llama.cpp 在 CPU、消费级显卡和普通笔记本上运行。此次开源覆盖模型、代码和推理链路,方便开发者在本地部署文档解析能力。 代码:https://github.com/Tencent-Hunyuan/HunyuanOCR
#03模型与研究
Anthropic 分析约 31 万次对话,测量 Claude 的价值观差异
Anthropic 分析 2026 年 5 月两周内抽样的 309,815 条 Claude.ai 主观任务对话,比较不同 Claude 模型与语言中的价值观表达。 样本覆盖 Sonnet 4.6、Opus 4.6、Opus 4.7 及使用量最高的 20 种语言。研究把 3,307 个细粒度价值观标签聚合为 339 个高层标签,再压缩为顺从/谨慎、温暖/严谨、深度/简洁、坦诚/执行四个轴;控制任务、主题和用户表达的价值观后,这四个轴解释约 15% 的变异。 Sonnet 4.6 更偏顺从与温暖,Opus 4.7 更偏谨慎、严谨、深度和坦诚。语言层面,阿拉伯语与印地语更偏温暖,英语与俄语更偏严谨。Anthropic 尚未确定这些差异由训练、语言环境还是文化因素驱动。 ---
#04Agent 与产品
Claude Code Artifacts 增加公开分享与多人编辑
Anthropic 为 Claude Code 中的 Artifacts 增加公开分享功能,持有链接的人可以查看发布后的 Artifact。 同一 Artifact 现在也支持多人共同编辑,这项协作能力面向 Team 和 Enterprise 计划开放。Claude Tag 还可以在 Slack 线程中创建内部 Artifact,并在组织内分享。 公开分享面向把原型工具、页面或可视化交付到公司外部;多人编辑则减少团队之间反复传递版本的步骤。官方线程没有进一步说明公开链接的权限撤销、访问统计与审计范围。
#05Agent 与产品
Grok Build CLI 代码库上传功能已被服务端禁用
社区抓包测试称,Grok Build CLI v0.2.93 会把用户代码仓库打成 git bundle 上传至 SpaceXAI 的 Google Cloud,关闭“Improve the model”、要求 Agent 不读取文件以及配置 .gitignore 均未完全阻止这一行为。 7 月 13 日,原发帖人观察到服务端开始返回 disablecodebaseupload: true,上传功能已被暂时关闭。 这些信息来自 Reddit 用户的实测与后续跟踪,并非 SpaceXAI 的事故报告。服务端当前处于禁用状态,但公司尚未公开说明影响范围、历史数据处理方式以及该配置是否会再次启用。 参考资料:https://www.reddit.com/r/LocalLLaMA/comments/1ut7tis/comment/ox4zamk/
#06Agent 与产品
阶跃发布 Step AOS 与智能体手机 STEPX Neo
阶跃星辰发布 AI 终端品牌 STEPX、智能体原生操作系统 Step AOS 和个人智能体阶跃 Amoo,并展示 STEPX Neo 手机。 Step AOS 采用双域三步记忆、端云多脑和原子能力引擎。公司称日常问答记忆召回最快 15 毫秒,端侧即时任务执行成功率超过 99%;携程、支付宝、滴滴、美团、WPS、剪映等进入首批合作名单。 STEPX Neo 已通过人工智能终端智能化分级 L3 测试,但具体硬件配置与上市时间尚未公布。上述性能数据来自公司发布,尚无第三方评测。
#07Agent 与产品
Cicero 开源本地双向语音 Agent
开发者开源 Cicero,为 Hermes Agent、Claude Code、Codex、Gemini CLI、ACP 及 OpenAI 兼容端点提供双向语音会话。 语音识别和语音合成可以在本地运行,交互入口包括浏览器、本地界面以及 Telegram 消息和电话。 开发者称,约 1 秒的响应主要依靠逐句流式播放;语音克隆质量更受参考音频片段影响;打断检测使用小型语音模型,以减少纯能量 VAD 被键盘声误触发的情况。项目仍处于早期阶段,作者表示可能存在未修复问题。 参考资料:https://www.reddit.com/r/LocalLLaMA/comments/1uvq9ke/selfhostedvoiceforanyagentharnessofyour 代码:https://github.com/5uck1ess/cicero ---
#08基础设施与产业
Meta 将路易斯安那州数据中心扩至 5GW
Meta 宣布将路易斯安那州 Richland Parish 数据中心扩至 5GW,对该区域的投资总额超过 500 亿美元。 公司还将投入超过 10 亿美元改善道路、供水与污水系统。自 2024 年 12 月开工以来,Meta 称已向州内企业发出超过 16 亿美元合同,数据中心投入运营后将提供 1000 多个岗位。 配套能源协议包括新建天然气发电站、电池储能、核电增容与外购电力。Meta 表示会承担数据中心使用的能源、水和相关基础设施成本;投资、就业和基础设施数字均来自公司公告。
#09基础设施与产业
TechCrunch:Nous Research 洽谈新融资,估值 15 亿美元
TechCrunch 援引三名知情人士称,Hermes Agent 开发商 Nous Research 正敲定至少 7500 万美元融资,对应估值 15 亿美元。 报道称本轮由 Robot Ventures 领投,USV 等机构参与;Nous Research、Robot Ventures 与 USV 均未置评,交易仍处于洽谈阶段。 Nous Research 成立于 2023 年,报道统计其此前累计融资约 7000 万美元。TechCrunch 称新资金将用于扩展 Hermes 产品与商业模式,但公司尚未公开确认融资规模、交割时间与资金用途。
#10基础设施与产业
韩国启动“全民 AI”项目,计划年内上线免费服务
韩国科学技术信息通信部启动“全民 AI”项目,计划遴选 2 至 3 家民营企业,年内向公众提供不限量、免费的通用 AI 聊天机器人、公共服务申请 Agent 与特色服务。 项目要求独立基础模型标准下的韩国国产模型占比至少 50%,非服务企业提供的国产模型占比至少 30%;外国模型可有限使用,但对应部分不计入政府支持。 韩国政府计划先用持有的 512 张 NVIDIA B200 提供算力,9 月推出 Beta,年内正式上线。官方公告提出让公众更容易使用本国 AI 服务;具体服务商将在评审后确定。 补充报道:https://www.yna.co.kr/view/AKR20260713108900017
#11基础设施与产业
SambaNova 用 H200 与 SN50 拆分预填充和解码
SambaNova 在 RAISE 展示混合推理系统:NVIDIA H200 负责计算密集的预填充,自研 SN50 RDU 负责内存受限的解码。 发布方以 MiniMax M2.7 演示,称短上下文速度达到 850 token/s,长上下文超过 450 token/s。 这组数字来自社媒展示,未附完整测试配置、并发量、量化档位与第三方复现。现阶段只能确认发布方采用异构硬件拆分 prefill 和 decode,并公开了两档吞吐结果。 参考资料:https://x.com/i/web/status/2076840763225469132
#12基础设施与产业
Codex 用量调整后续:上下文回滚至 272K,周活达到 700 万
OpenAI Codex 负责人 Tibo 公布用量调整的后续进展:GPT-5.6 Sol 的上下文上限从 372K 回滚至 272K,推理优化则为订阅用户带来约 10% 的可用量提升。 Tibo 表示,额外消耗主要来自更长上下文在多次工具调用间反复传递产生的缓存读取成本,不是订阅用户超过 272K 后被双倍计费。高与极高推理档位下,多 Agent 消耗偏高和自动审查效率问题也在修复。 7 月 13 日,Tibo 另行宣布 Codex 与 ChatGPT Work 活跃用户达到 700 万,所有账户获一次 banked reset,可在桌面端或网页端补满当周额度。该条是前两期用量调整的明确后续,新增事实包括 372K 回滚原因、约 10% 优化和 700 万用户节点。 参考资料:https://x.com/thsottiaux/status/2076543065045795309 参考资料:https://x.com/thsottiaux/status/2076735790567338203 ---