里约热内卢市政信息技术公司 IplanRIO 发布了 Rio 3.5 Open 397B 模型,基于 Qwen 3.5 397B 架构,宣称跑分超越 Qwen 3.7 Plus。 模型已在 Hugging Face 上发布,但页面当前返回 401(需登录或模型未完全公开)。 该发布目前仅来自 Linux Do 论坛帖子,缺乏官方公告、具体基准测试细节和独立验证。 ---
#06工具与平台
OpenRouter 推出 Fusion API,宣称半价达到 Fable 级智能
OpenRouter 推出 Fusion API,允许用户聚合多个模型协同工作。 官方宣称以一半的成本达到 Fable 级别的智能。 测试任务聚焦深度研究而非编程(这也解释了为何 DeepSeek v4 Pro Solo 在该测试中分数较高)。该 API 可能改变开发者调用多模型的成本结构,但具体实现细节和独立基准测试尚未公开。目前仅有 6 人参与的 Linux Do 帖子提及。
#07工具与平台
Anthropic 宣布 Claude Agent SDK / claude -p 不再计入订阅额度
自 2026 年 6 月 15 日起,Claude Agent SDK 和 claude -p 的使用将不再计入 Claude 订阅计划的使用限制。 订阅用户的使用额度保留用于 Claude Code、Claude Cowork 和交互式使用。 该政策对使用 Max 订阅的中转站可能产生影响,但官方 API Key 和反向代理不受影响。这可能推动更多开发者尝试 Agent SDK 进行自动化任务。
Lenny's Newsletter 社区讨论揭示 AI 正在重塑产品团队的日常工作流。 产品经理和设计师开始直接向 GitHub 推送代码,团队结构从传统交接转向更紧密的工程协作。 社区成员还分享了使用 Whoop 和 Apple Watch 追踪工作压力的实验,以及小型团队利用 AI Agent(包括 Hermes Agent)自动化营销 GTM 的实践。
#10行业观察
AI 应用日志体系争论:传统 log 不够用,需要 Runtime Trace
一位 AI 应用开发者在 Linux Do 上提出了对传统日志模型的批判。 以 AI 生图项目为例:传统 log 只能记录请求开始和结束,无法追踪 prompt rewrite、ControlNet、LoRA 权重、seed 等关键运行时参数 —— 而这些才是决定生成结果的核心变量。 作者主张采用 trace tree 或 DAG 结构的「Runtime Trace」,每个 span 记录输入、输出、artifact 引用和版本快照,并强调可重放能力。目前该观点仅为社区讨论,尚未有工程实现或标准。这一讨论触及了 AI 应用可观测性的核心痛点:当模型行为不是完全写死在代码里时,传统 debug 模型失效。
#11行业观察
Yann LeCun 类比 PS2 出口管制:当前 AI 芯片限制可能重蹈覆辙
Meta 首席 AI 科学家 Yann LeCun 在 X 上发帖,将当前 AI 芯片出口管制类比 2000 年对 PlayStation-2 的出口限制。 当年美国限制 1 GFLOPS 以上计算机出口,而 PS2 峰值性能约 6.2 GFLOPS,引发「游戏机是否算超级计算机」的争议。LeCun 暗示限制高性能 AI 芯片出口可能最终被消费级产品突破。该帖获得 99 次转发。 ---
#12问题与争议
Claude Opus 4.8 在 high 思考强度下出现频繁幻觉
社区反馈 Anthropic 的 Claude Opus 4.8 在 high 思考强度下出现频繁幻觉。 用户报告模型胡言乱语、错误声称启动了子代理。切换至 xhigh 强度后问题消失。该问题在简单任务和 100K 上下文场景中均有出现,官方尚未回应。 ---