返回日报索引

AI DAILY / 2026-05-31

05·31 - AI 午报:MiniMax 启动 A 股 IPO,软银 750 亿欧元建法国 AI 数据中心

今天的核心趋势是"AI 的资本化在加速,但能效和部署成本也在成为硬约束"。MiniMax 启动 A 股 IPO,SpaceX 以 1.8 万亿美元估值冲刺史上最大 IPO,软银在法国砸 750 亿欧元建 5GW 数据中心——钱在涌入。但另一面,有美国公司一个月在 Claude 上花掉 5 亿美元,ChatGPT Plus 共享账号被大规模二验封禁,Reddit 用户用 6400 美元自建本地 LLM 服务器算账发现比 API 更便宜。模型侧,Parallax 注意力机制和 NVIDIA 4-bit 量化都在推动"更省算力地跑模型"。

10 NEWS ITEMSHYPO-WRITER 写作档案ASIA/SHANGHAI
#01资本与基础设施

MiniMax 启动 A 股 IPO,港股股价已涨 409%

上海 AI 大模型企业 MiniMax 于 5 月 29 日与中信证券签署辅导协议,正式启动 A 股 IPO 进程。 此前该公司已于今年 1 月在港交所上市,股价较发行价上涨 409%,目前市值 2634 亿港元。 业务数据方面,MiniMax 过去两个月 ARR 增长超 100%,目前超过 3 亿美元,全球企业及开发者客户数超百万。产品线上,已发布 M2.5、M2.6、M2.7 三款旗舰大模型,并预告 M3 模型将采用 Sparse Attention 机制,推理速度会大幅提升。 MiniMax 将于 6 月 8 日被纳入恒生科技指数。

#02资本与基础设施

软银将在法国投资最高 750 亿欧元建设 AI 数据中心

软银集团宣布在法国投资最高 750 亿欧元,开发并运营总容量 5GW 的 AI 数据中心。 第一阶段投入 450 亿欧元,计划于 2031 年前在敦刻尔克、Bosquel 和 Bouchain 三地交付 3.1GW 的数据中心容量。 软银将与施耐德电气合作,在敦刻尔克港建立先进制造集群,生产机柜和集成电源模块。项目计划利用法国电网、工业用地和人才优势,支持欧洲 AI 主权,预计为当地创造数千个高技能岗位,并与本地大学合作培养人才。 这是软银在欧洲规模最大的 AI 基础设施投资。

SoftBank Group · 2026-05-29原文
#03资本与基础设施

SpaceX 拟以 1.8 万亿美元估值启动史上最大 IPO

据外媒报道,SpaceX 计划最早于 6 月 4 日启动 IPO 路演,目标估值至少 1.8 万亿美元,拟筹资 750 亿美元。 若成功,这将是历史上规模最大的 IPO。 SpaceX 在 4 月时目标估值超 2 万亿美元,经与顾问和投资者磋商后下调。公司承诺将在太空中建立数据中心,业务涵盖火箭、数据与 AI。路演预计 6 月 11 日定价,时间表仍有可能推迟。 ---

#04模型与技术

Parallax:参数化局部线性注意力,首次展示注意力机制的架构-优化器协同设计

研究者提出 Parallax,一种可扩展的参数化局部线性注意力(Local Linear Attention)机制。 相比传统 softmax 注意力,局部线性注意力将局部常数估计升级为局部线性估计,在关联记忆的偏差-方差权衡上具有理论优势。 Parallax 消除了原 LLA 中的数值求解器,改为学习一个额外的 query-like 投影器来探测 KV 协方差。在 0.6B 和 1.7B 参数规模的预训练中,Parallax 持续降低了困惑度,在下游基准上实现了帕累托改进。 工程方面,硬件感知算法提高了算术强度,解码内核在多种批大小和上下文长度下匹配或超越 FlashAttention 2/3。研究者还发现 Muon 优化器能够解锁 Parallax 的潜力——这是注意力机制研究中首次展示架构与优化器的强协同设计。

Reddit r/LocalLLaMA · 2026-05-30原文
#05模型与技术

Singularity Gate 基准发布:Opus 4.8 领跑科学发现预测

新基准 Singularity Gate 发布,评估前沿 AI 模型预测训练截止后范式突破性科学发现的能力。 Claude Opus 4.8 以 20.47% 的部分得分领先,但所有模型的完全正确率均为 0%。 该基准测试要求模型预测训练数据截止日期之后发布的范式突破性科学发现,被视为自主 AI 驱动发现的必要非充分条件——能通过不代表达到爱因斯坦水平,但通不过则说明不具备这种能力。所有模型均在原生 Agent 工具链(Claude Code、Codex、Gemini CLI)中测试,允许工具使用但禁用了网络搜索。

Reddit r/singularity · 2026-05-30原文
#06模型与技术

NVIDIA 发布 Qwen3.6-35B-A3B-NVFP4,精度几乎无损

NVIDIA 发布了基于阿里 Qwen3.6-35B-A3B 的 4-bit 量化版本 Qwen3.6-35B-A3B-NVFP4。 通过 Model Optimizer 将 MoE 模型中的线性层权重从 BF16 压缩至 NVFP4,位宽降至 1/4,显存和磁盘需求减少约 3.06 倍。 在 8 项基准测试中,NVFP4 精度与 BF16 几乎持平:MMLU Pro 从 85.6 降至 85.0,GPQA Diamond 从 84.9 降至 84.8(降幅仅 0.1 个百分点),部分任务如 IFBench 和 MMMU PRO 甚至略有提升。该模型可直接在 vLLM 推理框架中使用。

Reddit r/LocalLLaMA · 2026-05-30原文
#07模型与技术

小米 MiMo-V2.5 推理优化:KV Cache 命中率 93%,端到端提升 40%

小米 MIMO 团队发布 MiMo-V2.5 推理优化技术报告。 通过重构双池 KV Cache 管理、引入自研分布式缓存 GCache,并优化 Prefill 与 Decode 执行链路,将 Expert Parallelism 缩减至原先的 1/2,实现约 40% 端到端性能提升,多模态 Encoder 吞吐提升至 2 倍。 线上服务端 KV Cache 命中率平均达 93%。部分优化成果已回馈 SGLang 开源社区,并通过 API 降价将节省的成本回馈用户。 ---

小米大模型团队(微信公众号)· 2026-05-31原文
#08行业与生态

一家美国公司一个月在 Claude AI 上花费 5 亿美元

据 Axios 报道,一家未具名的美国公司因未设置 Claude AI 使用限制,一个月内意外花费 5 亿美元。 该事件暴露出企业 AI 支出缺乏管控的普遍问题,引发对 AI 投资回报率的重新审视。 此前亚马逊也被曝员工为完成 AI 使用指标虚增 token 消耗,公司已取消内部 AI 使用排行榜。两件事叠加,反映企业 AI 治理的紧迫性正在上升。

Linux Do / Axios · 2026-05-31原文
#09行业与生态

6400 美元自建本地 LLM 服务器,第一年比 API 省 708 美元

一位 Reddit 用户分享了花费 6406 美元搭建本地 LLM 服务器的详细成本分析。 配置为 4 块二手 AMD MI100 32GB GPU 和 EPYC 7K62 CPU,运行 4 个 llama.cpp 实例部署 Qwen3.6 27B 模型,每日处理 2040 万输入 token 和 132 万输出 token。 考虑折旧和电费后,第一年总拥有成本为 2992.72 美元,对比同等 OpenRouter API 调用年费 3701.10 美元,节省 708.38 美元。后续年份硬件折旧归零后,每年节省可达 2930.95 美元。 不过该用户指出 MI100 在 LLM 软件中优化不足,实际性能仅为预期的 70%,3 路互联桥也因兼容性问题无法使用。

Reddit r/LocalLLaMA · 2026-05-31原文
#10行业与生态

ChatGPT Plus 共享账号大规模触发二次验证封禁

5 月 30 日,多位用户报告购买的 ChatGPT Plus 共享账号被大规模踢出,触发二次验证。 有用户称其周五下午购买的三十多个 Plus 账号几乎全部失效,仅剩一个无需二验。使用环境为国内云服务器,并非对外中转。 社区普遍认为这是 OpenAI 针对共享/转售 Plus 账号的集中打击。此前已有日抛封号现象,此次二验波及范围更广。 ---