此刻 — 人在看
快讯

专题英伟达与 Reflection AI

要闻·模型与产品·2026-10-06 06:40

英伟达支持的 Reflection 发布首个开放权重旗舰模型 Beam:501B 参数、23B 激活

10 月 5 日(周一),成立两年的美国初创 Reflection AI 正式发布首个旗舰级开放权重模型 Beam——纯文本 MoE 架构:总参数 501B,每次推理只激活 23B;预训练 23.8 万亿 token,上下文窗口 100 万 token。公司称 Beam 在高级推理基准上追平智谱的 GLM-5.2,而且“推理算力只要三分之一到四分之一”。此次发布证实了 Axios 周末“发布在即”的报道。

事件经过

Reflection AI(2024 年由两位前 Google DeepMind 研究员 Misha Laskin 和 Ioannis Antonoglou 在布鲁克林创立,主营软件开发自动化)周一通过官方博客发布 Beam,TechCrunch、Reuters 同日跟进。公司把 Beam 定位成“工作马模型”——面向企业、公共部门和开发者,专攻推理、代码和 agent 任务,号称在“token 成本和推理算力只是一小部分”的情况下做到同级性能。

参数上:501B 总参数、每次 token 只用 23B;纯文本 MoE,用高算力强化学习训练,预训练语料 23.8 万亿 token。对照它点名的对手:智谱 GLM-5.2 约 744B 总参数、40B 激活。公司列出的对比对象还包括闭源实验室(Anthropic、OpenAI)、中国开源阵营(DeepSeek、Qwen、Z.ai)、西方开放阵营(Mistral、Meta、Cohere),以及美国对手、Mira Murati 旗下 Thinking Machines Lab 7 月发布的 Inkling。

关键事实

  1. 跑分:自家记分卡,还没人独立验证:Reflection 公布的成绩是:高级推理基准上与 GLM-5.2“打平”,推理算力只要 3–4 分之一;跑赢当今主流西方开放模型;在双方都公布的四个代码测试上压过 Inkling(但 Inkling 是多模态、Beam 纯文本,赛道并不完全一样)。TechCrunch 明确写了:这些性能声称“尚未独立验证”。
  2. 记分卡明细:有领先也有落后:公司自报的明细里,Terminal-Bench 2.1 上 Beam 得 80.1,对 GLM-5.2 的 81.0——落后;SWE-bench Pro v1 上 65.5 对 62.1——领先。
  3. “3–4 倍更便宜”的计算范围:这个倍数是“模型算力”对比:基于 Artificial Analysis 和 DataCurve 的基准数据估算,不包括 prompt 预处理、上下文相关的注意力开销和 serving 开销。即对比的是模型本身的算力,不是实际按 token 计费的成本。
  4. 权重尚未开放:公司承诺 10 月稍晚以 Apache 2.0 协议放出权重和完整技术报告,分发走 hyperscaler 和 neocloud,并接入开源库。发布当天提供的是博客和跑分记分卡,权重目前还无法下载。
  5. 融资与算力:Reflection 累计融资约 47 亿美元(英伟达、红杉、Lightspeed 等),上轮投前估值 250 亿美元;今夏与 SpaceX、Nebius 签下超 70 亿美元的算力协议,把 GB300 的供给锁到 2029 年。公司的主打方向是“AI 工厂”——帮企业和主权国家用自己的数据训出定制化本地系统,已在和韩国新世界集团测试主权 AI 工厂合作。
  6. 完整记分卡:新一代中国模型排在前面(10-05 深夜更新):公司公布的完整对照表里,Terminal-Bench 2.1:DeepSeek V4.1 Flash 90.6、Kimi K3 88.3、GLM-5.3 88.2、GLM-5.2 81.0、Beam 80.1;Humanity's Last Exam(无工具):Beam 36.2,对 Kimi K3 的 46.9;GPQA Diamond:Beam 90.5,对 93.5。公司在公告里自己承认:“Kimi K3 这样的前沿开放模型在原始能力上仍然领先,Beam 的优势在推理效率。”训练规模:10,500 块英伟达 GB300 跑了 4 周强化学习,生成超过 1 亿次 rollouts。独立评测机构 Artificial Analysis 拿到提前测试权限后称,早期迹象显示 Beam“可能是我们见过同等智能水平下 token 效率最高的开放模型之一”——但这是厂商提供环境下的初步判断,目前尚无公开发布的独立评测。

背景

近两年,DeepSeek、Qwen、Kimi、Z.ai 等中国开源模型在开放模型领域排名靠前。Reflection 成立两年,融资 47 亿美元、签下 70 亿美元算力协议,此次发布的模型权重尚未开放。英伟达 CEO 黄仁勋长期提倡“AI 工厂”概念,Reflection 也以此向企业和主权国家推广;英伟达既是它的投资人,也是它的算力供应商。

为什么重要

Beam 总参数 501B、每次只激活 23B,公司称推理算力为 GLM-5.2 的三分之一到四分之一;跑分为自报,权重 10 月稍晚开放。
有用 这篇对你有帮助,就点一下

信源Reflection 官方博客(2026-10-05)、TechCrunch(2026-10-05)、Reuters(2026-10-05)、Axios(2026-10-04 周末爆料)、RuntimeWire(2026-10-05 跑分细则整理)、Startup Fortune(2026-10-05 公司背景)、implicator.ai(2026-10-05 完整记分卡)。本文为公开信息整理,不构成任何投资建议。

  1. 评论加载中…
问问小喵