美国人工智能公司Reflection AI 10月5日公布首个开放权重模型Beam,总参数5010亿,每次只激活约230亿,主攻编程、推理和智能体任务。公司说,Beam在编程和智能体任务上可与智谱的GLM-5.2相当,接近阿里巴巴的Qwen3.8-Max,但绝对能力仍不如月之暗面的Kimi K3;在高难度推理测试里,Beam用的推理算力是GLM-5.2的三分之一到四分之一。
权重还没有公开:Beam正在做最后的安全检查,早期版本只通过预约向少数用户开放;Reflection说本月公开完整权重,按Apache 2.0许可证发布,用户可以自行部署、继续训练和用在自己的系统里。公司公布,Beam在测试修复真实软件缺陷能力的SWE-Bench Verified上得了80.9分。目前的测试分数都是公司自己公布的,技术报告也还没有发表,独立测试要等权重公开后才能开始。Reflection的目标客户,是不愿或不能使用中国模型、又想自己掌握人工智能能力的企业和政府;权重公开后,这些客户可以自行部署、继续训练模型。
Beam用23.8万亿Token做预训练,再用10500块英伟达GB300芯片连续四周做强化学习,生成了超过1亿次推演。Reflection 2024年由两名前谷歌DeepMind研究人员创办,累计融资超过40亿美元,投资方包括英伟达、红杉和花旗,还与五角大楼和美国能源部有合作。今年7月,英伟达、Meta、微软等25家美国公司呼吁美国政府不要限制开放权重模型。
茉莉花观察
这一节是茉莉花的看法,依据是上文的事实。
我们的分析Reflection是把中国模型当作追赶的标杆。Reflection拿来比较的GLM-5.2、Qwen3.8-Max和Kimi K3全是中国模型;创始人原本以为西方会不断出现足够强的开放模型,DeepSeek V3出现后差距反而拉大,等了几个月没等到,才决定自己从头训练。
不同看法这些成绩都是公司自己公布的,权重和技术报告都还没有拿出来。我们同意,分数要等独立测试;但Reflection要争取的客户,是不愿或不能用中国模型的企业和政府,这些客户看重的不只是分数。
我们的判断Reflection能不能按说的在本月公开权重。我们判断,到2026年10月31日,Reflection会按Apache 2.0许可证公开Beam的完整权重。公司自己在10月5日的发布帖里写明本月公开完整权重,模型已在做最后的安全检查,早期版本也已交给少数用户试用。Beam的成绩要等权重公开、有人独立测试后才能定论,而Reflection自己定下的公开期限就在本月。
综合虎嗅网、ForkLog、Crypto Briefing报道



