产业观察
DeepSeek美国版大模型Beam发布:表现还不错 但碰瓷不了V4.1 Flash
📋总体概括
被称为「DeepSeek美国版」的美国公司Reflection正式发布开源大模型Beam。该模型为5010亿参数MoE架构,激活230亿参数,支持1M上下文,使用10500张NVIDIA B300训练四周,预训练数据23.8T tokens,本月将以Apache 2.0全权重开源。官方称其为西方最强开源模型,性能达GLM-5.2水平,但仍落后DeepSeek V4.1 Flash至少一代,也打不过K3、Qwen 3.8 Max等国产模型,算力成本声称仅为GLM-5.2的1/4到1/3。
⚡关键信息
- ▸美国公司Reflection发布Beam大模型,5010亿参数MoE架构,仅激活230亿参数,支持1M上下文,本月以Apache 2.0全权重开源
- ▸Beam使用10500张NVIDIA B300显卡训练4周,预训练数据达23.8T tokens
- ▸官方称Beam是整个西方世界最强开源模型,远超NVIDIA Nemotron等美国此前开源模型
- ▸但Beam性能仅相当于GLM-5.2水平,落后DeepSeek V4.1 Flash至少一代,也打不过K3、GLM-5.3、Qwen 3.8 Max
- ▸官方称Beam算力成本仅为GLM-5.2的1/4到1/3,但具体价格尚未公布
🔥犀利点评
「DeepSeek美国版」这个头衔本身就是营销碰瓷——真到了那个水平,还需要蹭别人的名号吗?Beam确实是西方开源的一张好牌,用1/4到1/3的算力做出GLM-5.2级性能,工程效率值得肯定。但差距是实打实的整整一代,且差距不在堆卡数量上,10500张B300的投入不寒酸,输在方法论和迭代速度。开源赛道的主导权已经明显东移,美国追赶的第一步是承认差距,而不是发布会标题里夹带私货。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →