Reflection 发布开源模型 Beam,501B 参数仅激活 23B 即可比肩 GLM 5.2
Reflection 发布首个免费模型 Beam,面向编码、逻辑推理与智能体任务,MoE 架构总参数 501B、每 token 激活 23B。据 Reflection,Beam 在高难度推理任务上以少三到四倍的算力匹配 GLM 5.2,其强化学习阶段使用了 10,500 块 Nvidia GB300 GPU、运行超过四周。
Reflection 发布首个免费模型 Beam,面向编码、逻辑推理与智能体任务,MoE 架构总参数 501B、每 token 激活 23B。据 Reflection,Beam 在高难度推理任务上以少三到四倍的算力匹配 GLM 5.2,其强化学习阶段使用了 10,500 块 Nvidia GB300 GPU、运行超过四周。
Reflection AI 正式发布首个开源权重前沿模型 Beam,定位为面向企业、公共部门和开发者的主力模型。Beam 为纯文本 MoE 模型,总参数 501B、激活参数 23B,在 23.8T tokens 上预训练,上下文窗口 100 万 token。
Aleph Alpha 发布德英双语模型 Kolibri,总参数 78B,每 token 激活约 3B,权重以 Apache 2.0 许可在 Hugging Face 开源。
GPT-6 Astra Ultrafast 现已通过 OpenAI API 提供,运行在 NVIDIA Blackwell GPU 上,并向符合条件的 ChatGPT Work 和 Codex 用户开放。
推荐理由:原文给出了 Astra Ultrafast 相对 Standard 模式最高 8 倍的 token 生成速度对比,读者可据此判断其对编码智能体工作流的影响。
Google DeepMind 发布前沿模型 Gemini 4 Argon,面向真实软件工程、法律金融等企业知识工作与网络安全防御,可在长程复杂工作流中维持深度推理。
推荐理由:原文给出输出上限从 64K 提升到 1M token 的关键变化,并附上 Google 内部代码迁移与内存优化的量化结果,可据此判断长程任务工作流的改动幅度。