Reflection 发布开源模型 Beam,501B 参数仅激活 23B 即可比肩 GLM 5.2
Reflection 发布首个免费模型 Beam,面向编码、逻辑推理与智能体任务,MoE 架构总参数 501B、每 token 激活 23B。据 Reflection,Beam 在高难度推理任务上以少三到四倍的算力匹配 GLM 5.2,其强化学习阶段使用了 10,500 块 Nvidia GB300 GPU、运行超过四周。
Reflection 发布首个免费模型 Beam,面向编码、逻辑推理与智能体任务,MoE 架构总参数 501B、每 token 激活 23B。据 Reflection,Beam 在高难度推理任务上以少三到四倍的算力匹配 GLM 5.2,其强化学习阶段使用了 10,500 块 Nvidia GB300 GPU、运行超过四周。
Reflection 发布 Beam,一个总参数 501B、激活 23B 的纯文本 MoE 模型,面向编码、智能体与科学计算,完整权重预计本月以 Apache 2.0 开源。
Reflection AI 于当地时间周一发布首款开放权重大模型 Beam,总参数量 5010 亿,采用稀疏激活架构,每项任务仅激活 230 亿参数,主攻代码与智能体任务。
Reflection AI 正式发布首个开源权重前沿模型 Beam,定位为面向企业、公共部门和开发者的主力模型。Beam 为纯文本 MoE 模型,总参数 501B、激活参数 23B,在 23.8T tokens 上预训练,上下文窗口 100 万 token。
Axios 报道称,Reflection 等多家西方企业本月将推出开放权重 AI 模型,人工智能模型领域的竞争将进一步升级。开放权重模型支持客户本地部署,对微调和推理数据安全有严格要求的行业是关键优势。Reflection 即将推出的模型预计最初落后于美国最先进的闭源模型,但足以同中国厂商的顶级开放权重模型竞争,公司正积极锁定算力。
Hugging Face 推出 Open TTS Leaderboard,用客观指标评测开源多语言 TTS 与语音克隆模型。榜单以 Qwen3 ASR 转写计算 WER/CER 衡量可懂度,以 RTFx 和 TTFA 衡量 H200 GPU 上的批量推理与流式延迟,并以 WavLM 嵌入余弦相似度衡量说话人相似度,把单个模型评测从数周缩短到数小时。
推荐理由:原文对比了人工偏好竞技场与客观指标评测,说明新榜单用 WER、RTFx、TTFA 和说话人相似度补齐开源 TTS 评测的缺口。
NVIDIA 发布开源表格基础模型 Kumo Tabular,输入带标签的表格后可在一次前向传播中预测新行标签,无需训练、微调或特征工程,支持分类与回归。
推荐理由:原文给出四项基准的排名与推理速度对比,读者可据此判断它相对调参梯度提升树和同类表格基础模型的位置。
Hcompany 发布 Holo4 系列智能体模型,包含 27B dense 与 35B-A3B MoE 两种尺寸,可通过 GUI、代码、MCP 和 API 与软件交互,同一模型可跨桌面、网页、Android、代码沙箱与业务 API 运行。
推荐理由:原文给出了多接口能力说明与 OSWorld 2.0 成本性能对比,读者可据此判断开源智能体模型相对闭源前沿模型的取舍。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,在 AlphaFold Database 中开放 2800 多种病毒的蛋白复合体预测三维结构,约 30% 的蛋白相互作用为科学界此前未记录。
推荐理由:开放数据集与 BioNeMo 结构预测流程的发布,让研究者能针对自选病毒蛋白靶点批量预测三维结构,降低实验成本。
RAND 发布报告,建议美国以“行动自由”战略应对通往超级智能的不确定路径,通过建设人类-AI 生态系统、AI 安全架构等四方面投入保持地缘政治优势。报告列出共存、否认、加速三类共七种战略原型及五大不确定性,作者认为美国当前实际奉行的更接近“加速”战略。本期还报道了在小鼠脑中培育人类脑组织的研究。
微软研究院联合华盛顿大学与 Providence 发布开源病理基础模型 GigaPath-Flash 与 GigaTIME-Flash,权重与代码以 Apache 2.0 许可在 HuggingFace 开放。
Mistral AI 宣布从三方面推进客户的主权 AI:推理的区域控制、开放模型选择以及欧洲算力的长期保障。