跳到正文
今天10月6日周二2 条
  1. The Decoder64

    韩国计划投入 34.9 亿美元建设国产前沿 AI 模型,对标中国头部模型

    韩国计划通过政府参股投资 4.7 万亿韩元(34.9 亿美元)开发国产前沿 AI 模型,相关资金列入拟议中的 2027 年预算,仍需议会批准。第二条资金线将推动韩国自研模型在全国各行业落地,政府将面向初创企业开放新一轮竞争,LG AI Research、SK Telecom 与 Upstage 的现有入围者不会自动获得追加资金。

10月2日周五
  1. Hugging Face Blog66

    Ai2 开源 AstaBrief 8B,Asta 平台的快速报告生成模型

    Ai2 开源 AstaBrief 8B,它把研究问题与检索到的文献片段直接转成带引用的报告,训练数据一并开放。模型基于 Qwen3-8B,用 SFT 加 DPO 训练;在 Asta 的 Fast mode 下平均 51.1 秒生成一份报告,约为 Claude 驱动的 Thinking mode(178.5 秒)速度的 3.5 倍。

    推荐理由:原文给出一条可迁移的训练经验,用引用密度这一简单信号过滤合成数据,比更复杂的过滤组合更有效。

  2. Google Research68

    Google 发布基于 TEE 的新一代联邦学习系统,迈向可证明隐私的学习

    Google Research 宣布新一代联邦学习系统,利用可信执行环境(TEE)提供完全可验证、可审计的数据匿名化保证,Gboard 已率先采用。新系统由客户端加密上传与访问策略、基于 RAFT 共识的 KMS 密钥管理、用 Federated Language 编排的 TEE 训练循环以及加密恢复状态协同工作,训练时间从此前的 1-2 个月大幅缩短,同时模型准确率提升。

    推荐理由:原文对比了新旧联邦学习系统在隐私可验证性与训练效率上的差异,读者可了解 TEE 如何移除对服务器运营方的信任依赖。

9月29日周二
  1. Hugging Face Blog72

    NVIDIA 发布开源表格基础模型 Kumo Tabular,四项基准排名第一

    NVIDIA 发布开源表格基础模型 Kumo Tabular,输入带标签的表格后可在一次前向传播中预测新行标签,无需训练、微调或特征工程,支持分类与回归。

    推荐理由:原文给出四项基准的排名与推理速度对比,读者可据此判断它相对调参梯度提升树和同类表格基础模型的位置。

9月24日周四
  1. NVIDIA Blog66

    NVIDIA 与 Google DeepMind 如何借开放病毒蛋白结构数据帮助研究者应对下一次疫情

    NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,在 AlphaFold Database 中开放 2800 多种病毒的蛋白复合体预测三维结构,约 30% 的蛋白相互作用为科学界此前未记录。

    推荐理由:开放数据集与 BioNeMo 结构预测流程的发布,让研究者能针对自选病毒蛋白靶点批量预测三维结构,降低实验成本。

9月19日周六
9月16日周三
9月3日周四
9月1日周二
8月25日周二
  1. Mistral AI50

    Mistral 与 HUMAIN 达成战略合作,推进沙特及中东主权 AI

    Mistral 与 HUMAIN 宣布战略合作,将在沙特及中东地区推进主权 AI,合作规模达数亿欧元。双方初期聚焦网络安全与语音,计划开发阿拉伯语表现强劲的前沿模型,Mistral 还将探索使用 HUMAIN 的数据中心基础设施支持本地算力需求。两家公司同时计划在沙特推出面向受监管行业的联合市场策略。

8月24日周一
  1. Import AI34

    Import AI 470:机器无权利;用 SPADE 自动化环境生成;用 Hawkeye 构建更优 GPU kernel

    多校研究者推出 SPADE 框架,让 LLM 在自博弈中交替生成可执行训练环境并尝试求解,用强模型生成的合成数据反哺模型自身训练。SPADE 在 Qwen3-30B-A3B-Instruct-2507 上经 GRPO 微调后,游戏环境套件平均分达 58.3,较 base 提升 8.1;METR 另分析称 AI 显著加速了网络安全漏洞发现,对数学研究仅有小幅加速,对 AI 研究优化尚无可测加速。

5月8日周五