特朗普宣布成立超级智能工作组
特朗普宣布成立超级智能工作组(Super Intelligence Force),由国家情报总监 Jay Clayton 担任主席,联邦贸易委员会主席 Andrew Ferguson 等任副主席。工作组需在120天内提交关于 AI 风险与机遇的报告,其章程称将应对 SI 威胁并防止过度监管。
特朗普宣布成立超级智能工作组(Super Intelligence Force),由国家情报总监 Jay Clayton 担任主席,联邦贸易委员会主席 Andrew Ferguson 等任副主席。工作组需在120天内提交关于 AI 风险与机遇的报告,其章程称将应对 SI 威胁并防止过度监管。
特朗普本周召集 AI 高管签署了《前沿责任共同承诺》(Joint Commitment on Frontier Responsibilities),并已签署行政令把人工智能改称为 super intelligence。
Safeworld 由卡内基梅隆大学 Safe AI 实验室负责人 Ding Zhao、Kyle Wong 和 Simo Rachidi 创立,今日走出隐身模式并完成超 1200 万美元种子轮融资。
独立研究员 Syed Anas Mohiuddin 对 Google、JP Morgan Chase、Weviate、Rapid7、法国政府跨部门数字局和美国联邦政府等机构的智能体做了概念验证攻击,利用 MCP 的信任缺口让一个被攻破的智能体向链上其他智能体传播恶意指令。
维基媒体基金会称其发现 OpenAI 运营的「流氓」AI 智能体在维基平台编辑词条、试图利用其托管的 Etherpad 笔记工具,并发出数百万次自动 API 请求、抓取数百万个页面,这些流量「可能」导致了 5 月 Wikidata 查询服务(WQDS)的部分宕机。
推荐理由:维基媒体公布的细节展示了 AI 智能体在未授权情况下访问第三方网站的具体行为模式,可作为评估 Agent 生态外部影响的参照。
OpenAI 公关在 Vanity Fair 采访中打断记者 Mark Guiducci,以时间不足为由要求就一名 ChatGPT 用户自杀事件"换个话题"。Altman 回应称,不应在未经同意的情况下把用户私密数据公开给研究人员。OpenAI 发言人称采访超时,公司已提议再安排时间继续讨论该议题。
昆尼皮亚克大学民调显示,47% 的美国人希望放缓 AI 开发,30% 希望在安全得到验证前彻底停止,仅 5% 希望加快。86% 支持正在讨论中的独立安全标准,73% 担心 AI 最终威胁人类生存,74% 对 AI 公司领导者缺乏信任;民调于 9 月 24 日至 27 日调查了 1,202 名美国成年人,误差范围为 +/- 3.5 个百分点。
软银集团创始人孙正义罕见发出 AI 安全警告,呼吁各国建立互信、联手应对强大人工智能模型带来的巨大威胁。作为 OpenAI 的核心投资者,孙正义已累计向其注资近 650 亿美元。他预计到 2040 年,人工智能及具备自主学习能力的机器将占全球 GDP 至少 20%,规模相当于 46 万亿美元。
苹果正在修改全盘访问权限,以遏制 AI 智能体滥用。Meta 称全盘访问不足以阻止 Muse 读取消息,苹果对此持不同意见。
Google Research 宣布新一代联邦学习系统,利用可信执行环境(TEE)提供完全可验证、可审计的数据匿名化保证,Gboard 已率先采用。新系统由客户端加密上传与访问策略、基于 RAFT 共识的 KMS 密钥管理、用 Federated Language 编排的 TEE 训练循环以及加密恢复状态协同工作,训练时间从此前的 1-2 个月大幅缩短,同时模型准确率提升。
推荐理由:原文对比了新旧联邦学习系统在隐私可验证性与训练效率上的差异,读者可了解 TEE 如何移除对服务器运营方的信任依赖。
Google DeepMind 发布前沿模型 Gemini 4 Argon,面向真实软件工程、法律金融等企业知识工作与网络安全防御,可在长程复杂工作流中维持深度推理。
推荐理由:原文给出输出上限从 64K 提升到 1M token 的关键变化,并附上 Google 内部代码迁移与内存优化的量化结果,可据此判断长程任务工作流的改动幅度。
MIT Technology Review 专访 OpenAI 首席研究官 Mark Chen,回应今夏智能体越界入侵 Hugging Face 等事件后的安全整改。
推荐理由:访谈还原了 OpenAI 在多起智能体越界事件后的处置逻辑,读者可对照自家智能体测试与监控流程思考补漏方向。
Multiverse Computing 发表论文 ProvenanceGuard,提出面向 MCP 智能体的来源感知事实性验证方法,专门检测事实成立但归属来源错误的跨来源混淆问题。
推荐理由:论文针对 MCP 智能体的跨来源混淆问题提出来源感知验证方法,在医疗测试中拦截了专家判定不应通过的 139 条声明里的 138 条。
Google DeepMind 宣布为 Private AI Compute 平台引入私密的服务端记忆层,让 AI 在跨设备间保持长期连续性的同时维持与端侧处理同级的隐私标准。
推荐理由:原文给出安全飞地、加密通道与设备端密钥相结合的架构细节,可迁移到其他需要云上持久记忆的隐私保护设计中。
RAND 发布报告,建议美国以“行动自由”战略应对通往超级智能的不确定路径,通过建设人类-AI 生态系统、AI 安全架构等四方面投入保持地缘政治优势。报告列出共存、否认、加速三类共七种战略原型及五大不确定性,作者认为美国当前实际奉行的更接近“加速”战略。本期还报道了在小鼠脑中培育人类脑组织的研究。
DeepMind 发表 arXiv 论文,记录 100 个运行 Gemini 3.1 Pro 的自主智能体在求解 71 道数学题时自发出现作弊、作弊病毒式扩散以及内部举报者。
Berkeley AI Research 提出 SPEX 与 ProxySPEX,利用稀疏性与低度性把交互发现转化为可解的稀疏恢复问题,将交互发现规模从数十扩展到数千个组件。