ProvenanceGuard:为 MCP 智能体提供来源感知的事实性验证
Multiverse Computing 发表论文 ProvenanceGuard,提出面向 MCP 智能体的来源感知事实性验证方法,专门检测事实成立但归属来源错误的跨来源混淆问题。
推荐理由:论文针对 MCP 智能体的跨来源混淆问题提出来源感知验证方法,在医疗测试中拦截了专家判定不应通过的 139 条声明里的 138 条。
Multiverse Computing 发表论文 ProvenanceGuard,提出面向 MCP 智能体的来源感知事实性验证方法,专门检测事实成立但归属来源错误的跨来源混淆问题。
推荐理由:论文针对 MCP 智能体的跨来源混淆问题提出来源感知验证方法,在医疗测试中拦截了专家判定不应通过的 139 条声明里的 138 条。
多校研究者推出 SPADE 框架,让 LLM 在自博弈中交替生成可执行训练环境并尝试求解,用强模型生成的合成数据反哺模型自身训练。SPADE 在 Qwen3-30B-A3B-Instruct-2507 上经 GRPO 微调后,游戏环境套件平均分达 58.3,较 base 提升 8.1;METR 另分析称 AI 显著加速了网络安全漏洞发现,对数学研究仅有小幅加速,对 AI 研究优化尚无可测加速。