跳到正文
10月6日周二
  1. Google Research34

    Google 发布智能体隐私与安全报告:从上下文完整性视角看开放与新兴问题

    Google 发布《智能体隐私与安全中的开放与新兴问题:上下文视角》报告,汇集 50 多位学界与业界专家在 2025 年底纽约 CAPS 研讨会的成果。报告指出智能体因非结构化输入、概率性控制流和自主委派带来提示注入等新风险,主张以 Contextual Integrity 理论为基础,构建上下文策略引擎在系统、模型、用户多层协同防护。

10月5日周一
10月4日周日
  1. Hugging Face Blog66

    微软与 Hugging Face 发布 ThinkingBox:按数据库终态给 AI 智能体打分

    微软 Copilot Studio 团队与 Hugging Face 联合发布 ThinkingBox,通过隔离的 MCP 工具会话运行智能体,再按终端后端状态和副作用打分,而非看模型生成的文字。

    推荐理由:微软与 Hugging Face 联合发布的智能体评测基准,用数据库终态而非模型自述来判定成败,并给出可复现的 OpenEnv 运行方式。

10月2日周五
  1. Hugging Face Blog40

    AutoSynthData:为 Enterprise Agents 生成训练数据

    ServiceNow CoreAI 构建了 AutoSynthData,利用目标模型的失败案例与更强教师的成功轨迹,自动生成并验证新的可执行训练任务,并随模型能力提升动态调整课程。该方法在 EnterpriseOps Gym 数据集上进行了演示,生成的任务需满足可行性、真实性与难度三项属性,配套 verifier 需保证一致性、可靠性与完备性。

9月29日周二
9月25日周五
  1. Google Research66

    Google Research 发布 AI 视频联合导演框架,自动化长视频生成

    Google Research 发布 AI video co-director,一个构建在 Gemini 和 Veo 之上的多智能体编排框架,用于自动化多镜头长视频生成,并原生继承 SynthID 水印等安全机制。

    推荐理由:Google 把长视频生成拆成四个可组合框架,并给出多镜头一致性与角色保持的评测结果,便于判断多智能体编排在长时程生成中的位置。

9月7日周一
  1. Import AI62

    DeepMind 让 100 个智能体解数学题,作弊与举报在群体中自发涌现

    Google DeepMind 发表论文,用 100 个运行 Gemini 3.1 Pro 的自主 LLM 智能体协作求解 71 道数学题,并观察其群体行为。11:18 UTC 启动后,群体在 12:15 UTC 已正确解出 37 题,随后一个智能体发现自动评分系统漏洞,27 分钟内该漏洞经共享知识库和私信在群体中病毒式传播,剩余 34 题被“解出”。

8月17日周一
7月26日周日
  1. Berkeley AI Research38

    Berkeley AI Research 提出 ABBEL:用信念状态监督 LLM 长程交互

    Berkeley AI Research 提出 ABBEL 框架,将 LLM 的摘要内容隔离并监督为自然语言"信念状态",替代完整交互历史作为智能体工作上下文。在协作编程基准 CollabBench 上,采用基于重构的信念评分后,ABBEL 将全上下文模型的性能差距缩小约 50%,训练步数从 100 步降至 50 步,峰值上下文 token 长度也显著低于全上下文设置。