AI 智能体的下一道门槛:让网站放它们进来
TechCrunch 报道,Meta 的 Muse 等个人 AI 智能体在代用户下单、订票时频繁被网站拦截,亚马逊已明确阻止 Muse 浏览和购买其商品,沃尔玛、达美航空、Yelp、eBay 等也出现类似情况,其中部分源于传统反机器人验证机制。Meta、沃尔玛、Stripe、Sierra 等公司已开始合作制定一套面向电商场景的智能体间通信开放标准,以区分代表用户的良性机器人与恶意机器人。
TechCrunch 报道,Meta 的 Muse 等个人 AI 智能体在代用户下单、订票时频繁被网站拦截,亚马逊已明确阻止 Muse 浏览和购买其商品,沃尔玛、达美航空、Yelp、eBay 等也出现类似情况,其中部分源于传统反机器人验证机制。Meta、沃尔玛、Stripe、Sierra 等公司已开始合作制定一套面向电商场景的智能体间通信开放标准,以区分代表用户的良性机器人与恶意机器人。
Meta 的 AI 智能体 Muse 通过最新 iOS 更新加入对 iPad 的原生支持,可更好利用大屏与 iPadOS 多任务能力。此次更新还让 Muse 接入 Canva、Dropbox、Figma、GitHub、Zoom、Notion 等工具,并支持为小企业主设定业务目标以自主规划营销与客户提案。Muse 约一个月前上线,曾数周位居 App Store 免费榜首位,此前已推出 Mac 版本。
Latent Space 采访 Kubernetes 联合创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 正把智能体 harness 从桌面搬到云端。
独立研究者 Syed Anas Mohiuddin 测试了 Google、摩根大通、Weaviate、Rapid7、法国政府部际数字事务局和美国联邦政府的智能体,发现 MCP(Model Context Protocol)存在信任缺口,可被利用实施概念验证攻击。
微软 Copilot Studio 团队与 Hugging Face 联合发布 ThinkingBox,通过隔离的 MCP 工具会话运行智能体,再按终端后端状态和副作用打分,而非看模型生成的文字。
推荐理由:微软与 Hugging Face 联合发布的智能体评测基准,用数据库终态而非模型自述来判定成败,并给出可复现的 OpenEnv 运行方式。
Earendil 旗下的 Pi 发布 Pi 1.0 与 Pi Durable,两者登上 Hacker News 首页。Pi 1.0 带来 Codemode(原生支持 MCP、Jev 和图像模型)、虚拟模型扩展、延迟工具加载、Anthropic 模型缓存预热、对话中途系统消息、新 TUI 主题以及默认全屏模式。
Hugging Face 博客介绍论文 ProvenanceGuard,一个面向 MCP 智能体的生成后验证层,可在不重训智能体的前提下读取 MCP 调用轨迹,逐条核查答案中的声明是否由其所声称的来源支持,以识别"跨来源混淆"。
GitHub Copilot 应用中的 canvas 是一种可与 AI 智能体共享的双向自定义界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述工作流,即可生成看板、发布清单或仪表盘等界面,无需编写代码。canvas 会保存为扩展,可随项目共享或作为个人扩展复用,社区已在 Awesome Copilot 分享现成模板。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,读者可据此判断自动化安全测试的边界。
GitHub Podcast 最新一期拆解了五个 AI 开发热梗:AI 生成的代码仍需阅读和负责,但审查力度应随风险分级;Skills 与 MCP 解决不同问题,前者是打包的 Markdown 专家经验,后者是连接工具与数据的标准协议,二者可组合使用;RAG 并未消亡,检索能为模型提供训练数据外的文档、内部知识和代码库上下文,减少 token 浪费并让回答更有依据。