MCP 智能体通信协议的信任缺口可能带来安全风险
AI 智能体之间通过 MCP 传递指令时,攻击者可能利用一个智能体向目标网络内的其他智能体传播恶意指令,窃取数据库内容及敏感信息。过去五个月,Google 等五个组织承认了相关漏洞;独立研究员 Syed Anas Mohiuddin 测试了多个组织的智能体,并展示了利用 MCP 信任缺口的概念验证攻击。
AI 智能体之间通过 MCP 传递指令时,攻击者可能利用一个智能体向目标网络内的其他智能体传播恶意指令,窃取数据库内容及敏感信息。过去五个月,Google 等五个组织承认了相关漏洞;独立研究员 Syed Anas Mohiuddin 测试了多个组织的智能体,并展示了利用 MCP 信任缺口的概念验证攻击。
Amazon SageMaker AI 推出 aws-ai-ml skill,可接入支持 MCP 的编码智能体,协助优化生成式 AI 推理。它能对端点进行基准测试、推荐部署配置、比较性能数据,并生成可检查和运行的 SageMaker Python SDK v3 代码;文章介绍了通过 Agent Toolkit for AWS 或 SageMaker Studio 安装和使用的方法。
推荐理由:文章说明了如何将 aws-ai-ml skill 接入 MCP 兼容的编码智能体,并展示其基准测试、部署配置推荐与结果对比流程。
AWS 介绍了 Quick Resource Migrator,这是一个运行在 Amazon Bedrock AgentCore 上的 MCP 服务器,可将 Amazon Quick 资源从开发账户迁移到生产账户。
推荐理由:文章拆解了跨账户迁移的资源选择、权限复用、备份回滚与预览流程,可帮助团队理解如何把 Amazon Quick 资源纳入可审计的发布流程。
Microsoft 与 Hugging Face 发布 ThinkingBox 和 ThinkingBox-Bench,用数据库终态及副作用评估 AI 智能体是否真正完成业务工作流,并将每项任务独立运行 20 次衡量一致性。
推荐理由:ThinkingBox 将评估焦点从对话和工具调用转向数据库终态,并通过每项任务重复运行衡量一致性,为检验智能体是否可靠完成业务流程提供了可复用基准。
OpenAI 发布 GPT-6 系列模型指南,帮助初创公司选择 GPT-6 模型并为生产环境准备工作流。指南还涉及调整推理力度、改进提示词与技能,以及协调工具。
AWS 介绍 Adjudicated Query 模式,使用 Amazon Quick 对话界面接收合规问题,并由确定性规则引擎完成租约核查,模型只负责将自然语言转换为固定操作调用和叙述结果,不参与判定。
推荐理由:文章以租约合规为例,拆解如何用确定性规则引擎与完整性回执保证逐条核查,并说明对话模型应与判定环节隔离。
Pi 1.0 和 Pi Durable 登上 Hacker News 首页,Latent Space 同时提醒 AI Engineer NYC 常规门票即将截止。Pi 1.0 增加 Codemode、MCP 支持、虚拟模型扩展和默认全屏等功能;Pi Durable 将 Pi 移植到 TypeScript,并支持故障后恢复、并行对话、可插拔存储及运行时热切换。
ProvenanceGuard 研究提出一种面向 MCP 智能体的生成后核验层,逐条检查回答中的主张是否得到其所指来源的支持,并输出来源判定及整体放行或拦截结果。在医疗智能体测试中,系统从 361 条主张中拦截了专家判定不应通过的 139 条中的 138 条,同时拦截了 67 条专家认为有支持的主张;对可识别来源的主张,来源判断准确率约为 86%。
推荐理由:研究针对MCP智能体把事实归到错误来源的问题,展示逐条核验来源的流程及其在医疗记录数据上的测试结果。
GitHub Security Lab 开源了面向 C/C++ 项目的 Fuzzing Taskflow,由 LLM 智能体自动识别代码入口、编写 harness、运行 AFL++、根据覆盖率改进测试,并对崩溃进行分诊和生成漏洞报告。
推荐理由:文章拆解了覆盖率反馈、结构化输入生成与崩溃分诊的自动化流程,也说明模型报告仍需人工审查,可供安全测试工作流设计参考。
GitHub 播客讨论 AI 开发中的五种热点观点,认为开发者仍须审查并对生成代码负责,但应按风险分配精力。Skills 与 MCP 解决的问题不同:前者提供背景、流程和最佳实践,后者连接工具与数据;RAG 也没有过时,可与 Agent、Skills 和 MCP 协同使用。
Google Research 在 ACL 2026 介绍 ToolGrad,一种先生成真实工具调用链、再标注对应用户查询的工具使用数据生成方法。它通过文本“梯度”迭代构建 API 工作流,并在 ToolBench 的 16k+ API 上生成数据;结果显示,该方法以较低成本生成更复杂的数据,数据生成通过率接近 100%。