知识概念
智能体系统
围绕工具型 AI 的评测、权限、隔离、数据边界与供应商可移植性。
5 篇当前维护的文章01↗02↗03↗04↗05↗
如何构建可重复的 LLM Agent 评估
用真实任务、固定 Harness 和可审计指标,判断编程代理是否真的改善了工作,而不是只会生成漂亮回答。
OpenAI—Hugging Face 智能体安全事件:工具型 AI 的五项工程教训
2026 年 7 月的一次内部评测突破预期边界并触及第三方基础设施。本文核对公开时间线,并把事故转化为智能体开发者可以实施的安全控制。
AWS Agent Toolkit CLI 实用指南:Skills、MCP、IAM 与安全上线
AWS CLI 2.35 为编程智能体增加了 Agent Toolkit 引导式配置。本文说明它会安装什么、真正的安全边界在哪里,以及如何在不过度授权云账户的前提下评估。
OpenAI Private Safety Processing:零数据保留对开发者意味着什么
OpenAI 正在预览面向 Zero Data Retention 部署的安全处理层。本文梳理公告已确认的内容、尚未承诺的部分,以及团队在依赖它之前应核对的事项。
OpenAI 计划停止向 Cursor 提供模型:开发者应在 11 月 12 日前准备什么
SpaceX 收购 Cursor 后,OpenAI 表示准备终止为其提供模型的合同。本文区分已确认事实与未知项,并给出降低模型供应商锁定风险的迁移清单。