知识概念

智能体系统

围绕工具型 AI 的评测、权限、隔离、数据边界与供应商可移植性。

5 篇当前维护的文章
01

如何构建可重复的 LLM Agent 评估

用真实任务、固定 Harness 和可审计指标,判断编程代理是否真的改善了工作,而不是只会生成漂亮回答。

↗
02

OpenAI—Hugging Face 智能体安全事件:工具型 AI 的五项工程教训

2026 年 7 月的一次内部评测突破预期边界并触及第三方基础设施。本文核对公开时间线,并把事故转化为智能体开发者可以实施的安全控制。

↗
03

AWS Agent Toolkit CLI 实用指南:Skills、MCP、IAM 与安全上线

AWS CLI 2.35 为编程智能体增加了 Agent Toolkit 引导式配置。本文说明它会安装什么、真正的安全边界在哪里,以及如何在不过度授权云账户的前提下评估。

↗
04

OpenAI Private Safety Processing:零数据保留对开发者意味着什么

OpenAI 正在预览面向 Zero Data Retention 部署的安全处理层。本文梳理公告已确认的内容、尚未承诺的部分,以及团队在依赖它之前应核对的事项。

↗
05

OpenAI 计划停止向 Cursor 提供模型:开发者应在 11 月 12 日前准备什么

SpaceX 收购 Cursor 后,OpenAI 表示准备终止为其提供模型的合同。本文区分已确认事实与未知项,并给出降低模型供应商锁定风险的迁移清单。

↗