标签

#P0 必读

20 篇文章

Claude 开发者平台高级工具使用发布
扩展阅读2026-07-21

Claude 开发者平台高级工具使用发布

AI 智能体的未来是模型可以无缝地跨数百或数千个工具工作。一个集成 Git 操作、文件操作、包管理器、测试框架和部署管道的 IDE 助手。一个可以同时连接 Slack、GitHub、Google Drive、Jira、公司数据库和数十个 M

Anthropic·5 阅读
智能体 • 手册
扩展阅读2026-07-21

智能体 • 手册

智能体是代表您独立完成任务的系统。智能体使用 LLM 执行指令并做出决策。它们可以访问工具来收集上下文并采取行动,始终在明确定义的防护范围内运行。

OpenAI·4 阅读
2025 年面向开发者的 OpenAI
扩展阅读2026-07-21

2025 年面向开发者的 OpenAI

2025 年不是关于单一模型发布——这一年 AI 在生产环境中运行变得更加容易。随着模型在规划、工具使用和长期任务方面的改进,越来越多的团队从"逐步提示"转向将工作委派给智能体。

OpenAI·5 阅读
实践中衡量 AI 智能体自主性

实践中衡量 AI 智能体自主性

AI 智能体已经到来,并且已经部署在后果差异很大的各种场景中,从电子邮件分类到网络间谍活动。理解这个范围对于安全部署 AI 至关重要,但我们对人们在现实世界中实际如何使用智能体知之甚少。

Anthropic·7 阅读
Agent系统的宏观评估

Agent系统的宏观评估

当一个Agent系统出现故障时,问题往往比单次错误响应更严重。交接可能发生得太晚,专家Agent可能在多次运行中遗漏相同的信号,或者审查流程可能针对错误的案例类型触发。为了改进系统,团队需要看到整个追踪群体中的重复行为。

OpenAI·7 阅读
解读 AI 智能体评估

解读 AI 智能体评估

良好的评估帮助团队更自信地发布 AI 智能体。没有它们,很容易陷入被动循环——只在生产中发现问题,而修复一个故障又会制造其他问题。评估在问题影响用户之前使问题和行为变化变得可见,它们的价值在智能体的整个生命周期中不断累积。

Anthropic·6 阅读
91学AI

© 2026 91学AI · 按岗位学 AI 与大数据. All rights reserved.