标签

#Anthropic

20 篇文章

推进 Claude 金融服务解决方案
扩展阅读2026-07-21

推进 Claude 金融服务解决方案

我们正在扩展 Claude 金融服务版,添加 Excel 插件、更多实时市场数据和投资组合分析连接器,以及新的预构建 Agent Skills,如构建现金流贴现模型和启动覆盖报告。

Anthropic·6 阅读
AI 系统中的上下文检索 | Anthropic
扩展阅读2026-07-21

AI 系统中的上下文检索 | Anthropic

为了让 AI 模型在特定场景中发挥作用,它通常需要访问背景知识。例如,客户支持聊天机器人需要了解它们所服务的特定业务的知识,而法律分析机器人则需要了解大量过去的案例。

Anthropic·5 阅读
推出 Claude 4
扩展阅读2026-07-21

推出 Claude 4

今天,我们推出下一代 Claude 模型:Claude Opus 4 和 Claude Sonnet 4,它们为编码、高级推理和 AI 智能体设定了新标准。

Anthropic·4 阅读
金融服务智能体
扩展阅读2026-07-21

金融服务智能体

我们正在发布十个现成可用的智能体模板,用于金融服务中最耗时的工作:构建推介书、筛选 KYC 文件以及月末结账。每个模板都作为 插件 在 Claude Cowork 和 Claude Code 中提供,并作为 Claude 托管智能体 的食谱

Anthropic·4 阅读
Claude Sonnet 4.5 发布
扩展阅读2026-07-21

Claude Sonnet 4.5 发布

Claude Sonnet 4.5 是世界上最好的编码模型。它是构建复杂智能体的最强模型。它是使用计算机最好的模型。它在推理和数学方面也显示出实质性的进步。

Anthropic·5 阅读
量化智能体编码评估中的基础设施噪声
扩展阅读2026-07-21

量化智能体编码评估中的基础设施噪声

智能体编码基准测试(如 SWE-bench 和 Terminal-Bench)通常用于比较前沿模型的软件工程能力——排行榜上的前几名往往仅相差几个百分点。这些分数经常被视为相对模型能力的精确衡量标准,并越来越多地影响关于部署哪些模型的决策。

Anthropic·5 阅读
"思考"工具:让 Claude 停下来思考
扩展阅读2026-07-21

"思考"工具:让 Claude 停下来思考

扩展思考能力自首次发布以来已得到改进,因此我们建议在大多数情况下使用该功能而非专用的思考工具。扩展思考提供了类似的好处——为 Claude 提供解决复杂问题的空间——并具有更好的集成和性能。请参阅我们的扩展思考文档以了解实现细节。

Anthropic·5 阅读
Claude 3.7 Sonnet and Claude Code
扩展阅读2026-07-21

Claude 3.7 Sonnet and Claude Code

今天,我们宣布推出 Claude 3.7 Sonnet¹——我们迄今为止最智能的模型,也是市场上首个混合推理模型。Claude 3.7 Sonnet 可以产生近乎即时的响应,或者进行对用户可见的扩展的、逐步的思考。API 用户还可以细粒度控

Anthropic·4 阅读
Claude 开发者平台高级工具使用发布
扩展阅读2026-07-21

Claude 开发者平台高级工具使用发布

AI 智能体的未来是模型可以无缝地跨数百或数千个工具工作。一个集成 Git 操作、文件操作、包管理器、测试框架和部署管道的 IDE 助手。一个可以同时连接 Slack、GitHub、Google Drive、Jira、公司数据库和数十个 M

Anthropic·5 阅读
Claude SWE-bench 性能
扩展阅读2026-07-21

Claude SWE-bench 性能

_我们的最新模型——升级后的 Claude 3.5 Sonnet 在软件工程评估 SWE-bench Verified 上达到了 49% 的成绩,超过了先前最先进模型的 45%。本文解释了我们围绕模型构建的"智能体",旨在帮助开发者从 Cl

Anthropic·5 阅读
实践中衡量 AI 智能体自主性

实践中衡量 AI 智能体自主性

AI 智能体已经到来,并且已经部署在后果差异很大的各种场景中,从电子邮件分类到网络间谍活动。理解这个范围对于安全部署 AI 至关重要,但我们对人们在现实世界中实际如何使用智能体知之甚少。

Anthropic·7 阅读
91学AI

© 2026 91学AI · 按岗位学 AI 与大数据. All rights reserved.