
针对开发者在构建自定义智能体(Agent)时面临的底层架构复杂、难以复现云端工具流畅体验等痛点,Strands Harness 正式发布。这是一款全功能、业界领先的通用型智能体框架,采用 Apache 2.0 开源许可证,支持本地运行或部署至主流云平台。
Strands Harness 定位为通用型智能体框架,而非专用的编码智能体。开发者只需一行 Python 或 TypeScript 代码,即可接入任意选择的模型。该框架在保持同等甚至更高准确率的同时,显著提升了成本效率。
性能与成本优势
基准测试数据显示,在使用相同的 Claude 或 GPT 模型时,Strands Harness 的成本降低了 28%。与 Claude Code、Codex 及其他流行框架相比,其在 Token 效率上表现更优,且基准测试得分几乎持平,确保了不以牺牲准确性为代价换取低成本。值得注意的是,虽然 Deepseek Harness 在整体 Token 效率上表现最佳,但其准确率评分通常最低。上述测试基于 EC2 平台结合 Harbor 进行的分布式基准测试。
在使用 Fable 5 模型时,Strands Harness 的成本比 Claude Code 低 77%,且在 Terminal Bench 2.1 基准测试中得分更高。测试还发现,其他两款开源框架在成本与准确率平衡方面同样表现出色,足以与 Claude Code 媲美。
性能提升的核心在于其默认的上下文管理机制:当工具结果超过约 1500 个 Token 时自动截断;当上下文窗口占用率超过 85% 时触发摘要压缩;若发生溢出,则在循环内自动执行上下文恢复。研究人员后续将发布详细论文阐述这些基准测试细节。
快速上手与核心特性
Strands Harness 基于 Strands Harness SDK 构建,默认集成提示词缓存和上下文管理功能。它支持 Amazon Bedrock、Anthropic、OpenAI、Google 的最新模型,也可指向本地 Ollama 模型。通过 create_harness() 创建的智能体具备以下特性:
- 支持在多平台最新推理模型上运行;
- 内置 Shell、文件读写编辑及 Web 工具,提供通用基础能力;
- 自主管理上下文窗口,卸载庞大工具结果至文件并缓存重复请求;
- 跨运行周期保持长期记忆,支持通过会话 ID 恢复对话;
- 可将开放式子任务委派给内置辅助智能体,并通过清单追踪多步骤工作;
- 自动加载可用的技能模块。
该框架可部署于任何支持 Linux 容器的提供商,包括 Modal、Cloudflare Containers、Azure Container Apps、Google Cloud Run、Amazon ECS 以及 Amazon Bedrock AgentCore。
此外,Strands CLI 允许开发者使用自然语言原型化智能体。连接模型提供商、添加提示词和工具后,可通过 /export 命令获取 TypeScript 或 Python 代码,便于使用编码智能体进行迭代开发。例如,在演示中,用户仅通过自然语言指令添加 Playwright MCP 并测量延迟,随后导出代码即可完成配置。
扩展性与社区
Strands CLI 本身即构建于 Strands Harness 之上。得益于其低门槛的原型开发能力,工程师已开发出远程启动 Strands Harness 的桌面应用程序。对于深入开发需求,框架完全支持自定义,包括覆盖默认设置、更换模型、添加工具或逐步替换组件直至底层 SDK。
开发者可通过 pip install strands-harness(Python)或 npm install @strands-agents/harness(TypeScript)安装框架,或通过 npm install -g @strands-agents/cli 下载 CLI 进行交互式体验。团队同时在 Discord 社区提供支持,欢迎交流咨询。