Better Agents

为智能体项目生成可测试、可评估、可观测且可协作维护的开发结构。

Star 数
★ 1.6k
最近更新
4 个月前
License
MIT
主语言
TypeScript

30 秒速览

运行形态
命令行工具
可在哪里用
通用 · 跨平台Claude Code
费用
软件免费,模型调用费用自付
上手难度
低 · 几分钟可跑通
开始前需要
Node.js 22+npm 或 pnpm受支持的编码助手LangWatch API 密钥LLM 提供商 API 密钥Shell / 命令行网络访问本地文件系统MCP Server
典型场景
使用 Claude Code 开始 Agno 项目的开发者,希望第一次提交前就建立 Scenario 端到端测试目录和提示词版本管理。
不适合
  • 需要开箱即用运行时的团队:它只生成项目骨架
  • 不想依赖 LangWatch 云服务的团队
  • 不使用 Claude Code、Cursor、Antigravity 或 Kilocode 的开发者

这个 Agent 能做什么,适合哪些场景?

Better Agents 是一个命令行工具和一套智能体开发标准,用于初始化新的智能体项目。它面向 Agno、Mastra、LangGraph 等可选框架,并可配合 Claude Code、Cursor、Antigravity 或 Kilocode CLI 等编码助手使用。初始化后,项目结构包含应用代码目录、端到端 Scenario 测试、评估 Notebook、版本化提示词、提示词注册表、MCP 配置和 AGENTS.md。其交付边界是生成和规范化本地项目骨架,而不是作为托管运行时执行智能体。它适合希望从项目起步阶段就纳入测试、提示词协作、评估和可观测性约定的团队。

运行 better-agents init . 或 better-agents init my-awesome-agent 后,CLI 会引导选择编程语言、智能体框架、编码助手、LLM 提供商和 API 密钥。它生成 app/(或 src/)、tests/scenarios/、tests/evaluations/、prompts/、prompts.json、.mcp.json、AGENTS.md、.env 与 .gitignore 等项目文件。tests/scenarios/ 用于 Scenario 端到端会话测试,tests/evaluations/ 放置用于评估 RAG 或分类等流水线环节的数据集和 Notebook,prompts/ 以 YAML 保存版本化提示词。.mcp.json 用于配置 MCP 服务器,使所选编码助手能够获得所选框架和 Scenario 测试相关的上下文。

  1. 使用 Claude Code 开始 Agno 项目的开发者,希望第一次提交前就建立 Scenario 端到端测试目录和提示词版本管理。
  2. 采用 Mastra 的团队,需要让多个成员通过 YAML 提示词和 prompts.json 协作维护提示词。
  3. 构建含 RAG 或分类环节的 LangGraph 项目,并希望在 tests/evaluations/ 中保存评估数据与 Notebook 的工程团队。
  4. 需要为新智能体项目预置 .mcp.json、可观测性相关配置和开发约定的技术负责人。
  5. 已使用 Cursor、Antigravity 或 Kilocode CLI 的开发者,希望把现有编码助手接入统一的智能体项目结构。

如何安装或部署这个 Agent?

要求 Node.js 22+、npm 或 pnpm、一个受支持的编码助手、LangWatch API key 和所选 LLM 提供商的 API key。全局安装:npm install -g @langwatch/better-agents。也可免安装运行:npx @langwatch/better-agents init my-agent-project。

如何使用这个 Agent?

在当前目录初始化:better-agents init .;创建新目录并初始化:better-agents init my-awesome-agent。随后按 CLI 引导选择语言、框架、编码助手、LLM 提供商并提供所需 API key。默认启用匿名使用遥测;如需退出,设置 BETTER_AGENTS_TELEMETRY=0。

这个 Agent 有哪些优点和局限?

优点
  • 一次初始化同时建立 Scenario 端到端测试、评估 Notebook、提示词版本化和提示词注册表,而不只生成应用代码目录。
  • 通过 .mcp.json 将所选智能体框架与 Scenario 测试相关 MCP 配置纳入新项目。
  • 可在初始化流程中选择语言、智能体框架、编码助手和 LLM 提供商,面向多种开发组合。
  • 项目结构明确区分 tests/scenarios/、tests/evaluations/ 和 prompts/,便于将行为测试、离线评估与提示词协作分开维护。
局限
  • 运行环境要求 Node.js 22+,并依赖 npm 或 pnpm。
  • 需要 LangWatch API key 及所选 LLM 提供商的 API key,采用前需处理凭据配置。
  • 文档列出的编码助手范围有限:Claude Code、Cursor、Antigravity 和 Kilocode CLI。
  • 它生成项目标准和配置,而非提供已部署的智能体运行服务;实际框架实现仍需由项目自行完成。

这个 Agent 与同类方案有什么区别?

它与 Agno、Mastra、LangGraph 等智能体框架是互补关系:这些框架承载实际智能体代码,而 Better Agents 用于初始化围绕测试、评估、提示词和 MCP 配置的项目结构。它也配合 Claude Code、Cursor、Antigravity 和 Kilocode CLI 等编码助手使用,而非替代这些助手。

与相关度最高的同类 agent 并排比较关键指标。

Agent 源码审查 形态 / 费用 Star 最近更新 主语言 完整支持的平台
Better Agents 当前 54 · 缺口较多 命令行工具免费 + 模型费 ★ 1.6k 4 个月前 TypeScript Claude Code
Rulesync 69 · 存在缺口 命令行工具免费 ★ 1.5k 今天 TypeScript Codex · Claude Code
zero2Agent:从零到生产的 Agent 工程教程 61 · 存在缺口 网页应用免费 + 模型费 ★ 541 4 天前 Python —
Kite 智能体框架 51 · 缺口较多 命令行工具免费 + 模型费 ★ 11 2 个月前 Python OpenAI API · Claude API

FollowAgents 如何评估这个 Agent?

FollowAgents 源码审查 · FARS-2.1
缺口较多
54/ 100 五分制 2.7 / 5
信任安全 10/29
可靠稳定 8/14
适用触发 12/18
规范维护 12/18
有效结果 9/13
证据核验 3/8
查看各维度的扣分理由
信任安全10 / 29 · 1.7/5

证据显示:CLI 会引导用户选择 LLM 提供商并可能请求 API 密钥,但未明确说明权限最小化或数据流。存在遥测(默认开启)但可关闭,未说明收集的数据。依赖有安全覆盖(如 picomatch、axios 等),但未提供漏洞扫描证据。外部影响包括创建项目文件、安装依赖、可能调用外部 API,但未明确用户确认步骤。回滚机制未提及。来源归属:作者为 LangWatch,但未验证。扣分:权限最小化、用户确认、数据流透明、敏感数据处理、外部影响、回滚均缺乏明确证据。

可靠稳定8 / 14 · 2.9/5

证据显示:README 与 package.json 描述一致,CI 配置了类型检查、lint、构建、单元测试和 E2E 测试,但未提供测试结果。依赖项常见且版本固定,但未验证可用性。失败消息未在文档中说明。扣分:失败消息缺乏具体示例。

适用触发12 / 18 · 3.3/5

证据显示:面向开发者,支持多种框架和编码助手,场景明确。能力边界在文档中有所描述(如支持 Node.js 22+、特定助手)。触发精度:CLI 命令明确。环境适配:支持多种操作系统,但未明确说明。扣分:环境适配细节不足。

规范维护12 / 18 · 3.3/5

证据显示:有清晰的文档结构(docs/ 目录),安装说明明确,命名稳定(better-agents),有示例和 FAQ(文档中),已知限制未明确列出,MIT 许可证完整,有 CHANGELOG.md 和版本号,维护责任由 LangWatch 承担。扣分:已知限制未明确列出。

有效结果9 / 13 · 3.5/5

证据显示:输出为项目脚手架,可直接使用,价值在于标准化和最佳实践,成本为安装和使用 CLI。扣分:未提供实际使用效果或性能数据。

证据核验3 / 8 · 1.9/5

证据显示:README 中的声明(如“生产就绪”)缺乏具体证据支持,未提供测试结果或独立验证。扣分:声明可追溯性不足,缺乏交叉验证,事实与推断未明确分离。

风险与缓解建议
  • 源码中未见:回滚或恢复路径运行前先备份,或在 git 分支、快照上操作,确保改动可以撤销。
  • 遥测默认开启,需明确数据收集范围。
  • API 密钥处理方式未详细说明,需谨慎。
  • 回滚机制缺失,初始化失败可能留下部分文件。
证据充分度:低 评估于 2026年8月9日 审查版本 00c44b92fafc
查看完整评分方法 →

常见问题

它会直接部署或运行我的智能体吗?
不会。它的已说明作用是通过 CLI 初始化项目结构、配置和开发约定;实际智能体代码位于 app/ 或 src/。
需要哪些密钥?
需要 LangWatch API key,以及所选 LLM 提供商的 API key。
如何关闭遥测?
设置环境变量 BETTER_AGENTS_TELEMETRY=0;匿名使用遥测默认开启。
它支持哪些编码助手?
明确列出 Claude Code、Cursor、Antigravity 和 Kilocode CLI。
在 GitHub 查看 ↗ 安装 ↓

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents