Better Agents
为智能体项目生成可测试、可评估、可观测且可协作维护的开发结构。
- Star 数
- ★ 1.6k
- 最近更新
- 4 个月前
- License
- MIT
- 主语言
- TypeScript
- FA 评分
- 54/100 · 缺口较多
30 秒速览
- 运行形态
- 可在哪里用
- 通用 · 跨平台Claude Code
- 费用
- 软件免费,模型调用费用自付
- 上手难度
- 低 · 几分钟可跑通
- 开始前需要
- 典型场景
- 使用 Claude Code 开始 Agno 项目的开发者,希望第一次提交前就建立 Scenario 端到端测试目录和提示词版本管理。
- 不适合
- 需要开箱即用运行时的团队:它只生成项目骨架
- 不想依赖 LangWatch 云服务的团队
- 不使用 Claude Code、Cursor、Antigravity 或 Kilocode 的开发者
这个 Agent 能做什么,适合哪些场景?
Better Agents 是一个命令行工具和一套智能体开发标准,用于初始化新的智能体项目。它面向 Agno、Mastra、LangGraph 等可选框架,并可配合 Claude Code、Cursor、Antigravity 或 Kilocode CLI 等编码助手使用。初始化后,项目结构包含应用代码目录、端到端 Scenario 测试、评估 Notebook、版本化提示词、提示词注册表、MCP 配置和 AGENTS.md。其交付边界是生成和规范化本地项目骨架,而不是作为托管运行时执行智能体。它适合希望从项目起步阶段就纳入测试、提示词协作、评估和可观测性约定的团队。
运行 better-agents init . 或 better-agents init my-awesome-agent 后,CLI 会引导选择编程语言、智能体框架、编码助手、LLM 提供商和 API 密钥。它生成 app/(或 src/)、tests/scenarios/、tests/evaluations/、prompts/、prompts.json、.mcp.json、AGENTS.md、.env 与 .gitignore 等项目文件。tests/scenarios/ 用于 Scenario 端到端会话测试,tests/evaluations/ 放置用于评估 RAG 或分类等流水线环节的数据集和 Notebook,prompts/ 以 YAML 保存版本化提示词。.mcp.json 用于配置 MCP 服务器,使所选编码助手能够获得所选框架和 Scenario 测试相关的上下文。
- 使用 Claude Code 开始 Agno 项目的开发者,希望第一次提交前就建立 Scenario 端到端测试目录和提示词版本管理。
- 采用 Mastra 的团队,需要让多个成员通过 YAML 提示词和
prompts.json协作维护提示词。 - 构建含 RAG 或分类环节的 LangGraph 项目,并希望在
tests/evaluations/中保存评估数据与 Notebook 的工程团队。 - 需要为新智能体项目预置
.mcp.json、可观测性相关配置和开发约定的技术负责人。 - 已使用 Cursor、Antigravity 或 Kilocode CLI 的开发者,希望把现有编码助手接入统一的智能体项目结构。
如何安装或部署这个 Agent?
要求 Node.js 22+、npm 或 pnpm、一个受支持的编码助手、LangWatch API key 和所选 LLM 提供商的 API key。全局安装:npm install -g @langwatch/better-agents。也可免安装运行:npx @langwatch/better-agents init my-agent-project。
如何使用这个 Agent?
在当前目录初始化:better-agents init .;创建新目录并初始化:better-agents init my-awesome-agent。随后按 CLI 引导选择语言、框架、编码助手、LLM 提供商并提供所需 API key。默认启用匿名使用遥测;如需退出,设置 BETTER_AGENTS_TELEMETRY=0。
这个 Agent 有哪些优点和局限?
- 一次初始化同时建立 Scenario 端到端测试、评估 Notebook、提示词版本化和提示词注册表,而不只生成应用代码目录。
- 通过
.mcp.json将所选智能体框架与 Scenario 测试相关 MCP 配置纳入新项目。 - 可在初始化流程中选择语言、智能体框架、编码助手和 LLM 提供商,面向多种开发组合。
- 项目结构明确区分
tests/scenarios/、tests/evaluations/和prompts/,便于将行为测试、离线评估与提示词协作分开维护。
- 运行环境要求 Node.js 22+,并依赖 npm 或 pnpm。
- 需要 LangWatch API key 及所选 LLM 提供商的 API key,采用前需处理凭据配置。
- 文档列出的编码助手范围有限:Claude Code、Cursor、Antigravity 和 Kilocode CLI。
- 它生成项目标准和配置,而非提供已部署的智能体运行服务;实际框架实现仍需由项目自行完成。
这个 Agent 与同类方案有什么区别?
它与 Agno、Mastra、LangGraph 等智能体框架是互补关系:这些框架承载实际智能体代码,而 Better Agents 用于初始化围绕测试、评估、提示词和 MCP 配置的项目结构。它也配合 Claude Code、Cursor、Antigravity 和 Kilocode CLI 等编码助手使用,而非替代这些助手。
与相关度最高的同类 agent 并排比较关键指标。
| Agent | 源码审查 | 形态 / 费用 | Star | 最近更新 | 主语言 | 完整支持的平台 |
|---|---|---|---|---|---|---|
| Better Agents 当前 | 54 · 缺口较多 | 命令行工具免费 + 模型费 | ★ 1.6k | 4 个月前 | TypeScript | Claude Code |
| Rulesync | 69 · 存在缺口 | 命令行工具免费 | ★ 1.5k | 今天 | TypeScript | Codex · Claude Code |
| zero2Agent:从零到生产的 Agent 工程教程 | 61 · 存在缺口 | 网页应用免费 + 模型费 | ★ 541 | 4 天前 | Python | — |
| Kite 智能体框架 | 51 · 缺口较多 | 命令行工具免费 + 模型费 | ★ 11 | 2 个月前 | Python | OpenAI API · Claude API |
FollowAgents 如何评估这个 Agent?
查看各维度的扣分理由
证据显示:CLI 会引导用户选择 LLM 提供商并可能请求 API 密钥,但未明确说明权限最小化或数据流。存在遥测(默认开启)但可关闭,未说明收集的数据。依赖有安全覆盖(如 picomatch、axios 等),但未提供漏洞扫描证据。外部影响包括创建项目文件、安装依赖、可能调用外部 API,但未明确用户确认步骤。回滚机制未提及。来源归属:作者为 LangWatch,但未验证。扣分:权限最小化、用户确认、数据流透明、敏感数据处理、外部影响、回滚均缺乏明确证据。
证据显示:README 与 package.json 描述一致,CI 配置了类型检查、lint、构建、单元测试和 E2E 测试,但未提供测试结果。依赖项常见且版本固定,但未验证可用性。失败消息未在文档中说明。扣分:失败消息缺乏具体示例。
证据显示:面向开发者,支持多种框架和编码助手,场景明确。能力边界在文档中有所描述(如支持 Node.js 22+、特定助手)。触发精度:CLI 命令明确。环境适配:支持多种操作系统,但未明确说明。扣分:环境适配细节不足。
证据显示:有清晰的文档结构(docs/ 目录),安装说明明确,命名稳定(better-agents),有示例和 FAQ(文档中),已知限制未明确列出,MIT 许可证完整,有 CHANGELOG.md 和版本号,维护责任由 LangWatch 承担。扣分:已知限制未明确列出。
证据显示:输出为项目脚手架,可直接使用,价值在于标准化和最佳实践,成本为安装和使用 CLI。扣分:未提供实际使用效果或性能数据。
证据显示:README 中的声明(如“生产就绪”)缺乏具体证据支持,未提供测试结果或独立验证。扣分:声明可追溯性不足,缺乏交叉验证,事实与推断未明确分离。
- 源码中未见:回滚或恢复路径运行前先备份,或在 git 分支、快照上操作,确保改动可以撤销。
- 遥测默认开启,需明确数据收集范围。
- API 密钥处理方式未详细说明,需谨慎。
- 回滚机制缺失,初始化失败可能留下部分文件。
常见问题
它会直接部署或运行我的智能体吗?
app/ 或 src/。需要哪些密钥?
如何关闭遥测?
BETTER_AGENTS_TELEMETRY=0;匿名使用遥测默认开启。