Aiden
把目标交给可验证执行的本地自动化工作引擎。
按维度查看评分与理由
证据显示有风险分级审批、信任级别、预算、作用域权限、租约和生成围栏,以及10模块安全护城河(moat/)门控工具调用,包括危险命令分类器、SSRF安全URL获取器、秘密/PII预写扫描器。用户确认通过审批面板实现,破坏性操作即使在高信任级别也需询问。数据流透明度通过作业、尝试、效果、证据、验证、裁决和证明的跟踪实现,但未提供详细的日志或审计线索。敏感数据处理:API密钥存储在本地.env,OAuth令牌以0600权限存储,但未明确说明加密或泄露防护。依赖安全:有npm audit CI步骤(高严重性,continue-on-error)和overrides,但未提供漏洞扫描结果。外部影响:有浏览器和终端执行,但通过审批和沙箱(Docker)控制,未明确说明所有外部副作用。回滚:有/undo命令和冲突证据,但未提供完整的回滚机制。来源归属:作者和仓库明确,但发布者未验证。
自一致性:README、package.json和CI配置在版本号(4.19.1)和功能描述上一致,但README中提到的技能/工具数量与package.json描述略有差异(76 vs 69+)。依赖可用性:依赖列表完整,有overrides,但未提供锁定文件或完整性校验。失败消息:有错误恢复系统(TCE)和失败注入覆盖,但未提供具体的失败消息示例。
受众和场景:README列出了多种用例(代码库模式、研究、浏览器工作流等),但未提供详细的场景指南。能力边界:有信任级别和审批,但未明确列出所有工具的能力边界。触发精度:有触发器(文件、计划、邮件、webhook),但未提供精确的触发条件文档。环境适配:支持Windows、Linux、WSL、macOS API模式,但未提供详细的系统要求。
信息架构:有README、docs/目录、CHANGELOG.md,但未提供完整的架构文档。安装说明:有npm安装和npx命令,但未提供详细的安装步骤或故障排除。命名稳定性:版本号稳定,但未提供命名约定文档。示例和FAQ:有示例提示,但未提供FAQ。已知限制:有已知问题(终端调整大小),但未提供全面的限制列表。许可证:AGPL-3.0,有LICENSE文件,完整。版本和变更日志:有CHANGELOG.md和版本号,但未提供详细的变更日志。维护责任:有作者和联系方式,但未提供维护计划。
输出可用性:有证据、验证和裁决,但未提供输出格式的详细说明。边际价值:有独特功能(证据跟踪、恢复),但未提供与其他工具的比较。成本效益:有预算和成本跟踪,但未提供定价或成本分析。
声明可追溯性:README中的声明有部分支持(如技能数量),但未提供详细的证据。跨来源佐证:有CI和测试,但未提供独立验证。事实与推断分离:有证据和验证,但未明确区分事实和推断。
- 发布者身份未验证,需谨慎对待。
- 依赖安全扫描未提供结果,且npm audit为continue-on-error,可能掩盖漏洞。
- API服务器默认无认证(loopback),需设置AIDEN_API_KEY。
- 技能和工具数量在文档中不一致,需核实。
- 回滚机制不完整,仅提供/undo命令。
这个 Agent 能做什么,适合哪些场景?
Aiden 是面向真实电脑操作的自治工作引擎,可通过终端 TUI、一次性命令、守护进程、频道适配器和 MCP 运行同一套执行生命周期。它将请求建模为 Job,并以带 generation、lease、预算和取消状态的 Attempt 执行;对外部或有副作用的操作则记录为 Effect。文件改动、测试、构建、诊断、浏览器操作和 Git 操作可附加 Evidence,经 Verification、Verdict 和 Proof 后才形成完成结论。其 Codebase Mode 会先记录仓库快照、分支、HEAD、脏文件、清单和锁文件,再进行冲突安全的变更与结构化验证。运行时基于 Node.js、TypeScript、SQLite、Playwright 与 Chromium,支持 Windows、Linux、WSL,以及 macOS API mode。
用户可用 aiden 进入 Operator TUI,或以 aiden -q "..." 执行一次性任务。Aiden 能读取和写入文件、执行 shell 命令与代码、启动和管理进程、进行网页搜索与抓取、通过 Playwright/Chromium 操作浏览器、调用 API 与 MCP server,并可操作已支持的应用和频道。Codebase Mode 会建立仓库快照,检查 VCS 状态、分支、HEAD、脏文件、未跟踪文件、manifest、lockfile、构建与测试命令;文件变更绑定到 Attempt、源快照和 Effect,并通过磁盘回读、哈希和 diff 记录结果。TestRun、BuildRun 和 Diagnostic 记录命令、解析后的结果、产物、失败信息及验证状态;Git 的 branch、stage、commit、fetch、pull、push 和 tag 也作为可协调的 Effect。启用 AIDEN_DAEMON=1 后,文件监视器、webhook、邮件轮询和计划任务可经持久化 trigger bus 调度 agent turn。
- 负责维护 Node.js 仓库的工程师,可让 Aiden 先快照仓库、定位失败测试、修改冲突安全的文件,再运行相关测试和构建并保留验证证据。
- 需要重复处理浏览器后台流程的运营人员,可让它导航支持的网站、填写表单、处理标签页和对话框,并捕获执行结果。
- 使用 Windows、Linux 或 WSL 的个人用户,可把整理文件、检查系统状态和执行固定终端步骤交给交互式 TUI。
- 希望对收件目录中新到达的
.txt文件作出响应的自动化用户,可启用 daemon,并用aiden trigger add file添加文件监视触发器。 - 需要把研究结果保存为结构化交付物的分析人员,可让它搜索、比较来源、汇集发现并创建 Markdown 报告。
- 需要拆分大型任务的用户,可让 Aiden 启动隔离上下文、相交工具集的 sub-agent,并要求子任务返回可复核的证据。
这个 Agent 有哪些优点和局限?
- 不是只以命令退出码或模型回复判断完成:Job、Attempt、Effect、Evidence、Verification、Verdict 和 Proof 被分开追踪。
- Codebase Mode 在写入前记录仓库与 VCS 快照,并阻止过期基线、不安全路径、符号链接逃逸和冲突的用户编辑。
- 支持 19 个提供商、Ollama、自定义 OpenAI-compatible endpoint,以及在支持场景下的 ChatGPT OAuth 订阅路由。
- 交互式 TUI、one-shot、daemon、频道、MCP 和浏览器工作流复用同一套持久化执行权威与恢复机制。
- 需要 Node.js ≥18、npm、所选提供商的认证与可用模型;模型质量和预算会直接影响复杂任务的结果。
- 它可读写文件、运行 shell、访问网页和外部服务,因此部署时需要审查权限、凭据和备份策略。
- macOS 仅标为 API mode;部分能力被明确说明为实验性或依赖平台。
- 已知问题指出激烈调整终端大小时可能出现活动行的视觉伪影,虽未发现重复执行或状态损坏。
- 守护进程、邮箱、webhook 和浏览器等功能需要额外配置;daemon 默认关闭。
如何安装或部署这个 Agent?
需要 Node.js ≥18 和 npm,并为所选模型提供商准备认证信息。安装并首次启动:
npm install -g aiden-runtime
aiden首次启动会进入设置流程,选择提供商、获取可用模型(支持时)并进行连接探测。也可免全局安装运行:
npx aiden-runtime@latest用 aiden --version 验证安装;用 aiden doctor 诊断提供商、认证、配置与环境。
如何使用这个 Agent?
在 TUI 中输入一个完整目标,或运行:
aiden -q "Inspect this repository, explain how it works, identify the three highest-risk areas, and support the findings with repository Evidence."用 /model 选择提供商和模型;也可设置 AIDEN_DEFAULT_PROVIDER 与 AIDEN_DEFAULT_MODEL。若需后台触发,执行:
export AIDEN_DAEMON=1
aiden trigger add file --path ~/Documents/inbox --label "watch-inbox" --include "*.txt"
aiden随后可用 aiden runs list 查看触发的运行。守护进程默认绑定 127.0.0.1;非 loopback 绑定需要设置 AIDEN_API_KEY。
常见问题
Aiden 是否必须使用某一家模型提供商?
它会不会自动执行危险操作?
任务中断或外部结果不确定时怎么办?
能否在没有常驻服务的情况下使用?
aiden 使用终端界面,或用 aiden -q "..." 执行一次性任务;daemon 是 opt-in。