Aegis 方法包
让编程智能体先核对架构基线,再安全修改并用新证据验证结果。
SECURITY.md明确将产品限定为Method Pack,并区分宿主平台与未来Runtime Core;测试中的临时目录有清理机制,许可证和版权归属清楚。扣分在于所给材料没有展示核心插件实现、权限清单、用户确认点、数据流或敏感数据处理规则;依赖仅声明为可选peer dependency,未见锁文件、审计或供应链固定措施。外部效果和回滚证据也主要来自测试脚本,而非产品行为。
包元数据、Security边界和CI检查对象基本一致,CI覆盖模式包边界、结构、兼容性与聚合静态检查。依赖和宿主缺失被明确识别为跳过条件,可选peer dependency也减少硬失败。测试脚本的未知参数、缺失CLI、宿主表面不兼容及运行条件阻塞都有具体消息,因此failure_messages给满分;但未提供主要实现和完整测试内容,无法确认所有路径的一致性或依赖可用性。
材料显示面向多个宿主或扩展表面,包括OpenCode、Codex、Pi、OMP、DSH和Antigravity,并对宿主缺失、认证或配置阻塞作区分。SECURITY.md清楚否认Runtime Core权限,边界较好;但实际受众说明、使用场景、触发规则及误触发防护未提供,环境适配证据主要是包配置、CI和一个Antigravity探测脚本,故未给高分。
存在README语言入口、标准包元数据、SECURITY.md、CI、测试目录和完整MIT许可证;名称Aegis及Method Pack边界在材料中较稳定,已知宿主与运行限制也有说明。扣分在于主README内容未提供,无法看到安装步骤、示例或FAQ;只有package版本2.8.8,没有变更日志或版本策略;安全报告建议联系维护者,但未给出确定的联系人、响应时限或明确维护组织。
描述提出baseline-first、证据验证和漂移检查等潜在增益,测试还验证doctor可输出结构化JSON并确认配置状态。不过所给文件没有核心工作流、产物样例或实现代码,无法静态判断输出是否足够可用,也无法量化相对普通编码代理的边际价值。可选依赖和宿主中立CI暗示一定成本控制,但安装、运行开销及收益权衡没有实质说明。
CI把若干边界、结构、兼容性和静态聚合主张映射到具名脚本;Antigravity脚本也清楚区分通过、失败和因环境造成的跳过。SECURITY.md、package.json和CI对Method Pack定位形成一定交叉印证,并明确分离现有能力、未来Runtime Core以及需要真实宿主的集成探测。扣分是关键被调用脚本、主README和产品实现未提供,核心架构感知与漂移检查主张无法逐项追溯或多源核对。
- 未提供主README、核心插件代码及多数CI所调用脚本;不要把“架构感知、证据验证、漂移检查”视为已经由本次静态材料完整证明。
- 在采用前应核查实际文件读写、命令执行、网络访问、遥测、凭据处理和用户确认边界。
- 应审查可选DeepSeek预发布依赖及GitHub Actions依赖的锁定、来源、漏洞状态和更新策略。
- 默认CI明确不运行真实Codex宿主冒烟测试,Antigravity集成测试也需显式启用且可能跳过;宿主兼容性仍需在目标环境验证。
- 安全报告路径依赖GitHub私密报告是否启用,备用的维护者联系方式和响应时限不明确。
这个 Agent 能做什么,适合哪些场景?
Aegis 是面向 AI 编程智能体的方法包,而不是守护进程、后台执行器或完整智能体平台。它通过可发现的技能、宿主安装适配、工作流规则和验证脚本,把基线确认、架构边界、实施、独立审查与完成验证组织成一套流程。智能体在修改代码前应识别项目中的责任归属、契约和边界,完成后则提供新生成的验证证据、覆盖范围与剩余风险。项目还提供 `scripts/aegis-doctor.py`、`scripts/aegis-update.py`、端到端检查脚本、宿主安装指南以及可选的激活与 TDD 模式。它可用于 Codex、OpenCode 及多种其他技能型宿主,但只有 Codex 和 OpenCode 被说明具有当前方法包范围内的新鲜验证证据;多数其他宿主仍缺少发布级的新鲜冒烟测试。
安装后,宿主发现并加载 Aegis 技能,由这些技能根据请求复杂度选择轻量或完整工作流。对于非简单任务,流程先读取目标项目的真实基线,包括责任归属、契约、边界,以及可选的 CONTEXT.md 或由 CONTEXT-MAP.md 选定的有限上下文;只有遇到已解析、歧义、重命名、弃用或冲突的术语时才启用领域建模。随后,编程智能体在该基线上规划和实施修改,追踪已退役的回退路径或旧路径,并在声明完成前运行新的验证。交付内容包括验证证据、已覆盖范围和剩余风险,而不是由 Aegis 产生权威的 GateDecision、PolicySnapshot 或最终完成裁定。scripts/aegis-doctor.py --write-config --json 检查安装、工作区支持和配置状态;scripts/aegis-update.py 按当前宿主更新已安装的方法包。维护者可运行 bash tests/e2e/run-all.sh --full --host-profile fast 以及边界、工作流质量和安装策略检查。
- 在大型既有代码库中工作的开发团队,希望编程智能体先识别模块责任、接口契约和架构边界,再开始修改。
- 需要委派跨多个步骤的长期任务、但担心智能体随时间偏离原始范围的工程师。
- 要求智能体在修复缺陷后提交新测试或检查证据、覆盖范围与剩余风险,而不接受仅凭口头宣称完成的评审者。
- 同时使用 Codex、OpenCode、Claude Code 或其他技能型宿主,并希望采用相近工程纪律的个人或团队。
- 准备合并高风险变更,希望先进行独立审查、第一性原理复核或严格测试优先流程的维护者。
- 希望小任务保持轻量、仅在风险上升时增加架构与验证流程的开发者。
这个 Agent 有哪些优点和局限?
- 把修改前的真实基线、责任归属、契约和架构边界纳入工作流,针对既有项目中常见的错误假设。
- 完成声明必须附带新验证证据、覆盖范围和剩余风险,并包含专门的安装诊断与端到端检查脚本。
- 在冻结的 120 次、20 个案例 A/B 基准中,契约通过率由 61.67% 升至 93.33%,不安全结果由 13.33% 降至 0%;项目同时明确限定了该证据的适用范围。
- 提供轻量路径、自动或显式激活、可选 TDD 路由及独立审查等控制,不强制所有任务采用同等流程。
- 同一方法包面向 Codex、OpenCode、Claude Code、DeepSeek Harness、Kimi Code CLI 等多个技能型宿主,并提供宿主级安装指南。
- 它不是完整平台、运行时核心、后台执行器或最终完成裁定系统;实际执行仍依赖外部编程智能体和宿主。
- 除 Codex 和 OpenCode 外,多数列出的宿主尚缺少发布级的新鲜冒烟测试;Claude Code 等集成因此存在验证缺口。
- 基准属于有边界的建议性证据:评审是隐藏实验组的技术评审,而非独立人工评审,宿主事件也未返回实际模型身份。
- 安装不是统一的一条命令;用户必须选择宿主指南、验证技能发现、原生激活和自动入口,部分宿主还需要额外参数。
- 全局路由前缀需手动复制,且不会由
aegis:update管理;旧 Lite 或 Advanced 配置需要人工替换对应区块。 - Gemini CLI 适配器已经退役,不再由项目发布或验证。
如何安装或部署这个 Agent?
仓库给出的最快入口,是让当前 AI 编程智能体读取 https://github.com/GanyuanRan/Aegis,识别正在使用的宿主,并依照对应宿主指南执行全局安装。安装或重新加载宿主后,先找到 <aegis-method-pack-root>,再运行:
cd <aegis-method-pack-root>
python scripts/aegis-doctor.py --write-config --json只有 JSON 同时包含 "ok": true、"workspaceSupport": "available" 和 "configStatus": "configured",并完成宿主原生激活及自动入口检查时,才能视为完整安装。若宿主使用独立技能发现目录,还需传入 --discovery-root <path>;若指南规定技能目录名前缀,还需传入 --discovery-name-prefix <prefix>。官方 DeepSeek Harness 的原生安装命令是:
dsh plugin --profile <profile> add "git+https://github.com/GanyuanRan/Aegis.git"该宿主的直接子目录兼容路径只应在插件管理器不可用且用户明确同意兼容模式时使用。来源没有给出统一的手工克隆命令、Python 版本或各宿主完整安装命令,因此具体路径仍由所选宿主指南决定。
如何使用这个 Agent?
完成安装并重启宿主后,可直接用自然语言调用,例如:Aegis goal: Fix the auth refresh bug without rewriting the auth system.、Why does this login failure happen? Diagnose it before changing code. 或 Review this diff independently before I merge it.。需要决策访谈时使用 Grill me ... 或 审问我 ...;它会一次询问一个决策问题,不进入规划或实施。需要严格测试优先时使用 TDD Route: strict、strict TDD、test-first 或 RED / GREEN / REFACTOR。TDD 默认关闭;若希望 Aegis 按任务风险自动选择严格、轻量或跳过模式,可在方法包根目录运行 python scripts/aegis-doctor.py tdd-mode auto。激活默认自动进行;切换到显式模式可运行 python scripts/aegis-doctor.py activation-mode explicit,随后重启宿主。更新当前宿主可请求 update Aegis 或 aegis:update;更新所有已登记宿主必须显式要求 --all。
这个 Agent 与同类方案有什么区别?
Aegis 源自 Jesse Vincent 创建的 Superpowers。两者都采用可组合、跨宿主的智能体技能思路;Aegis 在此基础上增加面向真实软件项目的架构基线、证据验证、漂移控制和工作流治理。它也受到 mattpocock/skills 的简洁沟通、共享语言和纪律化调试模式启发,但相关做法以 Aegis 格式重新实现。
常见问题
Aegis 会自行运行或在后台自动修改代码吗?
它能权威判断变更已经安全完成吗?
GateDecision、PolicySnapshot 或最终完成裁定;用户指令和目标项目规则优先。是否支持 Claude Code?
它会强制所有任务采用 TDD 和重型流程吗?
auto,由任务风险决定严格、轻量或跳过。安装成功如何判定?
ok 为 true、workspaceSupport 为 available、configStatus 为 configured;还必须完成对应宿主的原生激活和自动入口检查。