Loki Mode
把规格转为经验证代码与可复核交付凭证。
按维度查看评分与理由
证据显示:README 强调只读评估模式(--assess)、用户确认(--strict 阻止所有行为变更)、证据收据分离事实与 AI 评估、GPG 签名可选、secret-leak 门禁。扣分:未提供权限最小化的具体实现细节(如文件系统访问范围),敏感数据处理(如 API 密钥存储)未详细说明,依赖安全(如漏洞扫描)仅提及,回滚机制未明确,发布者身份未验证。
证据显示:README 声称有 8 个质量门禁、确定性验证、失败时明确报告(NOT VERIFIED),测试文件展示了对等价性报告和评分器的自检。扣分:依赖可用性(如 Bun、Python)未在文档中明确保证,失败消息的具体内容未展示。
证据显示:README 描述了多种使用场景(新项目、遗留代码、不同 spec 类型)、能力边界(如不支持某些模型)、触发条件(如 --assess 只读)、环境适配(跨平台、Docker)。扣分:未提供详细的配置选项文档,环境要求(如 Bun 版本)未明确。
证据显示:README 结构清晰,包含安装、使用、文档链接、变更日志、许可证(BUSL-1.1)、版本号(v9.16.0)。扣分:已知限制未单独列出,维护责任(如贡献指南)未明确,发布者身份未验证。
证据显示:README 强调输出为可验证的 Git 仓库、证据收据、成本估算,边际价值(如验证完成)和成本效益(如免费使用)有说明。扣分:未提供实际使用案例或性能数据。
证据显示:README 提供可运行的验证命令(loki proof verify)、测试文件展示自检,并明确区分事实与 AI 评估。扣分:跨来源佐证不足(仅依赖自身文档),部分声明(如“8 个质量门禁”)未在代码中直接验证。
- 发布者身份未验证,需谨慎对待来源。
- 依赖安全仅提及,未提供具体漏洞扫描结果或依赖清单。
- 敏感数据处理细节不足,如 API 密钥存储方式。
- 回滚机制未明确,需确认在失败时如何恢复。
这个 Agent 能做什么,适合哪些场景?
Loki Mode 是一个从需求规格驱动的软件构建与验证 CLI。它接受 PRD、GitHub Issue、OpenAPI/JSON/YAML、纯文本 brief 等输入,通过 Bash 编排的 RARV 循环执行 Reason、Act、Reflect、Verify。运行会生成 Git 仓库中的源代码、测试、配置、Docker Compose 文件、CI/CD 配置、审计日志及 `.loki/proofs/<run_id>/` 下的 Evidence Receipt。该项目提供 `loki` CLI、Python 仪表盘、跨项目记忆系统,以及可由 `loki mcp` 启动的 MCP server。它可以生成部署配置,但文档明确说明 `loki deploy` 只输出部署命令,不会自行执行云端 CLI 或 `git push`。
使用 loki start <spec> 读取并标准化 Markdown、JSON、YAML/OpenAPI、GitHub Issue、Jira、GitLab 或 Azure DevOps issue 等规格输入,再由 autonomy/run.sh 的 run_autonomous() 执行 RARV 循环。它按复杂度组合 41 个角色规格,运行静态分析、测试、盲审、反迎合检查、mock 完整性、测试变异、文档覆盖和 Magic Modules 辩论等 8 个质量门。完成时,Loki 将 diff 的 base/head SHA、diff_sha256、测试和构建命令及退出码、门禁结果写入 Evidence Receipt;可通过 loki proof list、loki proof show <id> 与 loki proof verify <id> 检查。loki verify 还能对任意分支或 PR diff 运行构建、测试、静态分析、密钥扫描和依赖审计,并将机器可读证据写入 .loki/verify/evidence.json。对已有代码库,loki modernize heal <path> --assess 会先以只读方式产出语言、成熟度、技术债和按爆炸半径排序的建议。
- 需要把一份 PRD 或一句产品需求交给 CLI,并希望最终获得代码、测试和可复核 diff 证据的小型产品团队。
- 维护多年旧仓库的工程团队,可先运行
loki modernize heal ./repo --assess评估技术债而不修改文件。 - 需要把 OpenAPI、GraphQL 或 Postman 合约拆成逐操作检查项的 API 团队。
- 希望在 PR 审查中附带测试、diff 哈希和门禁结果,而不只依赖代理自述完成状态的代码审查者。
- 使用 Claude Code 为主、但需在 Cline、Codex、Aider 或 opencode 间保留切换和故障转移路径的开发者。
这个 Agent 有哪些优点和局限?
- Evidence Receipt 将 diff 哈希、实际测试命令与退出码、构建结果和门禁结论写为可重新验证的文件,并明确区分确定性事实与 AI 判断。
loki verify可独立检查任意分支或 PR diff,并使用 0、1、2 作为 VERIFIED、CONCERNS、BLOCKED 的 CI 退出码。- 支持从多种规格来源启动,包括 PRD、OpenAPI/JSON/YAML、GitHub Issue、Jira 和 GitLab/Azure DevOps issue。
- 既支持新项目构建,也提供带 archaeology、stabilize、isolate、modernize、validate 阶段的旧系统修复流程。
- 提供 Claude Code、Cline、Codex、Aider、opencode 的 provider 路径,以及本地 MCP server、Docker Compose 输出和本地仪表盘。
- Claude Code 是唯一标注为 Tier 1 且端到端验证的 provider;Cline、Codex、Aider 和 opencode 均为实验性且顺序执行。
- 实际构建需要已认证的模型提供商 CLI 或 Anthropic 凭据;
tour和离线 demo 只是历史样例回放,不能验证你的项目。 - 凭证未签名时,README 明确承认攻击者若同时重写事实、标题并重算哈希,仍可能通过验证;GPG 签名需自行配置。
- 项目采用 Bash 与 Bun 双运行时,部分命令由 Bun 路由;文档还提示后续大版本可能终止 Bash 运行时,带来迁移风险。
- 许可证信息存在不一致:提供的仓库元数据标为
NOASSERTION,README 则声明 BUSL-1.1,并称 2030 年转换为 Apache 2.0。
如何安装或部署这个 Agent?
快速查看离线示例:npx loki-mode tour。推荐全局安装:bun install -g loki-mode;随后运行 loki doctor 检查环境。常规运行需要 Python 3.10+、Git 2.x、curl,以及已安装并认证的 provider CLI;README 将 Claude Code 列为 Tier 1。也可使用内置 Claude Agent SDK:设置 ANTHROPIC_API_KEY=sk-...,并执行 LOKI_SDK_MODE=full loki start prd.md,此路径要求 Bun 在 PATH 中。
如何使用这个 Agent?
首次可执行 loki quickstart,按提示完成环境检查、输入想法、选择模板并审阅计划。脚本化流程可用:loki init my-app --template simple-todo-app,然后 cd my-app && loki start prd.md。运行完成后用 loki proof list 找到凭证,并用 loki proof verify <id> 重新计算哈希和 diff;对现有分支可运行 loki verify。若需要本地仪表盘与预览,使用 loki dashboard 或 loki preview。
这个 Agent 与同类方案有什么区别?
README 将 Loki Mode 与 bolt.new、Replit 和 Lovable 对比,主张其具备自托管、自带密钥、多 provider 故障转移、8 个质量门和盲审。该比较仅针对表中列出的产品,README 也明确表示并未覆盖整个市场。
常见问题
不安装或不配置 API key 能试用吗?
npx loki-mode tour 或 loki demo --offline 查看历史 Evidence Receipt;两者均为回放样例,不会对你的代码给出结论。它会自动部署或推送我的代码吗?
loki deploy 只打印部署命令,不执行云端 CLI 或 git push。