PRO-LONG
为长任务编码代理提供持久记忆:所有事件写入一个本地追加式日志,代理用代码按需检索,而不是塞进提示词。
- Star 数
- ★ 458
- 最近更新
- 1 个月前
- License
- MIT
- 主语言
- Python
- FA 评分
- 57/100 · 缺口较多
30 秒速览
- 运行形态
- 可在哪里用
- 通用 · 跨平台Codex · Claude Code
- 费用
- 免费,无需付费服务
- 上手难度
- 低 · 几分钟可跑通
- 开始前需要
- 典型场景
- 用 Claude Code 或 Codex 做跨越压缩或多天会话的大型重构,需要代理记住早期决策
- 不适合
- 不允许在本地保留含敏感信息的会话记录的团队
- 只使用未列出的编码客户端、且不愿自行适配的开发者
- 期望一个已被直接验证过的编码基准、而非研究结果的采购者
- 源码审查
- 57/100 · 缺口较多
这个 Agent 能做什么,适合哪些场景?
PRO-LONG(GitHub: alexisfox7/PRO-LONG,MIT 许可)为 Codex、Claude Code、OpenCode 和 pi 等编码 CLI 提供可编程的长期记忆。长任务往往超出上下文窗口,压缩或新开会话后,代理可能丢失早期决策、重复失败的工作。PRO-LONG 通过项目本地适配器把提示词、工具活动、助手交接和会话边界追加到 .prolong/log.l 中,并提供一个 agent skill 教代理用 rg、jq 或 Python 等普通工具检索日志。它不注入完整日志、不包装你的 CLI,也没有服务器或数据库;读取日志的内容不会被再次记录,避免记忆自我复制。该项目源于长时程代理研究,在 ARC-AGI-3 全公开游戏集上以 Fable 5 达到 97.4% best@2,比匹配基线平均提升 18 个百分点,但作者明确说明这尚未直接验证编码工具 MVP。
运行 prolong init 后,它检测 PATH 上的受支持客户端并安装:.prolong/runtime.mjs(零依赖事件写入器)、.prolong/log.l(追加式日志)、.prolong/install.(安装清单)、.agents/skills/prolong/SKILL.md(检索 skill)、AGENTS.md 指针、.gitignore 中的 .prolong/ 条目,以及各客户端集成(Codex 的 .codex/hooks.、Claude Code 的 .claude/settings. 生命周期钩子、OpenCode 的 .opencode/plugins/prolong.ts、pi 的 .pi/extensions/prolong.ts)。适配器把生命周期事件追加到日志;当先前工作相关时,skill 指导代理用 rg、jq 或 Python 搜索日志并只读相关条目。CLI 共三条命令:prolong init(可用 --client codex,claude-code,opencode,pi 显式选择)、prolong status(支持 --)、prolong uninstall(保留日志,--purge 连历史一起删除)。
- 用 Claude Code 或 Codex 做跨越压缩或多天会话的大型重构,需要代理记住早期决策
- 调试长任务时,希望代理能检索之前失败的工具调用和结果,避免重复踩坑
- 在同一项目里频繁新开会话、希望每次都能找回相关历史的开发者
- 使用 OpenCode 或 pi、想要无服务器无数据库的本地记忆方案的用户
- 重视隐私、要求记忆留在项目内并默认被 gitignore 的团队
如何安装或部署这个 Agent?
需要 Node.js/npm 环境和 PATH 上已安装的受支持编码客户端。克隆并构建:
bash
git clone https://github.com/alexisfox7/PRO-LONG.git && cd PRO-LONG
npm install && npm run build && npm link然后在你的项目目录中初始化:
bash
cd /path/to/your/project
prolong init如需显式指定客户端:
bash
prolong init --client codex,claude-code,opencode,pi如何使用这个 Agent?
初始化后正常使用你的编码代理即可——PRO-LONG 在后台记录,代理在任务跨压缩或会话时通过 prolong skill 检索相关历史。可用以下命令检查状态或卸载:
bash
prolong status
prolong status --
prolong uninstall
prolong uninstall --purge注意:钩子与扩展以你的用户权限运行,首次使用前应审查生成的集成文件并接受客户端的项目/钩子信任提示。
这个 Agent 有哪些优点和局限?
- 日志不注入每次提示词,且日志读取不被记录,避免上下文膨胀和记忆递归复制
- 零依赖的本地 runtime.mjs,无服务器、无数据库,日志留在项目内并默认 gitignore
- 一条命令同时集成四个主流编码 CLI(Codex、Claude Code、OpenCode、pi),且保留你原有工作流
- 有 ARC-AGI-3 研究背书(97.4% best@2、平均提升 18 个百分点)并附复现代码与论文
- 日志会包含提示词、工具输入输出及其中出现的任何密钥,敏感项目需评估本地政策
- 97.4% 的结果来自研究 harness(Fable 5),作者自认还不是编码工具 MVP 的直接基准
- 仅内置支持四个客户端,其他 CLI 需自行适配钩子/插件
- 记忆质量依赖代理遵循 SKILL.md 主动检索,无检索则无收益
这个 Agent 与同类方案有什么区别?
README 未点名具体竞品,但定位隐含了与'把完整转录/记忆注入提示词'或'外置记忆服务器/数据库'类方案的区别:PRO-LONG 选择本地追加式日志加代码检索,不引入包装器或服务。
与相关度最高的同类 agent 并排比较关键指标。
| Agent | 源码审查 | 形态 / 费用 | Star | 最近更新 | 主语言 | 完整支持的平台 |
|---|---|---|---|---|---|---|
| PRO-LONG 当前 | 57 · 缺口较多 | 命令行工具免费 | ★ 458 | 1 个月前 | Python | Codex · Claude Code |
| MonoCode | 56 · 缺口较多 | 桌面应用免费 | ★ 1.6k | 1 天前 | TypeScript | Codex · Claude Code |
| Coder Eval | 86 · 表现良好 | 命令行工具免费 + 模型费 | ★ 141 | 今天 | Python | Codex · Claude Code · OpenAI API · Claude API |
| Emulo | 78 · 表现良好 | Agent 插件 / 技能免费 + 模型费 | ★ 292 | 3 天前 | HTML | Codex · Claude Code |
FollowAgents 如何评估这个 Agent?
查看各维度的扣分理由
信任:README 明确说明钩子以用户权限运行、运行时零依赖、日志留在项目内并默认 gitignore,隐私一节警告日志可能包含密钥并提供 --purge 清除;卸载保留用户已有配置。扣分点:src/ 源码未在证据中出现,runtime.mjs 的实际行为、hook 注入内容与日志写入逻辑均只能依据 README 断言,无法静态核实,故未给满分;来源归属依赖 CITATION.cff 引用但该文件未提供,发布者身份未经验证,记 1。
可靠性:tests/lifecycle.test.ts 存在明显缺陷——断言使用了未定义的 claudeConfig 和 pluginPath、调用了未导入的辅助函数(如临时目录创建用到的符号与导入不一致),意味着测试套件很可能无法编译通过,这直接削弱自一致性证据,记 1;测试同时展示了幂等 init、非法 JSON 时安全失败并保留现场、status -- 与卸载警告等良好失败处理,记 2;仅依赖 Node>=20 且无运行时依赖,可用性风险低,记 2。
适应性:面向编码代理场景清晰,支持四种客户端并可选择;README 诚实地将 ARC-AGI-3 研究结果与编码工具 MVP 区分开,说明能力边界。扣分点:检索触发的精确性(何时搜索、搜索策略)只有一句 skill 描述,无 SKILL.md 或源码佐证,记 1。
规范:MIT 许可证文件齐全且与 package. 一致,记 3;README 结构清晰、安装说明完整、命名(pro-long/prolong)一致、对局限有坦诚说明,各记 2;扣分点:无 CHANGELOG,仅 README 中一条更新记录且标注 2026 年 8 月(日期可疑),版本仅 0.1.0,记 1;无使用示例或 FAQ,尤其是最核心的日志搜索用法没有示例,记 1;维护责任仅有一个 issues 链接,发布者未经验证,无治理或响应承诺,记 1。
有效性:产出(.prolong/log.l)可用标准工具 rg/jq/Python 检索,status 支持 -- 自动化,记 2;针对压缩后上下文丢失的边际价值论据合理但 MVP 本身无基准数据,记 2;扣分点:成本收益无法核实——README 承认 97.4% 的结果不直接适用于编码工具,实际开销与收益缺乏证据,记 1。
可验证性:论文与复现代码链接提供了追踪路径,但 arXiv 编号 2607.20064 对应 2026 年 7 月,超出可核实的范围,且研究代码与 CITATION.cff 文件未随附,记 1;无独立第三方佐证,97.4% 与 18 个百分点均为自述,记 1;加分点:README 明确声明研究结果'还不是编码工具 MVP 的直接基准',事实与推断区分做得较好,记 2。
- 测试文件存在明显代码缺陷(未定义变量、导入不完整),静态审阅下不能认为测试套件可用;请勿据此推断功能正确。
- 核心源码(src/、runtime.mjs、SKILL.md)未在本次证据中出现,所有安全与行为声明均来自 README,使用前请自行审阅生成的钩子与插件文件。
- arXiv 编号与 2026 年 8 月更新日期无法核实,97.4% 与 18 个百分点为自述结果,且作者承认不直接适用于编码工具 MVP。
- 日志会记录提示词与工具结果,可能包含密钥;在本地策略禁止留存转录的环境中不要启用,必要时执行 prolong uninstall --purge。
- 版本仅 0.1.0、无 CHANGELOG、发布者未经验证,适合评估试用而非生产依赖。