开发与工程 coding-agenttoken-efficiencyopenai-compatibleclinimcontext-compactionself-hostedswe-bench

3code 省 token 编码代理

把 token 预算当作一等约束:同样 token 量做 5 倍工作,免费额度也能真正干活。

FollowAgents 评估 · FARS-2.1
不推荐
40/ 100 五分制 2.0 / 5
1 2 3 4 5 6
按维度查看评分与理由
1信任安全10 / 29 · 1.7/5

README 提到 loop guard、私有模式(-p 仅走零训练供应商)、无遥测、会话本地保存,说明作者对权限与数据流有意识;但仓库中没有任何沙箱实现、权限清单、确认提示或数据流文档可供核对,安装脚本通过 curl | sh 从远程域名执行且未在仓库内提供可审计内容,依赖仅以名称从公共 registry 解析、无锁定文件或哈希校验。因此这些项只能算“有提及但无证据支撑”,各给 1 分;未发现恶意、窃取凭据或隐蔽外传等红线行为,故不判 blocked。

2可靠稳定5 / 14 · 1.8/5

CI 工作流注释显示作者已修复“测试失败仍报绿”的退出码问题,并加入看门狗与超时,属于对失败可见性的实际投入;但仓库内没有错误信息样例、重试/降级策略或依赖可用性验证,README 的“40 个已验证组合”“1.6MB 单文件”等说法无对应文件佐证。故三项均为 1 分。

3适用触发9 / 18 · 2.5/5

README 明确列出 macOS/Linux/Windows/Termux 安装路径、NVIDIA 免费层快速上手、任意 OpenAI 兼容端点、以及作为 Nim 库嵌入的用法,受众与场景覆盖较清楚,给 2 分;但能力边界(沙箱范围、工具权限、自治编辑的停止条件)只有一句 loop guard,触发精度(何时自动执行、何时询问)无说明,环境适配虽有平台列表但缺少版本/前置条件细节,各给 1 分。

4规范维护9 / 18 · 2.5/5

MIT 许可证文件完整且与 README 一致,给 3 分;README 结构清晰、安装说明覆盖三平台并给出 Windows 手动安装替代方案,各给 2 分;但无 CHANGELOG、无版本号策略说明、无 FAQ、无已知限制章节,命名稳定性(CLI 参数、.3log 格式、库 API)无兼容性承诺,维护责任仅靠个人商标与博客,均给 1 分。

5有效结果4 / 13 · 1.5/5

README 给出 SWE-bench 10 任务子集的 token 对比表,声称比 pi 少 9% token 且多解一题,并链接博客与详情页,属于可用的价值主张;但样本仅 10 题、由作者自测、无第三方复现,输出可用性(生成代码质量、可回滚性)无证据,成本收益依赖未经验证的基准,故三项均给 1 分。

6证据核验3 / 8 · 1.9/5

基准数据指向外部站点与博客,仓库内没有原始结果、脚本或方法说明,无法在源码层面追溯;README 的“5× 更省”“75% 更少 token”等营销表述与表格中 88.3% 的数字并存,事实与推断未明确分离;除 README 与 CI 注释外无交叉来源。三项各 1 分。

证据充分度: 评估于 2026年9月16日 审查版本 1fd8b85377d0
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
使用前请注意
  • 安装方式为 curl | sh 与 irm | iex,从远程域名拉取并直接执行,仓库内没有可审计的安装脚本;建议先下载并审阅脚本再执行。
  • 依赖仅按名称从公共 Nim 包注册表解析,无锁定文件或哈希校验,构建可复现性与供应链安全无法从源码确认。
  • README 的 token 节省与 SWE-bench 结果均为作者自测的 10 题子集,仓库内无原始数据或复现脚本,不应作为采购决策的唯一依据。
  • 沙箱、权限边界、自治编辑停止条件、数据流与敏感信息处理均只有 README 一句话描述,缺少实现或文档佐证。
  • 发布者身份未经 FollowAgents 企业注册表验证,维护责任与更新路径仅依赖个人域名与博客,长期维护存在单点风险。
评估证据 [1][2][3][4]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

3code 是一个把成本作为首要设计目标的命令行编码代理,主张在相同 token 预算下完成更多工作,从而让订阅更耐用、免费额度模型也能投入实际使用。它兼容任何 OpenAI 兼容接口,可用免费额度、包月套餐、订阅账号或本地服务作为后端。安装后是单个 1.6 MB 可执行文件,无运行时依赖,跨 Linux、macOS、Windows 和 Termux(Android arm64)运行,无守护进程、无 Web UI、无遥测。实现上通过 chunked mode 持续抽取相关上下文并丢弃过期信息、激进缓存、supersede-aware 上下文压缩,以及在 plan/execute 阶段之间自我清空的执行流程来控制上下文体积。除 CLI 外,它还是一个 Nim 库,可把同一套代理循环嵌入自己的程序,用返回值和回调替代终端交互。

3code 作为 CLI 代理在项目目录中运行:它读取你的代码库文件、调用工具修改文件并执行命令,依据模型返回决定下一步,最终产出代码变更与可运行的结果。所有模型调用都走 OpenAI 兼容端点,可接入免费额度、包月编码套餐、订阅登录或本地服务器。为压低成本,它在运行中持续做 chunked mode 上下文抽取与丢弃、缓存复用、supersede-aware 压缩(后续写入会让过期读取失效),并在 plan/execute 阶段之间自我清空上下文。CLI 提供 3code 启动、:provider add 追加供应商、-p 私有模式(只允许零训练供应商,token 进度条变品红)、loop guard 检测失控的自主编辑并在阈值处中止、会话以人类可读的 .3log 保存并可恢复、内置原生网络搜索。作为 Nim 库时,同一套代理循环、工具调用、沙箱与会话持久化以返回值和回调形式暴露,供你自行接前端、聊天机器人、CI runner 或 IDE 插件。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents