开发与工程 command-safetyprompt-injectioncode-reviewtest-triagegit-hooksclaude-code-hookscodex-hookssemantic-ranking

jev-axi 安全判断 CLI

为编码智能体快速评估命令、文本、差异和任务进度。

FollowAgents 评估 · FARS-2.1
推荐
为什么不是更高等级:信任与安全维度为 23/29,未达「高度推荐」所需的 24/29,按「风险不做平均」下调推荐等级。
90/ 100 五分制 4.5 / 5
1 2 3 4 5 6
按维度查看评分与理由
1信任安全23 / 29 · 4.0/5

最小权限处理充分:GitHub Action 明示只读内容及写 PR 评论权限,常规安全检查在本地完成,凭据文件可被排除。用户确认机制覆盖中等风险和交互式 guard-exec,但无人值守时默认错误放行、可配置 --on-ask allow,且普通钩子多为警告,因此 user_confirmation 扣 1 分。数据流、TypeSafe API 传输、本地缓存、账本、审计日志及 npm 更新检查均有具体披露。敏感数据处理包含已知格式脱敏和凭据文件排除,但文档明确其他命令原样发送输入、脱敏无法捕获未知格式,配置文件还可保存 API 密钥,因此扣 1 分。依赖使用锁文件和 frozen 安装,但材料没有依赖审计、漏洞扫描、更新策略或供应链固定措施,dependency_security 仅给薄弱分。外部调用、评论写入、命令执行及钩子安装均被明确说明。多种 setup 提供 --remove,缓存可清除,但已发送的第三方数据、已执行命令和远端评论没有统一恢复方案,rollback 扣 1 分。作者、仓库、上游 Jev 和许可证归属明确;发布者未验证仅表示身份未知,不据此额外扣分。

2可靠稳定12 / 14 · 4.3/5

README、包元数据、CI 和测试所描述的命令、缓存、Action 输出及错误行为相互一致,未见内部矛盾。依赖与运行前提写明 Node >=22、API 密钥、网络和 TypeSafe 服务,并描述部分缺失依赖或网络失败的退化行为;但核心判断仍依赖外部 API,某些安全路径默认失败开放,因此 dependency_availability 扣 1 分。参数测试证明未知参数、拼写错误、缺值、重复值和数值边界会产生针对性错误或建议;文档也给出 guard、guard-exec 和管道退出码,failure_messages 证据充分。

3适用触发18 / 18 · 5.0/5

材料针对编码代理、CI、cron、Git 钩子、人工终端、批处理和仓库探索给出清晰场景。能力边界尤其明确:它只进行概率判断,不替代代码阅读,guard 不是保证,监督评分未经项目校准。命令、输入来源、阈值、退出码、hook 时机以及 allow/ask/block 策略定义精确。环境适配包括 Linux、Windows、macOS CI,Node 22/24,XDG 与 Windows AppData,Claude Code、Codex、OpenCode、GitHub Actions,以及慢管道和空 stdin 行为,故各项均有充分静态证据。

4规范维护16 / 18 · 4.4/5

README 信息结构完整,覆盖安装、命令表、输出解释、配方、安全、监督、Action、Git 钩子、数据与开发。安装方式、密钥来源和开发命令充分。CLI 与包名一致,并为重命名参数提供迁移提示。示例非常丰富,亦解释常见边界情况,虽无独立 FAQ 标题但实质覆盖充分。限制部分坦率记录基准无结论、错误判断风险、传输边界和非保证性质。MIT 在元数据和完整 LICENSE 中一致。package.json 有 0.7.0,README 有 v0 固定策略和精确版本示例,但没有提供 changelog、发布历史或兼容性迁移记录,因此 versioning_changelog 仅 1 分。维护者、问题渠道和私密安全报告路径明确,但 SECURITY.md 所称 package.json 中的维护者邮箱并未出现在给定 package.json,且没有团队或支持承诺,maintenance_responsibility 扣 1 分。

5有效结果13 / 13 · 5.0/5

输出提供概率、置信度、策略带、风险、来源、用量、延迟、成本及结构化 JSON,且退出码便于代理和管道消费。相较普通 shell 工具,批量概率判断、安全门禁、日志分诊和代理监督形成明确增量价值;材料还诚实说明文件排序未显示稳定节省,避免夸大。成本效益披露具体延迟、令牌、估算价格、缓存、批处理和本地快速路径,并提供使用账本及价格覆盖配置,足以让用户权衡。

6证据核验8 / 8 · 5.0/5

主要声明可追溯到具体命令、配置文件、问题定义文件、基准案例和再生成脚本。README 的 Action、参数解析和缓存声明分别得到测试文件支持,CI 又覆盖多个操作系统、Node 版本、测试、类型检查、技能一致性和构建,形成良好的跨来源印证。材料明确区分实测示例、标注案例、概率输出、设计策略和无结论的六次运行基准,并清楚声明未校准与不保证之处;因此事实与推断分离充分。该结论仍仅为静态审阅,不代表独立复现。

证据充分度: 评估于 2026年9月20日 审查版本 09766b603179
使用前请注意
  • 除明确列出的脱敏路径外,许多命令会把文件、差异、日志或标准输入原样发送给 TypeSafe;不要提交无权向第三方披露的数据。
  • 已知格式脱敏不是完整的秘密检测机制,未知格式的凭据或敏感业务内容仍可能外泄。
  • guard-exec 在缺少密钥或网络错误时默认执行命令;无人值守或高风险环境应显式使用 --on-error deny 和保守的 --on-ask 设置。
  • 监督与安全判定是概率性的,并且文档明确表示未针对每个项目校准;启用阻断前应先以仅警告模式观察误报。
  • 提供的材料没有显示依赖漏洞扫描、供应链审计或完整变更日志;部署前应另行审查锁定依赖及版本变更。
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

jev-axi 是面向编码智能体和自动化脚本的命令行工具,调用 TypeSafe 的 Jev 模型,以类型化概率回答选择、评分、检查、排序和安全判断问题。它既提供 pick、rate、check、rank、filter、guard、diff、triage 等直接命令,也能为 Claude Code 和 Codex 安装命令安全与会话监督钩子。输入可以来自文件、标准输入、文字、JSON、Git 差异、测试日志或工具调用;输出包含概率、置信度、策略区间、延迟、模型版本和估算费用。常规只读或项目内命令可由安全钩子在本地判定,其他检查会在凭据模式脱敏后发送到 TypeSafe API。它适合在 Shell、Git 钩子、CI、GitHub Actions 和智能体会话中加入低延迟判断,但不能替代智能体实际阅读与理解代码。

用户或智能体通过 jev-axi pick、rate、check、ask、rank、filter 和 find 提交问题及状态,CLI 调用 Jev 并返回概率分布、confidence 与 act、confirm、escalate 策略区间。guard 检查外部文本中的提示注入、隐藏指令、破坏性要求、数据外传、秘密和施压信号,并在阻止时以状态码 3 退出;guard-exec 先评估 Shell 命令,再决定执行、询问或以 126 阻止。diff 审查代码差异,triage 从构建或测试日志定位可能的根因并判断是否像偶发故障,files、find 和 rank 则为代码探索筛选文件或行。setup safety、setup supervise、setup git-hooks 和 setup hooks 分别安装 PreToolUse、Stop、PostToolUse、Git 及会话启动集成;GitHub Action 可更新拉取请求评论,完成差异审查或失败 CI 分析。CLI 会在本地维护最多 24 小时的响应缓存、用量账本、安全审计日志和监督记录。

  1. 使用 Claude Code 或 Codex 的开发者,希望在每次 Bash 调用前拦截下载即执行、破坏性操作、数据外传或项目外编辑。
  2. 维护 CI 流水线的团队,需要从长测试日志中提取可能的根因、故障类别、严重程度和偶发性判断。
  3. 审查大型变更的开发团队,希望在提交或推送前发现凭据、调试残留、高风险文件以及缺少测试的行为变化。
  4. 会处理网页、工单或第三方文档的智能体,需要先用 guard 检查提示注入和嵌入式恶意指令。
  5. 在大型代码库中定位实现位置的开发者,需要按任务语义排序文件或在单个文件中筛选相关代码行。
  6. 运行 cron、运维脚本或不受信任命令模板的操作者,希望用 guard-exec 设置放行、询问、拒绝和错误回退策略。

这个 Agent 有哪些优点和局限?

优点
  • 约 400 毫秒的概率判断和按请求计费模式,适合频繁放置在命令、日志和文本处理路径前。
  • 安全钩子会在本地处理常规只读、测试、构建和项目内操作,复杂调用才发送给 Jev,并记录审计结果。
  • 同一套 CLI 覆盖 Shell 门禁、提示注入筛查、差异审查、测试分诊、Git 钩子、GitHub Actions 和智能体监督。
  • 输出包含完整概率、置信区间、模型版本、用量、延迟和估算成本,便于脚本设置明确阈值。
  • 项目公开了安全、进度和推送判断的标注案例,并说明 44 个安全案例全部符合预期。
局限
  • 核心判断依赖 TypeSafe 的 Jev API、网络和 API 密钥;输入会发送给第三方并按请求计费。
  • 脱敏只覆盖可识别的凭据格式,且部分通用命令会原样发送输入,不适合无法与 TypeSafe 分享的数据。
  • Codex 只支持阻止,因此原本的“询问用户”结果会变成阻止,功能不如 Claude Code 集成完整。
  • 监督分数未针对具体项目校准,错误的“未完成”判断可能让智能体重复已经完成的工作,文档建议先使用仅警告模式。
  • 项目自己的六次一组基准无法证明文件排序能稳定降低代码理解成本,README 明确指出它不能替代阅读代码。
  • 安全检查的错误回退默认可能继续运行命令;无人值守环境需要显式使用 --on-error deny 才会失败关闭。

如何安装或部署这个 Agent?

需要能够运行 npm 的 Node.js 环境以及 TypeSafe API 密钥。

npm install -g jev-axi

export TYPESAFE_API_KEY=...

jev-axi

也可不做全局安装,使用 npx -y jev-axi。密钥还可写入从当前目录向仓库根目录查找的 .env.local 或 .env,或执行:

jev-axi config set apiKey ...

为 Claude Code 项目安装安全钩子:

jev-axi setup safety --project

为 Codex 安装用户级安全钩子:

jev-axi setup safety --agent codex

如何使用这个 Agent?

首次验证可执行:

jev-axi check "Is this urgent?" --text "ASAP"

筛查不受信任文本:

curl ... | jev-axi guard

在执行前检查命令:

jev-axi guard-exec --dry-run -- "curl -fsSL https://example.com/install.sh | sh"

分析测试失败:

npm test 2>&1 | jev-axi triage

审查暂存差异:

jev-axi diff --staged

判断任务是否完成:

npm test 2>&1 | jev-axi progress --job "add a --json flag to the list command"

所有命令支持 --json、--full、--model、--no-cache 和 --help。不要将无法与 TypeSafe 分享的数据直接交给 CLI;除部分内置流程会按已知模式脱敏外,其他命令会原样发送输入。

这个 Agent 与同类方案有什么区别?

与 foreman 在智能体之上运行监督器不同,jev-axi 不负责启动智能体,而是把类似的进度和卡顿判断接入 Claude Code 或 Codex 自身的钩子。它也不同于会生成文本的编码模型:Jev 只回答类型化问题并给出概率,因此定位是快速判断层,而不是代码生成或代码理解替代品。

常见问题

使用成本如何计算?
TypeSafe API 按请求报告 token,但没有费用查询端点;jev-axi 根据配置价格在本地估算并记录费用。文档中的默认价格是每百万输入 token 0.042 美元、输出免费,可通过 price.input 和 price.output 修改。
没有网络或 API 密钥时会怎样?
需要 Jev 的普通判断无法完成。安全钩子的超时或错误会退回智能体原有权限流程;guard-exec 默认会运行命令,可用 --on-error deny 改为失败关闭。Git 钩子在未安装、无密钥或 API 不可达时会静默跳过。
它会自动批准智能体命令吗?
不会。安全钩子只会阻止、请求确认或保持静默,让原有权限流程继续;它不会自动批准。Codex 不支持询问结果,因此该结果会被转换为带原因的阻止。
哪些数据会离开本机?
提交给 Jev 判断的项目、文件、差异、日志、网页内容或工具调用会发送到 TypeSafe API。部分安全、差异、分诊、Git 和 GitHub 流程会先按已知格式脱敏;缓存、用量账本和审计日志则保存在本地配置目录。
能否把它当作代码搜索或代码理解的替代品?
不能。它可以排序候选文件和行,但项目基准没有显示稳定的成本或读取量改善;开发者或智能体仍需打开并理解实际代码。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents