开发与工程 latexquartoracademic-writingpeer-reviewreproducible-research

Claude Code 学术工作流模板

为学者打造的 Claude Code 模板,内置多智能体审查、质量门禁和对抗性 QA,适用于 LaTeX/Beamer、Quarto 和 R 的研究工作流。

FollowAgents 评估 · FARS-2.1
不推荐
49/ 100 五分制 2.5 / 5
1 2 3 4 5 6
1信任安全11 / 29 · 1.9/5

证据显示:README 描述了权限模式(Normal/Auto-accept/Bypass)和预批准的 Bash/Edit 模式,但未提供最小权限原则的明确说明;用户确认机制存在(需批准计划、显式 /commit),但未说明所有敏感操作;数据流透明度部分(如 /verify-claims 的 forked verifier)有描述,但未完整说明数据流向;敏感数据处理(如 /disclosure-check)有提及,但未深入;依赖安全未提及;外部影响(如 GitHub Pages 部署)有描述,但未说明权限范围;回滚机制未提及;来源归属(作者、许可证)有,但发布者未验证。扣分原因:缺乏最小权限原则的明确证据,数据流和敏感数据处理描述不完整,依赖安全未提及,回滚机制缺失。

2可靠稳定6 / 14 · 2.1/5

证据显示:README 和 CHANGELOG 存在,但未提供自洽性测试;依赖可用性未提及;失败消息(如 validate-setup.sh 报告缺失工具)有描述,但未提供错误处理细节。扣分原因:自洽性缺乏测试证据,依赖可用性未提及,失败消息描述不完整。

3适用触发12 / 18 · 3.3/5

证据显示:README 明确面向学术用户(LaTeX/Beamer + R),并列出多种场景(slides、papers、data analysis);能力边界有描述(如 /review-paper --peer 的适用范围);触发精度(如 /commit 的显式触发)有说明;环境适配(如 XeLaTeX、Quarto 要求)有说明。扣分原因:能力边界和触发精度描述较充分,但环境适配未提供详细配置。

4规范维护10 / 18 · 2.8/5

证据显示:信息架构清晰(README、CHANGELOG、CONTRIBUTING);安装说明详细(Quick Start、validate-setup.sh);命名稳定性未明确;示例和 FAQ 有(HelloWorld demos);已知限制未明确;许可证为 MIT;版本变更日志存在;维护责任未明确。扣分原因:命名稳定性、已知限制、维护责任未明确。

5有效结果7 / 13 · 2.7/5

证据显示:输出可用性(如 PDF、HTML 输出)有描述;边际价值(如多代理审查、对抗性 QA)有说明;成本效益(如模型路由、成本监控)有提及,但未提供具体数据。扣分原因:成本效益缺乏具体数据支持。

6证据核验3 / 8 · 1.9/5

证据显示:声明可追溯性(如 /verify-claims)有描述,但未提供验证结果;跨源佐证(如引用 Anthropic 文档)有,但未提供独立验证;事实与推断分离(如 framing honesty)有提及,但未系统化。扣分原因:缺乏验证结果和独立佐证。

证据充分度: 评估于 2026年8月9日 审查版本 be53c12f2359
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
使用前请注意
  • 发布者身份未验证,需谨慎对待来源。
  • 依赖安全未提及,需检查依赖漏洞。
  • 回滚机制缺失,需注意操作可逆性。
  • 敏感数据处理描述不完整,需审查数据流。
  • 成本效益缺乏数据,需实际测试。
评估证据 [1][2][3][4]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

这是一个可直接复刻的 Claude Code 配置模板,专为使用 LaTeX/Beamer、Quarto 和 R 进行学术工作的研究者设计。它提供了一套完整的承包商模式工作流:用户描述目标,Claude 规划方案、调用专业代理执行、修复问题、验证质量并呈现结果。包含 18 个专业代理(如 proofreader、slide-auditor、pedagogy-reviewer、r-reviewer、domain-reviewer 等)、52 个技能(如 /create-lecture、/review-paper、/data-analysis、/qa-quarto 等)、32 条规则和 7 个钩子,实现了目标优先、门禁强制的工作方式。该模板支持多代理审查、对抗性 QA(批评者-修复者循环)、质量评分(0-100,提交门槛 80 分)、上下文持久化(MEMORY.md、会话日志)和验证纪律(/verify-claims、/audit-reproducibility、/humanize)。它源自 Emory 大学经济学博士课程,支持经济学和政治学等领域的预配置,并可通过知识库和领域审查员扩展到其他学科。

该仓库通过 Claude Code 实现自动化学术工作流。用户通过 CLI 启动 Claude,提供一个起始提示,Claude 读取 .claude/ 目录下的配置文件(CLAUDE.md、规则、技能、代理),进入计划模式,然后执行技能(如 /create-lecture)来生成幻灯片、论文、数据分析或复制包。它运行 18 个专业代理,每个代理负责一项审查任务(例如 proofreader 检查语法,slide-auditor 检查视觉布局,r-reviewer 检查 R 代码质量),通过编排运行时(orchestrator-protocol)进行扇出-汇总-判断循环,直至没有新问题。质量门禁(80/90/95 分)由 /commit 技能和预提交钩子强制执行。对抗性 QA(/qa-quarto)让批评者和修复者循环直到没有新发现。技能还包括 /review-paper(带裁判分歧报告的模拟同行评审)、/audit-reproducibility(检查手稿中的数值声明与脚本输出)、/verify-claims(事实核查)和 /humanize(检测 AI 风格)。它支持 R 和 Stata 管道,并包含蒙特卡洛模拟(/simulation-study)和 R 包发布门禁(/r-package-check)。输出包括编译后的 PDF(通过 /compile-latex)、HTML 幻灯片(通过 /deploy)和发布就绪的复制包。

  1. 经济学或政治学教授需要为博士课程制作 LaTeX/Beamer 幻灯片,可使用 /create-lecture 技能,该技能会规划结构、生成内容,并通过 slide-excellence 进行多代理审查。
  2. 研究生正在撰写研究论文,可使用 /lit-review 查找文献,使用 /review-paper --peer 运行模拟同行评审,并使用 /verify-claims 在提交前验证所有引用。
  3. 应用计量经济学家进行数据分析,使用 /data-analysis 运行端到端 R 管道,生成出版级输出,并通过 /audit-reproducibility 验证数值声明。
  4. 研究员准备复制包,使用 /replication-package 组装一个符合 AEA 标准的数据集、环境快照(/capture-environment)和声明溯源护照。
  5. 助理教授向期刊提交论文,使用 7-pass-review 进行对抗性审查,并使用 /humanize 检测 AI 风格痕迹,然后再进行投稿。
  6. 研究员设计蒙特卡洛研究,使用 /simulation-study 创建参数化 DGP、估计器网格和蒙特卡洛 SE,并由 sim-reviewer 进行审查。

这个 Agent 有哪些优点和局限?

优点
  • 内置 18 个专业代理,每个代理针对一个特定的审查维度(如 proofreader、slide-auditor、r-reviewer),比通用审查更深入。
  • 通过预言钩子和预提交钩子强制执行质量门禁,确保即使绕过技能,审查也不会被跳过。
  • 对抗性 QA(批评者-修复者循环)和模拟同行评审(带裁判分歧报告的 --variance N)可发现单遍审查遗漏的错误。
  • 包含验证纪律层(/verify-claims、/audit-reproducibility),可防止虚构引用和数值不一致。
局限
  • 平台特定于 Claude Code,要求用户拥有 Claude 订阅或 API 访问权限,并依赖 Anthropic 模型。
  • 学习曲线陡峭:超过 50 个技能和 30 条规则需要时间熟悉;新用户可能被配置压倒。
  • 需要 XeLaTeX、Quarto、R 和 Python 等外部依赖,对于仅处理文本的用户可能显得繁重。
  • 文档庞大(指南、CHANGELOG、生态),必须花费时间阅读才能有效使用。

如何安装或部署这个 Agent?

  1. 在 GitHub 上 Fork 仓库 pedrohcgs/claude-code-my-workflow。2. 克隆你的 fork:git clone https://github.com/YOUR_USERNAME/claude-code-my-workflow.git my-project && cd my-project。3. 运行 ./scripts/validate-setup.sh 检查所需工具(Claude Code、git、Python 3;XeLaTeX、Quarto、R 可选)。4. 运行 ./scripts/install-hooks.sh 安装预提交钩子,用于质量门禁和 git 防护。

如何使用这个 Agent?

  1. 在项目目录中启动 Claude Code:claude。2. 粘贴指南中的起始提示(https://psantanna.com/claude-code-my-workflow/workflow-guide.html),填写你的项目名称和描述。3. Claude 读取配置,进入计划模式,并规划方法。4. 批准计划并调用一个技能,例如 /create-lecture、/data-analysis 或 /review-paper。5. 技能运行实施-验证-审查-修复-重新验证-评分循环,返回摘要。6. 使用 /commit 提交更改,预提交钩子运行质量门禁。对于完全自主运行,可使用 --permission-mode acceptEdits 或 Bypass 模式。

这个 Agent 与同类方案有什么区别?

该模板从由 Pedro Sant'Anna 开发的 Emory 大学课程中提取,其生态包括类似工具:clo-author(用于论文导向的研究工作流)、claudeblattman(针对非技术型学者)、MixtapeTools(关于演示修辞)、autoresearch(自主研究)、ClaudeCodeTools(顺序审查协议)。

常见问题

这个模板是否只适用于经济学?
虽然预配置了经济学和政治学领域,但它被设计为领域无关的。你可以通过填写知识库模板、定制领域审查员以及调整期刊档案来适应其他领域。
它的运行成本是多少?
成本取决于你的 Claude 订阅计划或 API 使用量。模板建议使用模型路由(70/20/10 的 Haiku/Sonnet/Opus 比例)以平衡成本。该工作流鼓励成本监控。
它是否在每次提交时自动运行?
是的,安装 hooks 后,会在每次提交时运行表面同步和质量门禁。你可以在单个提交中通过 SKIP_QUALITY_GATE=1 或 --no-verify 选择退出。
如果我没有 LaTeX 或 Quarto,可以使用它吗?
可以。代理、规则、技能和编排模式适用于任何文本或代码工件。你可以跳过 HelloWorld 演示,直接使用 /data-analysis、/lit-review 等。你只需要 Claude Code 和 git。
它如何处理会话之间的上下文?
MEMORY.md 存储通用的学习成果,personal-memory.md(被 gitignored)存储机器特定的笔记。预压缩钩子保存上下文快照,/compress-session 在强制压缩前将对话提炼为结构化的笔记。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents