MateClaw
自托管的"第二大脑"数字员工平台:多模型故障转移、LLM Wiki 知识消化、技能/记忆/多渠道接入,用 Spring Boot 一体化交付,让 IT 部门敢签字。
README声称Tool Guard(RBAC+审批+路径保护)、审批门、审计日志、AES-GCM加密、HMAC签名、默认幂等警告等,安全叙事相当完整;但评审样本仅含README、LICENSE与两个测试文件,未见任何安全实现代码,最小权限、敏感数据加密、依赖安全均只是自我声明,故保守扣分。审批门与外部副作用(发布、Goal幂等警告)在文档层面描述充分,给予中分。回滚有技能快照/恢复点、运行时停用的说明,仍属声明。来源归属仅见LICENSE版权行,无代码级出处说明。
README内部自洽:版本号、日期、模块结构一致,故障转移、健康追踪、per-channel错误隔离、SSE重连ID均有明确机制描述;但均为声明,无代码佐证,错误消息质量只有间接证据('Chinese error hints'),故2分。
受众(团队/Java企业)与场景(多渠道、桌面、Web、插件)描述清晰;能力边界在多处明示(幂等不保证、外部副作用需评审、DSH需安装验证);环境适配(H2/Postgres/MySQL/Kingbase、JRE21捆绑)充分。触发精度(六种trigger模式、递归守卫、fail-closed)有描述但无实现证据,扣分。
Apache-2.0全文完整且与README徽章一致,得满分。安装说明含Maven/npm/Docker/桌面三路径与默认凭据。项目结构、命名、版本路线图(1.8→2.0→2.1→2.2带日期)清晰。但FAQ/已知局限缺乏独立章节,维护者信息、贡献与更新路径未给出,故扣分。
输出可用性(文档生成工具、引用抽屉、内容日历、运行时控制台)描述具体;边际价值定位(面向团队的Spring Boot运行时,对比竞品表)明确;成本模型($0、自托管)清楚。但所有功效均未经执行验证,保守给2。
README断言密集(性能提升~78%、功能清单、竞品对比)但仅链接外部文档,仓库内样本无对应实现代码可追溯,交叉印证只能靠两个测试文件(仅覆盖UI过滤逻辑)。事实与推断基本可分(README为声明),给2;声明可追溯性与多源印证扣分。
- 本次评审仅基于README、LICENSE与两个小型测试文件,所有安全与可靠性声明(RBAC、审批、加密、故障转移)均未经代码核实,属低置信度静态评估。
- 默认登录凭据 admin/admin123 若出现在生产Docker部署中,必须在首次启动后立即修改。
- 面向外部的发布/发送/支付类操作,README自述不保证幂等,使用方需自行配置幂等或人工审批。
- 发布者身份未经注册表验证,供应链与维护持续性风险需自行评估。
这个 Agent 能做什么,适合哪些场景?
MateClaw(github.com/mateaix/mateclaw)是一个基于 Spring Boot 3.5 与 Spring AI Alibaba 的可插拔 Agent 运行时,定位为团队可用的"数字员工"平台。它提供原生 StateGraph 运行时(ReAct、Plan-and-Execute、持久化 Goals、Team Runs)和受管的外部 DeepSeek Harness(DSH)JSON-RPC 运行时,两条路径共享同一套会话、工作区边界、Tool Guard、事件投影与生命周期治理。知识侧通过 LLM Wiki 把上传的 PDF、Markdown 等原料消化为带 [[链接]] 与可追溯引用的结构化页面,并配备 AGENTS.md/SOUL.md/MEMORY.md 工作区记忆与 Dream 整理工作流。能力扩展支持 SKILL.md 技能包、MCP(stdio/SSE/HTTP,按员工绑定)以及把 Claude Code、Codex 等编码代理接入的 ACP 桥。产品一次部署覆盖五个入口:Web 管理台、Electron 桌面端(内置 JRE 21)、可嵌入 Webchat 小部件、钉钉/飞书/企业微信/Telegram 等 8 种 IM 渠道,以及 Java 插件 SDK。企业特性包括 RBAC + JWT、审批流、审计日志、运行时控制台与多供应商故障转移。
用户在 Web 控制台创建数字员工(角色/目标/背景/头像),为其绑定模型、技能、MCP 工具与知识库;员工回合由 AgentRuntimeProvider 契约分派到原生 StateGraph(ReAct、Plan-and-Execute、Goal 检查表、Team Run 任务 DAG)或 DSH 子进程,事件以标准化流(思考/工具调用/答案/用量)回传。请求失败时按优先级链切换到下一个健康供应商(DashScope、OpenAI、Anthropic、Gemini、DeepSeek、Kimi、Ollama 等),健康跟踪器将故障供应商冷却。上传文档经 LLM Wiki 生成互链页面与引用;Workflow 引擎以七种步骤模式(sequential/fan_out/collect/conditional/await_approval/dispatch_channel/write_memory)编排多员工流程,Triggers 支持 cron、webhook、channel_message 等六种触发模式。多模态输出涵盖 TTS/STT、图像、音乐、视频、3D,且 DocxRenderTool/XlsxRenderTool/PptxRenderTool/PdfRenderTool 在 JVM 内直接渲染 Office/PDF 文件。长任务通过持久化 Goal 检查点在重启后恢复继续。
- 需要内网自托管、可审计、可审批的 Java 技术栈团队,想给部门部署 IT 能签字的多用户 AI 员工平台
- 客服/产品团队想把钉钉、飞书、企业微信、Telegram 等渠道接到同一个有记忆、有知识的助手,渠道间共享大脑
- 研究/内容运营人员用 Content Studio 从一句话生成公众号图文或小红书 3:4 卡片笔记,并经去 AI 味打分与合规扫描后进草稿箱
- 需要数小时长任务(批量产出文件、持续研究)的用户,依赖持久化 Goal 在后端重启后从检查点续跑
- 想用 Claude Code / Codex 等编码代理作为"员工"纳入统一治理(权限、审批、记忆)的工程团队
- 运营人员通过 Workflow + Cron/Webhook 触发器把多员工协作流程定时或事件驱动地自动化
这个 Agent 有哪些优点和局限?
- 多供应商故障转移链 + 健康跟踪 + 冷却窗口,单一供应商宕机不会导致整站不可用,只需在设置里拖拽优先级
- 真正的可插拔 Agent 运行时契约(AgentRuntimeProvider):原生 StateGraph 与外部 DSH 运行时共享会话、审批、工具与审计面,员工不与单一推理循环绑定
- 五个交付面(Web 管理台、桌面端、Webchat 小部件、8 种 IM 渠道、Java 插件 SDK)共享同一大脑与记忆
- 企业治理完整:RBAC + 审批门 + 审计日志 + 分布式 Cron 锁 + 运行时控制台强制回收,敏感操作可暂停人工复核
- LLM Wiki 提供页面级互链与可追溯引用抽屉,可核验答案对应的源文本块
- 技术栈绑定 Java 21 + Spring Boot 3.5 + Vue 3,非 JVM 团队的二次开发和运维成本较高
- 社区规模 README 自述小于 OpenClaw、Hermes Agent 等竞品,生态与第三方资料相对有限
- 运行时不承诺对外部副作用的恰好一次执行,支付、发送、发布类调用仍需供应商幂等或人工审核
- DSH 运行时需要额外安装、验证并托管 dsh-rpc-agent 子进程,属可选但独立的运维面
- 数据库选型分散(H2 开发、PostgreSQL 16 Docker 默认、MySQL 支持版、Kingbase 选配),多环境迁移需自行验证 Flyway 脚本
如何安装或部署这个 Agent?
源码运行:git clone https://github.com/mateaix/mateclaw.git;后端 cd mateclaw-server && mvn spring-boot:run(http://localhost:18088);前端 cd mateclaw-ui && npm install && npm run dev(http://localhost:5173);默认登录 admin/admin123。Docker:cp .env.example .env && docker compose up -d(http://localhost:18080)。桌面版:从 GitHub Releases 下载 Electron 安装包,内置 JRE 21,无需单独安装 Java。需要 Java 21+。
如何使用这个 Agent?
启动后用 admin/admin123 登录 Web 控制台;在 Settings → Models 拖拽配置模型供应商优先级并填入各家 API Key;创建数字员工(六个内置模板:通用助手、产品助手、研究分析师、客服、数据分析师、代码评审)并绑定技能、MCP 工具与知识库;在 Settings → System → Runtime 查看每个员工的运行状态、令牌用量并可一键强制回收卡住的运行;在渠道页配置钉钉/飞书/Telegram 等 IM,IM 内可用 /new、/clear、/status、/stop、/model、/help 魔法命令;个人访问令牌(PAT)可用于脚本和 CI 无头调用。
这个 Agent 与同类方案有什么区别?
README 将其与 OpenClaw(TypeScript、配置文件优先、面向单人)、Hermes Agent(Python、单用户 CLI)、Claude Code(专有、仅 Anthropic)和 Cursor(IDE)对比:MateClaw 的差异点是面向团队的多用户 RBAC/审批/审计、LLM Wiki 引用式知识消化、以及 Java/Spring Boot 技术栈与五入口交付;OpenClaw 和 Hermes Agent 更适合单用户笔记本场景。