效率与协作 desktop-automationcomputer-usemacosmcpollamaopenclawsafari-automation

TuriX

让多模型 AI 通过桌面 GUI 完成浏览器与办公软件操作。

FollowAgents 评估 · FARS-2.1
不推荐
34/ 100 五分制 1.7 / 5
1 2 3 4 5 6
按维度查看评分与理由
1信任安全5 / 29 · 0.9/5

证据显示:README声明'我们从不收集数据',但未提供实现细节;要求用户授予辅助功能和Safari自动化权限,但未说明最小权限原则;有技能示例要求登录前询问用户,但未系统化;依赖列表包含posthog和oss2等可能涉及遥测或云存储的库,但未说明数据流向;未提供回滚机制;许可证和版权归属明确。扣分原因:数据流不透明,敏感数据处理未说明,依赖安全未审计,外部影响未充分说明。

2可靠稳定3 / 14 · 1.1/5

证据显示:README提供了配置示例和运行步骤,但未提供错误处理或失败消息的文档;依赖列表完整,但未说明版本兼容性;未提供故障排除指南。扣分原因:失败消息缺失,自一致性部分满足。

3适用触发8 / 18 · 2.2/5

证据显示:README面向macOS用户,提供了Windows和Linux分支说明;说明了能力边界(如'如果人类能点击,TuriX也能'),但未明确限制;提供了任务配置示例,但未说明触发精度;环境适配仅限macOS 15+,其他平台需切换分支。扣分原因:能力边界和触发精度描述不足。

4规范维护9 / 18 · 2.5/5

证据显示:README结构清晰,包含目录、快速开始、配置、贡献指南;提供了安装步骤和依赖列表;许可证为MIT,版权归属明确;有版本更新记录(新闻部分),但未提供正式变更日志;维护责任未明确。扣分原因:命名稳定性未说明,已知限制未明确列出。

5有效结果6 / 13 · 2.3/5

证据显示:README展示了多个演示GIF,声称高成功率,但未提供可复现的测试数据;提供了配置自定义模型的灵活性,但未说明成本效益;输出可用性未详细说明。扣分原因:输出可用性证据不足,成本效益未量化。

6证据核验3 / 8 · 1.9/5

证据显示:README声称达到OSWorld 64.2%和自建Mac基准80%,但未提供详细报告链接(仅提及技术报告);未提供第三方验证;事实与推断混合。扣分原因:声明缺乏可追溯性,交叉验证不足。

证据充分度: 评估于 2026年8月9日 审查版本 fe00c49ff14e
上游仓库在本次评估后已有新提交;当前评分仍对应所示审查版本,可能尚未覆盖最新改动。
源码中未见的安全控制:数据流向说明、敏感信息处理、依赖安全审查、回滚或恢复路径
使用前请注意
  • 依赖中包含posthog和oss2,可能涉及遥测或云存储,需审查数据流向。
  • 要求授予辅助功能和Safari自动化权限,权限范围较大,需谨慎评估。
  • README声称'从不收集数据',但未提供实现证据,需验证。
  • 性能声明(如OSWorld 64.2%)缺乏可复现的测试细节。
评估证据 [1][2][3]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

TuriX 是面向桌面自动化的计算机使用代理,主分支针对 macOS 运行,并要求 macOS 15+。用户在 examples/config.json 中定义任务以及 brain、actor、memory 模型;启用规划时还需配置 planner 模型。代理以屏幕上的 GUI 操作为执行边界,不依赖应用专属 API,可用于 Safari、办公软件和内部工具等人可点击操作的界面。它提供 MCP 接入,并展示了 Claude for Desktop 调用 TuriX 完成检索、写入 Pages 文档和发送给联系人的流程。项目也支持以 Markdown 技能文件辅助规划,并可通过 agent_id 与 memory.jsonl 恢复中断任务。

运行 python examples/main.py 时,TuriX 读取 examples/config.json 中的 agent.task 和模型角色配置,分别使用 brain_llm、actor_llm、memory_llm,以及可选的 planner_llm。模型端点可配置为 turix 提供方,或指向本地 Ollama 服务;要接入 build_llm 尚未定义的模型,需在 examples/main.py 中添加相应提供方实现,例如 ChatOpenAI、ChatGoogleGenerativeAI、ChatAnthropic 或 ChatOllama。启用 agent.use_plan 与 agent.use_skills 后,规划器先根据技能的 name 和 description 选择 Markdown 技能,brain 再使用完整技能内容制定步骤目标。执行时它通过桌面界面进行操作;恢复模式会从 src/agent/temp_files/<agent_id>/memory.jsonl 使用已有记忆继续同一任务。

  1. 需要在 macOS 上通过 Safari 完成网页流程的个人用户,例如检索信息后继续操作网页界面。
  2. 需要把 Numbers 中的数据整理为图表并放入 PowerPoint、随后回复联系人的办公用户。
  3. 需要搜索商品信息、创建 Pages 文档并发送给联系人的 macOS 用户。
  4. 希望由 Claude for Desktop 经 MCP 调用桌面执行器,将研究结果写入 Pages 并分享给联系人的团队成员。
  5. 想使用本地 Ollama 视觉模型执行桌面任务、并愿意为各模型角色配置本地服务地址的开发者。

这个 Agent 有哪些优点和局限?

优点
  • 将 brain、actor、memory 与可选 planner 分成独立模型角色,可为不同职责配置不同模型和端点。
  • 以桌面 GUI 为操作面,不要求目标应用提供专属 API,覆盖人类可点击的界面流程。
  • 提供 MCP 路径,并明确展示 Claude for Desktop 调用 TuriX 的桌面工作流。
  • Markdown 技能通过前置信息供规划器筛选,再把完整说明交给 brain,可为重复网页流程加入可读的操作规范。
  • 支持基于 agent_id 和 memory.jsonl 的中断任务恢复。
局限
  • 主分支文档明确为 macOS 15+ 配置,Windows 与 Linux 需要切换到各自分支。
  • 首次运行需要授予辅助功能及 Safari 自动化权限,权限配置失败会阻断桌面控制。
  • 主分支需要同时配置 brain、actor 和 memory 模型;启用规划还要配置 planner,模型与端点管理成本较高。
  • 使用 build_llm 未定义的模型需要修改 examples/main.py 并实现提供方适配。
  • 恢复功能依赖已有的 src/agent/temp_files/<agent_id>/memory.jsonl,并要求使用相同 task 与 agent_id。

如何安装或部署这个 Agent?

在 macOS 15+ 上执行:git clone https://github.com/TurixAI/TuriX-CUA.git && cd TuriX-CUA;随后执行 conda create -n turix_env python=3.12、conda activate turix_env、pip install -r requirements.txt。到“系统设置 > 隐私与安全性 > 辅助功能”授予终端和所用 IDE 权限;如仍无法操作,可加入 /usr/bin/python3。Safari 中需启用开发者功能、Allow Remote Automation 和 Allow JavaScript from Apple Events,并在出现的系统对话框中允许请求。

如何使用这个 Agent?

编辑 examples/config.json,将 agent.task 设为具体任务,并配置 brain_llm、actor_llm、memory_llm;若 agent.use_plan 为 true,也配置 planner_llm。使用远程模型时,为每个角色填写 provider、model_name、api_key 和 base_url;使用 Ollama 时,将各角色设为 provider: ollama,并填写 model_name 和 http://localhost:11434。若要使用技能,设置 agent.use_plan: true、agent.use_skills: true,并指定 skills_dir。完成配置后运行 python examples/main.py。要恢复任务,保持 task 不变,设置 agent.resume: true 和稳定的 agent.agent_id,且此前必须存在对应的 memory.jsonl。

这个 Agent 与同类方案有什么区别?

README 将默认模型与 UI-TARS 等此前开源代理比较,称其在 Mac 上的成功率和速度更高;项目同时报告 OSWorld 全量基准 64.2%(229.88/358)、排行榜第 3。该比较未提供 UI-TARS 的具体分数或相同测试配置。

常见问题

是否只能使用 TuriX 的模型?
不是。配置可指向自定义端点或本地 Ollama;但未被 build_llm 定义的模型需要在 examples/main.py 中加入提供方实现。
运行前必须授予哪些权限?
macOS 需要辅助功能权限;使用 Safari 时还需要开启远程自动化和来自 Apple Events 的 JavaScript,并接受系统弹窗。
能否从中断处继续任务?
可以。设置 resume: true 并复用同一 agent_id 和 task;对应目录必须已有 memory.jsonl。
支持 Windows 或 Linux 吗?
README 指向 multi-agent-windows 和 multi-agent-linux 分支提供相应支持;当前主分支的快速开始说明面向 macOS。

对比同类 Agent

用同一套 FARS 评审,横向比较这个 Agent 所属的短名单。

相关 Agents