效率与协作 local-firstdocument-analysisspreadsheet-analysisollamataurifastapicloudflare-tunnel

OpenYak 桌面智能工作台

在本机文件和模型边界内完成文档分析、任务编排与可复用产出。

FollowAgents 评估 · FARS-2.0
待评估
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

OpenYak 是一款本地优先的桌面 Agent 工作台,可处理本机文件并保留对话、记忆、工作流状态与生成物。它支持 DOCX、XLSX、PPTX、PDF、CSV、本地文件夹及生成的工件,并将结果呈现在聊天和右侧 Artifact workspace 中。桌面端采用 Tauri v2、Rust 与 Next.js 15,后端是 FastAPI Agent runtime,并使用 SQLite 存储。推理可通过 Rapid-MLX、Ollama 或自定义 OpenAI 兼容本地端点离线运行,也可由用户自行配置 OpenAI、Anthropic、OpenRouter 等云端服务。Ultra 模式可由父 Agent 创建 2–4 个持久化子会话,并在原任务中汇总结果。

用户安装桌面应用后,新建对话并附加实际文件。OpenYak 可读取办公文档、表格、幻灯片、PDF、CSV 和本地项目上下文,调用具备用户控制权限的文件工具来读取、写入、重命名、整理和自动化文件,并生成 Markdown 简报、表格、图表、清单等 Artifact。前端的 Next.js 聊天界面提供 SSE streaming、设置和工件面板;FastAPI 运行时负责 Agent 执行、LLM streaming、工具执行与存储。复杂任务中,Ultra 的父 Agent 可启动 AgentRuns,在持久化子 Sessions 中跟踪状态、交换输入并综合输出。模型请求要么发送至 localhost 上的 Rapid-MLX、Ollama 或自定义 OpenAI-compatible server,要么直接发送到用户配置的云端提供商。

  1. 部门经理收到一份长篇 DOCX 备忘录时,可将其转为高管简报、风险、负责人、下一步行动和可直接发送的跟进邮件。
  2. 财务人员上传预算工作簿后,可要求分析预算与实际差异、异常、驱动因素及会议用谈点。
  3. 项目负责人需要整合备忘录、预算表、演示文稿和 PDF 时,可在同一对话中形成一份董事会简报工件。
  4. 需要连续推进工作的运营人员,可先分析材料,再在原线程生成 RACI、30 天计划、议程和后续邮件。
  5. 处理复杂多部分任务的用户可启用 Ultra,让父 Agent 将工作拆分给 2–4 个子会话并汇总结果。
  6. 希望从手机向自己电脑提交任务的用户,可启用 Remote access,扫描二维码后通过 Cloudflare Tunnel 连接。

这个 Agent 有哪些优点和局限?

优点
  • 本地文件、对话、记忆、工件和工作流状态存储在设备上;使用本地模型时,模型请求也可留在本机。
  • 同时覆盖办公文档、表格、演示文稿、PDF、CSV 和本地文件夹,并能把结果沉淀为可复用的 Markdown、表格、图表和清单。
  • 模型边界选择较广:支持 Rapid-MLX、Ollama、自定义 OpenAI-compatible endpoint,以及多家 BYOK 云端提供商。
  • 运行时明确包含持久化运行状态、可恢复 SSE、取消、受限重试、工具参数校验和分层权限策略。
  • Ultra 提供同一任务内的持久化子会话、状态查看和结果汇总,适合多步骤工作。
局限
  • 离线使用依赖用户自行准备 Rapid-MLX、Ollama 或其他本地 OpenAI-compatible 服务及已下载模型。
  • 使用云端模型时,提示词和相关上下文会从桌面直接发送到用户选定的提供商;本地存储并不意味着云端推理也离线。
  • 文件读写、重命名、整理和自动化能力受用户控制的权限策略约束,实际可执行范围取决于授权。
  • Remote access 依赖 Cloudflare Tunnel 和令牌认证;它并非无需网络的功能。
  • 源码开发文档只给出 npm run dev:all 作为启动命令,未在提供材料中完整列出前置运行时与依赖安装流程。

如何安装或部署这个 Agent?

从 latest release 下载对应平台的软件包:macOS 为 .dmg 或 .app,Windows 为 x64 .exe installer,Linux 为 x64 .deb 或 .rpm。安装后,在设置中选择推理位置:Apple Silicon macOS 可使用 Rapid-MLX;macOS、Windows 或 Linux 可安装 Ollama 并下载模型;也可配置自定义 OpenAI-compatible 本地端点。若选择云端模型,需要自行提供对应服务商的 API key;ChatGPT 路径使用现有 Plus、Pro、Team 或 Enterprise 订阅(可用时)。源码开发入口仅明确提供 npm run dev:all,它会启动 8000 端口的后端与 3000 端口的前端;README 未给出运行该命令前所需的 Node.js、Rust、Python 或依赖安装步骤。

如何使用这个 Agent?

启动应用后,新建对话并附加一个真实文件。选择本地 Rapid-MLX、Ollama 或已配置的云端提供商,然后以交付物形式提出请求,例如要求从上传文件中提炼三项要点、风险、负责人、下一步行动和一封跟进邮件。查看聊天结果与右侧 Artifact panel,并在同一线程继续提出 RACI、计划或修订请求。对于复杂任务,打开 Ultra 并正常描述目标;父 Agent 会自行决定是否创建子 AgentRuns。需要移动访问时,在设置中启用 remote access,扫描二维码并使用移动网页客户端连接。

这个 Agent 与同类方案有什么区别?

README 将 OpenYak 定位为更接近本地 Agent workbench 的桌面工具:围绕本机文件、工件、工具权限与长线程工作设计;相较 ChatGPT 或 Claude.ai 等网页聊天产品,其重点是让工作持续绑定在用户自己的电脑上。

常见问题

是否需要注册 OpenYak 账户或支付平台订阅?
不需要 OpenYak 账户、登录、计费资料或托管后端。云端模型需要用户自己的 API key;ChatGPT 路径可使用已有订阅(可用时)。
能否完全离线运行?
可以。Apple Silicon macOS 可使用下载好的 MLX 模型配合 Rapid-MLX;macOS、Windows 和 Linux 可使用已下载模型的 Ollama。
云端模型会接触哪些数据?
当你选择云端模型时,提示词及相关上下文会从桌面直接发送给所选提供商;OpenYak 不代理模型流量。
它可以修改本机文件吗?
可以执行读取、写入、重命名、整理和自动化文件等操作,但这些操作受分层 allow/ask/deny 权限、资源范围审批和工作区边界控制。
长任务或失败任务如何处理?
运行时声明支持持久化运行状态、可恢复 SSE、取消、受限重试和子运行失败隔离;长对话还提供自动压缩与持久化 LLM 摘要。

相关 Agents