写作与内容 video-automationyoutube-shortstiktokvoice-dubbingcaption-generationmoviepyedge-ttspexels

ShortGPT 视频自动化

将脚本、配音、素材和剪辑串成短视频自动化流程。

FollowAgents 评估 · FARS-2.1
不推荐
0/ 100 五分制 0.0 / 5
1 2 3 4 5 6
按维度查看评分与理由
1信任安全0 / 29 · 0.0/5

证据仅包含README-Docker.md、LICENSE、requirements.txt和GitHub Actions工作流。没有权限模型、用户确认机制、数据流说明、敏感数据处理策略、依赖安全审计、外部影响说明、回滚机制或来源归属。所有标准均因缺乏证据而扣分。

2可靠稳定0 / 14 · 0.0/5

没有代码或测试来评估自洽性、依赖可用性或失败消息。依赖列表存在但未验证可用性。所有标准均因缺乏证据而扣分。

3适用触发0 / 18 · 0.0/5

没有文档说明目标受众、使用场景、能力边界、触发精度或环境适配。所有标准均因缺乏证据而扣分。

4规范维护0 / 18 · 0.0/5

信息架构不清晰;安装说明仅针对Docker,且不完整;命名稳定性未评估;没有示例或FAQ;没有已知限制;许可证存在但未验证;没有版本控制或变更日志;维护责任不明确。所有标准均因缺乏证据或部分证据而扣分。

5有效结果0 / 13 · 0.0/5

没有证据表明输出可用性、边际价值或成本效益。所有标准均因缺乏证据而扣分。

6证据核验0 / 8 · 0.0/5

没有证据表明声明可追溯、跨来源佐证或事实与推断分离。所有标准均因缺乏证据而扣分。

证据充分度: 评估于 2026年8月9日 审查版本 3df4e0f7a422
源码中未见的安全控制:最小权限约束、执行前用户确认、数据流向说明、敏感信息处理、依赖安全审查、外部影响披露、回滚或恢复路径、来源归属可核验
使用前请注意
  • 仓库仅包含少量文件,无法支持对Agent产品的全面评估。
  • 依赖列表包含固定版本和未固定版本,且未提供安全审计。
  • Docker运行需要API密钥,但未说明密钥的安全处理方式。
评估证据 [1][2][3][4]
查看完整评分方法 →

这个 Agent 能做什么,适合哪些场景?

ShortGPT 是一个 MIT 许可的 AI 视频内容自动化框架,面向 YouTube Shorts、TikTok 等内容制作场景。它提供 ContentShortEngine、ContentVideoEngine、ContentTranslationEngine 和基于 Editing Markup Language 与 JSON 的 EditingEngine。项目可通过 Docker 在本地运行,并在 localhost:31415 提供 Gradio Web 界面;也提供 Google Colab 运行入口。其文档说明会使用 OpenAI、ElevenLabs、EdgeTTS、Pexels、Bing Image 与 MoviePy 等技术,因此采用前需要接受这些服务和运行环境带来的依赖。

ContentShortEngine 用于从脚本生成到最终渲染的短视频制作,并包含 YouTube 元数据添加;ContentVideoEngine 为较长视频生成音频、自动获取背景视频素材、处理字幕时序和准备背景资源。ContentTranslationEngine 接收视频文件或 YouTube 链接,转录音频、翻译内容、以目标语言配音、添加字幕,并输出另一种语言的视频。EditingEngine 通过 Editing Markup Language 和 JSON 将剪辑拆分为可定制的块;框架还说明可借助 Pexels API、Bing Image 获取图片或视频素材,并用 TinyDB 持久化自动剪辑变量。

  1. 运营 YouTube Shorts 频道的创作者,希望把脚本生成、配音、素材准备和渲染整合到一个自动化流程中。
  2. 制作较长视频的内容团队,需要自动生成音频、寻找背景视频,并为字幕安排时间。
  3. 需要将现有视频或 YouTube 链接配音并翻译成目标语言的本地化制作者。
  4. 希望使用 EdgeTTS 覆盖英语、西班牙语、阿拉伯语、中文、日语等多种语言配音的创作者。
  5. 需要以 JSON 和 Editing Markup Language 描述可拆分、可定制剪辑步骤的开发者。

这个 Agent 有哪些优点和局限?

优点
  • 覆盖短视频、长视频和视频翻译三种明确的内容生产流程。
  • ContentTranslationEngine 明确支持从视频文件或 YouTube 链接到转录、翻译、配音、字幕和新视频输出的完整链路。
  • EditingEngine 使用 Editing Markup Language 与 JSON,将剪辑工作拆为可定制、便于大语言模型理解的块。
  • 既支持 Docker 本地运行,也提供 Google Colab 入口和 Gradio Web 界面。
局限
  • 核心自动化流程明确使用 OpenAI,且 README 未给出可替换模型提供商的配置方式。
  • 本地部署依赖 Docker,并要求 .env;现有材料没有列出环境变量、密钥或完整安装说明。
  • 素材来源依赖互联网、Pexels API 与 Bing Image,使用时会受外部服务可用性和访问条件影响。
  • README 称文档仍在补充,未提供可验证的 Web 界面操作、API 示例或 CLI 参数。

如何安装或部署这个 Agent?

README 将 Docker 列为本地运行的前提条件,并要求先阅读 installation-notes.md(该文件内容未提供)。在仓库根目录执行:

docker build -t short_gpt_docker:latest .

docker run -p 31415:31415 --env-file .env short_gpt_docker:latest

项目还提供 Google Colab 入口。README 要求使用 .env,但未提供变量名称、所需密钥、Python 版本或完整依赖安装细节,因此无法仅据现有材料完成凭证配置。

如何使用这个 Agent?

启动上述容器后,打开 http://localhost:31415 使用 Gradio 界面。对于视频翻译流程,README 说明 ContentTranslationEngine 可接收视频文件或 YouTube 链接,并输出带目标语言配音和字幕的视频;但现有材料没有给出 Web 表单字段、Python API 调用或命令行参数,因此这些具体操作无法验证。

这个 Agent 与同类方案有什么区别?

README 将 ElevenLabs 和 EdgeTTS 都列为语音合成技术;其中将 EdgeTTS 描述为免费且支持的语言数量多于 ElevenLabs。

常见问题

能否完全离线运行?
不能据现有材料确认。README 说明会连接互联网,并使用 Pexels API、Bing Image、OpenAI、ElevenLabs 或 EdgeTTS 等外部服务。
需要哪些密钥?
README 要求以 --env-file .env 启动 Docker,但未列出环境变量或密钥名称;无法从现有材料确认具体凭证。
它能处理已有视频吗?
可以。README 说明 ContentTranslationEngine 接收视频文件或 YouTube 链接,并生成翻译、配音和字幕后的新视频。
本地运行后的入口是什么?
Docker 容器映射端口 31415;README 说明 Gradio 界面应在 http://localhost:31415 打开。

相关 Agents