标签「ppo」的 Agents

共 5 个结果
ppo ×
数据与分析

Mava

用 JAX 快速训练与评估分布式多智能体强化学习系统。

★ 935 FS 41 缺口较多 15 天前 Apache-2.0
开发与工程

MARTI:多智能体强化学习训练与推理框架

让 LLM 多智能体系统通过强化学习进行可扩展训练与树搜索增强推理,覆盖辩论、智能体链、混合智能体等工作流。

★ 560 FS 36 缺口较多 1 个月前 MIT
数据与分析

RLinf 强化学习基础设施

面向具身机器人与智能体的大规模强化学习训练基础设施。

★ 5.3k FS 35 缺口较多 4 天前 Apache-2.0
开发与工程

Hands-On Modern RL 实战教程

从经典控制到 LLM 后训练与智能体强化学习的实践优先课程。

★ 4.4k FS 30 缺口较多 20 天前 NOASSERTION
开发与工程

AgentsMeetRL——智能体强化学习资源大全

系统收录并分类开源 LLM 智能体强化学习项目,助你快速寻找框架、算法、奖励与环境参考。

★ 1.8k FS 29 缺口较多 8 天前