标签「reinforcement-learning」的 Agents — 第 2 页

共 33 个结果
reinforcement-learning ×
数据与分析

Open-AgentRL

面向推理、工具调用与交互环境的强化学习训练框架。

★ 641 FS 28 缺口较多 3 个月前 Apache-2.0
开发与工程

Youtu-Agent

面向开源模型的可配置智能体构建、评测与持续优化框架。

★ 4.6k FS 27 缺口较多 6 个月前 NOASSERTION
开发与工程

GPTSwarm

以可优化图构建并自组织语言智能体群。

★ 1k FS 27 缺口较多 7 个月前 MIT
开发与工程

AgentGuide - AI Agent 开发求职一站式指南

对标 JavaGuide 的 AI Agent 学习指南:从入门到拿 Offer,系统化、实战化、求职导向。

★ 10k FS 23 缺口较多 9 天前
开发与工程

AI Agents 项目与教程集合

一个包含多智能体系统、记忆、规划与推理循环的代码教程和示例的综合性仓库。

★ 2.9k FS 9 缺口较多 4 天前
数据与分析

AReaL 异步强化学习平台

面向推理与工具型模型的异步强化学习训练基础设施。

★ 5.8k FS 0 缺口较多 今天 Apache-2.0
数据与分析

LLM智能体论文列表

大语言模型智能体领域的必读论文清单,基于86页SCIS封面综述整理。

★ 8.2k FS 0 缺口较多 1 年前
开发与工程

rLLM:大语言模型智能体强化学习框架

统一的智能体强化学习框架,支持任意 harness、任意沙箱,一键切换训练后端。

★ 5.8k FS 0 缺口较多 11 天前 Apache-2.0
效率与协作

解密 Prompt

持续整理 Prompt、LLM、RAG 与智能体研究资料。

★ 3.4k 证据不足 16 天前