标签「llm-evaluation」的 Agents

共 6 个结果
llm-evaluation ×
开发与工程

LangWatch

面向 LLM 应用的评测、智能体测试、追踪与生产监控平台。

★ 4.8k FS 78 表现良好 4 天前 Apache-2.0
开发与工程

LangChain 生成式 AI 实战

用 Python、LangChain 与 LangGraph 学习构建生产级 LLM 应用和多智能体系统。

★ 1.4k FS 52 缺口较多 1 个月前 MIT
开发与工程

Giskard

为 LLM 与多轮智能体执行评测、红队测试和测试生成。

★ 5.8k FS 47 缺口较多 9 天前 Apache-2.0
效率与协作

Waku

可在自己电脑上运行、可读可改的本地优先个人助手。

★ 1.8k FS 47 缺口较多 6 天前 MIT
自动化与运维

Laminar

为 AI Agent 提供追踪、评测、信号告警与调试查询的一体化可观测平台。

★ 3.3k FS 41 缺口较多 10 天前 Apache-2.0
数据与分析

ReLE中文大模型能力评测与缺陷库

持续更新的中文AI大模型能力评测,覆盖7大领域300+细分维度,提供排行榜和超200万缺陷样本库。

★ 6.4k FS 14 缺口较多 7 天前