Harbor

Harbor

开发框架/库 4k 免费
Harbor 是一个开源的 AI 智能体与大模型评测框架。它通过 Docker 容器化技术,让开发者一条命令即可拉起 Claude Code、Codex CLI 等 Agent 环境,并提供标准化沙箱和基准测试套件,用于评估 Agent 的代码生成、命令行操作等能力。Harbor 同时支持强化学习训练环境,是 AI Agent 评测和 RL 训练的基础设施。
访问官网

搭配玩法

1
Harbor + Claude Code Claude Code+ Codex Codex + AWS账户+ aws-bench+ Mini-SWE-Agent

基于Harbor扩展评估AI代理完成真实AWS任务的准确性

Harbor提供代理评估基础框架,aws-bench在其上扩展AWS资源配置、场景与验证器能力

✓ 可在真实一次性AWS账户中评估代理表现✓ 内置适配器支持多种智能代理和模型 ✕ 需要管理账户凭据及组织权限✕ 会创建持久化资源,可能产生费用

产品简介

Harbor 是一个开源的 AI 智能体与大模型评测框架。它通过 Docker 容器化技术,让开发者一条命令即可拉起 Claude Code、Codex CLI 等 Agent 环境,并提供标准化沙箱和基准测试套件,用于评估 Agent 的代码生成、命令行操作等能力。Harbor 同时支持强化学习训练环境,是 AI Agent 评测和 RL 训练的基础设施。

用户评价

还没有评价
这款产品刚收录,成为第一个评价的人
写第一条评价