Harbor
开发框架/库 4k 免费Harbor 是一个开源的 AI 智能体与大模型评测框架。它通过 Docker 容器化技术,让开发者一条命令即可拉起 Claude Code、Codex CLI 等 Agent 环境,并提供标准化沙箱和基准测试套件,用于评估 Agent 的代码生成、命令行操作等能力。Harbor 同时支持强化学习训练环境,是 AI Agent 评测和 RL 训练的基础设施。
搭配玩法
1基于Harbor扩展评估AI代理完成真实AWS任务的准确性
Harbor提供代理评估基础框架,aws-bench在其上扩展AWS资源配置、场景与验证器能力
✓ 可在真实一次性AWS账户中评估代理表现✓ 内置适配器支持多种智能代理和模型 ✕ 需要管理账户凭据及组织权限✕ 会创建持久化资源,可能产生费用
产品简介
Harbor 是一个开源的 AI 智能体与大模型评测框架。它通过 Docker 容器化技术,让开发者一条命令即可拉起 Claude Code、Codex CLI 等 Agent 环境,并提供标准化沙箱和基准测试套件,用于评估 Agent 的代码生成、命令行操作等能力。Harbor 同时支持强化学习训练环境,是 AI Agent 评测和 RL 训练的基础设施。