FrontierAgent:全新智能体环境,带 TUI、Agent Team 模式与质量评估
FrontierAgent — 面向长时间研究任务和文件任务的开源智能体环境,代码仓库于 2026 年 8 月 22 日开放,28 天内获得约 4 千颗星。它是把运行时、终端产品和智能体评测套件合而为一的项目:两种原生运行模式——ReAct 和 Agent Team——在 macOS 和 Linux 上用一条命令即可启动,无需强制使用 Docker。
功能
- Agent Team — 协调者维护任务看板,把相互独立的工作分派给并行子智能体,收集它们的报告并综合出最终结果。
- ReAct 模式 — 单个带状态的智能体进行探索、读取文件、写入结果、执行命令并在沙箱中迭代。
- 文件与命令沙箱 — shell 和文件工具在任务的共享文件系统中工作:/inputs 只读,/workspace 为工作状态,/outputs 为持久结果;授权和沙箱故障一律以拒绝方式处理。
- 人工确认 — 变更类操作会显示 diff 并要求批准,除非开启 --yes;会话会建立检查点,每个动作都在本地留痕,/revert 回滚更改,--resume 继续已保存的运行。
- 异步干预 — 可以在智能体工作时输入:指令进入队列,并在最近的安全回合边界注入,不会丢弃正在进行的运行。
- 智能体质量评测 — evaluation harness 在隔离的子进程中运行基准测试的每个问题,支持可续跑的多轮实验以及确定性或模型裁判。
用自己的模型替代云服务
自己的模型通过 OpenAI 兼容 API 和 SGLang 接入。文档指出,本地 SGLang 服务仅限经过验证的 NVIDIA 驱动、CUDA 和 SGLang 组合;无需托管模型——有 API 密钥和兼容端点即可。平台用 Python 编写,通过 docker run 安装,许可证为 Apache-2.0。
与同类项目的区别
在三个同类项目中,只有 FrontierAgent 的文档声明了图和状态保存,以及智能体质量评测。同时,MCP 支持、智能体记忆和自带 Docker 服务器在多数同类项目中都有提及,而这里文档并未声明。四个平台都声明了自有工具和函数。在接入自有模型方面,FrontierAgent 通过 OpenAI 兼容 API 更接近 DeerFlow 和 OpenBot,而 Hermes Agent 则押注于 Ollama、llama.cpp 和 vLLM。
项目活跃度如何
该仓库还不满一个月,有 10 位贡献者和约 4 千颗星。这是一个起步活跃的早期项目,但没有长期的版本发布历史——作为对比,Hermes Agent 在 90 天内有 16 个稳定版本,OpenBot 有 12 个。
| FrontierAgent | Hermes Agent | DeerFlow | OpenBot | |
|---|---|---|---|---|
| 类型 | 环境 | 环境 | 环境 | 环境 |
| 语言 | Python | Python | Python | TypeScript |
| 许可证 | Apache-2.0 | MIT | MIT | MIT |
| GitHub 星数 | 3 903 | 246 743 | 82 638 | 5 112 |
| 90 天内发布版本数 | — | 16 | 1 | 12 |
| 多智能体协同 | 有 | 有 | 有 | — |
| 自有工具和函数 | 有 | 有 | 有 | 有 |
| MCP 支持 | — | 有 | 有 | 有 |
| 智能体记忆 | — | 有 | 有 | 有 |
| 沙箱内执行代码 | 有 | — | 有 | — |
| 浏览器操作 | — | — | — | 有 |
| 人工确认 | 有 | 有 | — | — |
| 图和状态保存 | 有 | — | — | — |
| 追踪与调试 | — | — | 有 | — |
| 智能体质量评测 | 有 | — | — | — |
| 语音与讲话 | — | 有 | — | — |
| 自带服务器和 Docker | — | 有 | 有 | 有 |
| 自有模型:Ollama | — | 有 | — | — |
| 自有模型:llama.cpp | — | 有 | — | — |
| 自有模型:vLLM | — | 有 | 有 | — |
| 自有模型:SGLang | 有 | — | — | — |
| 自有模型:OpenAI 兼容 API | 有 | — | 有 | 有 |
依据各项目 README 和文档于 2026 年 9 月 19 日核对:“有”表示其中声明了该能力,破折号表示未提及(并不代表没有该能力)。星数和版本数来自 GitHub 数据。
FrontierAgent 适合那些为长时间研究任务和文件任务构建智能体、希望拥有内置质量评测,并愿意使用 OpenAI 兼容 API 或 SGLang 的人。关注新平台和评测解析可以查看 CPU3D 动态。



