CodeAgent 是本地的、基于 CLI 的自主编码智能体。网站称,模型负责推理,而确定性软件负责搜索、执行、约束、验证、持久化和观测。它围绕工具调用循环构建,带有原生提供方工具调用以及迭代、重复和预算护栏,并在执行前使用按表驱动的允许、询问和拒绝决策的权限引擎。 安全决策是确定性的,而不是委托给模型,工具和文件输出被视为不可信,无法更改权限规则。智能体默认通过 Git worktree 提供隔离,并支持检查点、回滚和可选的 Docker 沙箱。它还包含检查流水线和完成关卡,没有证据就不算验证通过的完成。 持久化运行使用 SQLite 状态,可在中断或配额等待后恢复,并提供完整的事件追踪。项目包含评测框架,带有 40 个任务的固定用例集、CI 中的脚本化重放,以及可选的实时切片。它发布到第 8 阶段,并针对小型仓库以及 Groq 免费层的上下文和配额限制进行了调优。
团队用 CodeAgent 通过 CLI 在本地运行自主编码任务。
团队用 CodeAgent 在迭代、重复和预算护栏下执行提供方的工具调用。
团队用 CodeAgent 在执行前强制执行允许、询问和拒绝权限。
团队用 CodeAgent 通过 Git worktree、检查点、回滚和可选的 Docker 沙箱隔离更改。
团队用 CodeAgent 通过检查流水线和完成关卡验证任务完成。
团队用 CodeAgent 在中断或配额等待后恢复持久化运行。
团队用 CodeAgent 通过 40 个任务的固定用例集和 CI 中的脚本化重放评估智能体行为。
团队用 CodeAgent 在循环内通过 grep、glob 和 read_file 执行智能体式搜索。