Sep 12, 2026

用 Caliber 让 CLAUDE.md 随代码演进保持准确

生成并持续同步所有 AI 上下文文件——CLAUDE.md、AGENTS.md、cursor rules、copilot instructions——并用确定性评分证明效果。

#tutorial#developer-tools#agent-tools

手写的 CLAUDE.md 在你重构的那一刻就开始过期——agent 幻觉出早已不存在的路径,基于昨天的架构给建议。Caliber 负责生成并维护你的 AI 上下文文件,随代码演进保持同步,覆盖 Claude Code、Cursor、Codex、OpenCode 和 GitHub Copilot。

为什么这个 Skill 重要

Caliber 把 agent 配置当代码对待。一个确定性评分——不调用 LLM、不发 API 请求——把你的配置文件与项目实际文件系统交叉核对,分六个类别:Files & Setup(25 分)、Quality(25)、Grounding(20)、Accuracy(15)、Freshness & Safety(10)、Bonus(5)。工作流模仿代码评审:先评分,以 diff 形式提议变更,逐条审阅,把原件备份到 .caliber/backups/,需要时用 caliber undo 回滚。如果现有配置已经拿到 95 分以上,Caliber 会跳过完整重新生成,只针对未通过的检查做定点修复。该仓库(caliber-ai-org/ai-setup)在 SkillMap 排行榜上拥有 1,267 颗星。

安装

需要 Node.js 20 或更高版本。

npx @rely-ai/caliber bootstrap

bootstrap 大约两秒完成,安装 /setup-caliber 技能——README 说明它 100% 本地运行,不调用 LLM,也不向任何地方发送代码。然后在终端里启动 Claude Code 或 Cursor CLI 会话,输入:

/setup-caliber

你的 agent 会检测技术栈,为团队使用的每个平台生成定制配置,装好 pre-commit 钩子并启用持续同步。不用 Claude Code 或 Cursor?caliber init 以 CLI 向导形式运行同样的设置。

实战:Bootstrap、评分、让循环转起来

  1. 运行 npx @rely-ai/caliber bootstrap,再在会话里执行 /setup-caliber。agent 会按平台生成配置——Claude Code 得到 CLAUDE.md 加 CALIBER_LEARNINGS.md 和 .claude/skills/*/SKILL.md,Cursor 得到 .cursor/rules/*.mdc,Codex 和 OpenCode 得到 AGENTS.md,Copilot 得到 .github/copilot-instructions.md。
  2. 确定性评分,并跨分支对比:
caliber score --compare main
  1. 让循环自己跑。pre-commit 钩子触发 caliber refresh,分析已提交、已暂存和未暂存的变更,把配置文件更新到一致。新队友首次会话时会被提示 bootstrap。

第二个工作流开启会话学习:caliber learn install 捕获工具使用、失败和你的纠正,再把模式提炼进 CALIBER_LEARNINGS.md——自动打上 [correction]、[gotcha]、[fix]、[pattern]、[env] 或 [convention] 标签并去重。

技巧

  • 生成环节使用你已有的 AI 订阅或 API key——Claude Code 或 Cursor 的席位可用,也可以自带 Anthropic、OpenAI、MiniMax 或 Vertex AI 的 key。bootstrap 和评分从不调用 LLM。
  • 遥测(命令名和耗时,不含代码)经 PostHog 上报;设置 CALIBER_TELEMETRY_DISABLED=1 即可退出。
  • 签名提交或极简 diff 工作流可以关掉 pre-commit 自动暂存:git config caliber.autostage false。
  • caliber uninstall 移除 Caliber 添加的一切——钩子、生成段落、技能、learnings——同时保留你自己的内容。

何时不用这个 Skill

需要 Node.js 20 以上,且生成环节需要 AI 订阅或 API key(bootstrap 和评分不需要)。如果你只为单一 agent 手工维护一份上下文文件、每个版本发布前都会人工复核,这套多平台同步机制就超出问题本身了——可能只有确定性评分这部分对你有用。


查看 排行榜 了解更多 skill。