CC-Bench v1.0: Claude Code Replication Benchmark
用 AI 编程 Agent 的复刻来度量 Agent 框架的工程能力。
核心观点
"能否在一个 Agent 框架上快速复刻 Claude Code 的核心体验"本身就是检验该框架工程完备度的最佳 benchmark。
评价体系
8 维度加权评分:LLM 抽象层、工具系统、Agent 循环、终端交互、权限与安全、协议扩展、上下文管理、框架胶水成本
排名结果
| 排名 | 框架 | 加权总分 |
|---|---|---|
| 🥇 1 | LangGraph | 3.60 / 5.00 |
| 🥈 2 | LangChain v1.2 | 3.45 / 5.00 |
| 🥉 3 | AgentScope | 2.25 / 5.00 |
包含文档
README.md— 完整 Benchmark 框架 + 评分方法论comparisons/agentscope-vs-cc.md— AgentScope 详细对比comparisons/langchain-vs-cc.md— LangChain 详细对比comparisons/langgraph-vs-cc.md— LangGraph 详细对比