Skill 广场
代码图谱检索基准测试 Skill

代码图谱检索基准测试.Skill

@colbymchenry/agent-eval-09dd7

4.4推荐AI 评分基础检查通过源自 GitHub

该能力专用于评估 CodeGraph 代码图谱索引对 AI Agent 任务解决效率的实际提升。它通过驱动测试框架,在真实的开源代码仓库上针对预设开发问题,分别以「启用 CodeGraph」与「仅使用原生 Grep/Read」两种模式运行 Agent,自动记录并比对调用耗时、API Token 成本、文件读取次数以及探索充分性等指标,帮助开发者量化图谱检索在代码定位和推理中的提效与降本成果。

AI工作流AI Agent 框架与工具开发者CodeGraph 贡献者与维护者关注代码辅助推理成本与准确率的架构师2026-09-23 更新main

代码图谱检索基准测试

该能力专用于评估 CodeGraph 代码图谱索引对 AI Agent 任务解决效率的实际提升。它通过驱动测试框架,在真实的开源代码仓库上针对预设开发问题,分别以「启用 CodeGraph」与「仅使用原生 Grep/Read」两种模式运行 Agent,自动记录并比对调用耗时、API Token 成本、文件读取次数以及探索充分性等指标,帮助开发者量化图谱检索在代码定位和推理中的提效与降本成果。

它会先理解你的原始内容和目标,再按清晰的步骤完成处理。你不需要学习复杂命令,也不用理解背后的技术细节。

常见场景

它能帮你做什么?

01

02

03

三步完成

怎么使用

1安装 Skill

把右侧安装请求发给你的 AI。

2说清楚目标

告诉 AI 你想完成什么,或直接贴入内容。

3检查结果

按需要继续调整语气、范围或格式。

复制就能用

你可以直接这样说

/agent-eval 对比 local 开发版和 latest 线上版本在 excalidraw 仓库上的检索效果与 Token 成本

使用 headless 模式测试 codegraph 0.7.10 在中型前端项目中的工具调用和文件读取次数

对 corpus.json 中的 Python 目标仓库运行完整 A/B 评测,输出包含上下文残留和检索充分性的对比表格

适用人群

适合谁?

AI Agent 框架与工具开发者CodeGraph 贡献者与维护者关注代码辅助推理成本与准确率的架构师

上手门槛

使用难度

专业

适合熟悉相关工具和专业流程的用户。

兼容范围

支持哪些 AI?

Codex可直接使用
Claude Code可直接使用
OpenClaw可直接使用
Hermes可直接使用
国内 Agent可直接使用

中文用户增强

Skill Px 做了什么?

中文说明简化使用方式补充中文案例整理安装流程降低理解难度