代码图谱检索基准测试
该能力专用于评估 CodeGraph 代码图谱索引对 AI Agent 任务解决效率的实际提升。它通过驱动测试框架,在真实的开源代码仓库上针对预设开发问题,分别以「启用 CodeGraph」与「仅使用原生 Grep/Read」两种模式运行 Agent,自动记录并比对调用耗时、API Token 成本、文件读取次数以及探索充分性等指标,帮助开发者量化图谱检索在代码定位和推理中的提效与降本成果。
它会先理解你的原始内容和目标,再按清晰的步骤完成处理。你不需要学习复杂命令,也不用理解背后的技术细节。
常见场景
它能帮你做什么?
三步完成
怎么使用
把右侧安装请求发给你的 AI。
告诉 AI 你想完成什么,或直接贴入内容。
按需要继续调整语气、范围或格式。
复制就能用
你可以直接这样说
“/agent-eval 对比 local 开发版和 latest 线上版本在 excalidraw 仓库上的检索效果与 Token 成本”
“使用 headless 模式测试 codegraph 0.7.10 在中型前端项目中的工具调用和文件读取次数”
“对 corpus.json 中的 Python 目标仓库运行完整 A/B 评测,输出包含上下文残留和检索充分性的对比表格”
适用人群
适合谁?
上手门槛
使用难度
适合熟悉相关工具和专业流程的用户。
兼容范围
支持哪些 AI?
中文用户增强