大家好,我最近做了一个实验性开源项目 Code Search 。
起因是我用 Codex 修复启动事件丢失问题时,它找到了事件发布者,却漏掉了订阅者初始化和依赖顺序。我开始觉得,Coding Agent 缺的可能不是更多相似代码,而是完成任务所需的完整证据。
Code Search 会尝试把实现、测试、配置和相关修复位置组织成一个紧凑的证据集,并说明每条结果的位置、入选原因和结构角色。
目前完全无模型:不用 embedding 、GPU 、常驻服务,运行时不联网;支持工作区和历史 Git revision 。
安装:uv tool install code-search-cli
在 61 条公开 Java development 查询中,它的 NDCG@10 为 0.8468 、MRR@10 为 0.8207 ,是本次记录的 6 种方法中最高的。不过 Semble 的 Recall 、速度和 payload 更好;这些数据也只测 retrieval ,不代表 patch success 。
接下来准备测试真实 issue 、改进长查询,并增强 AST/符号提取。
项目和 Benchmark:
https://github.com/quguai/code-search
想听听大家的意见:这种“任务证据集”是否比普通 Top-K 结果更适合 Coding Agent ?也欢迎提供搜漏过文件的真实 issue 。