gersteinlab/LocAgent
[ACL 2025] Graph-guided agentic framework for code localization https://arxiv.org/abs/2503.09089
解决的问题
LocAgent 解决了代码定位的难题——即准确识别出需要修改以修复 bug 或实现功能的文件或代码片段。传统方法在处理复杂代码库时往往难以导航,并且难以弥合自然语言问题描述与实际代码元素之间的差距。
工作原理
LocAgent 将代码库解析为有向异构图,以表示代码结构及其依赖关系。这种轻量级的图表示使 LLM 代理能够执行多跳推理,通过代码库的依赖关系进行导航,从而比简单的文本搜索更有效地查找和定位相关实体。
适用人群
该框架专为从事自动化软件维护、AI 驱动的 bug 修复以及基于 LLM 的代码分析工具的开发者和研究人员设计。
核心亮点
- 图引导导航:使用异构图捕捉代码依赖关系,提升搜索准确性。
- 多跳推理:使代理能够遍历代码库结构,寻找相关代码。
- 微调模型:提供针对代码定位优化的 Qwen2.5-Coder(7B 和 32B)专用版本。
- 基准集成:兼容 Loc-Bench 和 SWE-bench,可用于评估定位准确性。
相关
- 项目
- 项目
trailhq/GraftGraft 是一个开源的 TypeScript/Node.js 工具,利用 tree-sitter 进行结构化解析,并可选地使用 LLM 摘要,构建本地、基于 Markdown 的代码库知识图谱(摘要、关键代码片段、类型化链接)。图谱缓存在 `graft/` 文件夹中,仅在文件变更时刷新,并自动集成到 Claude Code、Cursor、Codex 和 Gemini 等编码代理中。基准测试显示,最多减少 46% 的工具调用、42% 的 token 消耗、60% 的延迟,并在 SWE-bench 上实现 12 点准确率提升。集成通过单个 `graft init` 命令完成,生成代理专用的指令文件;CLI 还提供搜索、可视化和遥测控制功能。项目采用 MIT 许可证,旨在实现更快、更低成本的 AI 辅助开发。
- 项目
vercel-labs/lat.mdlat.md 是一个通过 npm 分发的 CLI,为代码库创建基于 Markdown 的知识图谱。它允许您在 `lat.md/` 中编写链接文档,使用 `@lat` 注释标注源文件,并验证图谱。开发者和代理可以离线使用 MiniLM 或远程调用 OpenAI/Vercel 嵌入进行语义搜索,并使用 `lat check`、`lat locate` 和 `lat expand` 等命令,使设计决策、约束和测试规范与代码保持同步。
- 项目
- 项目
Cranot/roam-coderoam‑code 是一个本地静态分析 CLI(及可选 MCP 服务器),可构建仓库的符号图,使 AI 编码代理无需任何远程 API 调用即可查询定义、调用者、测试影响和风险(爆炸半径)。它提供预飞行检查、健康摘要、验证门禁和 Claude 特定钩子,全部开源且保护隐私。