
codeneedle
alexziskind1
暂无描述
AI 简介
这是一个用于评估大语言模型在长上下文中精确回忆代码片段位置能力的基准测试工具。它通过将大型源码语料注入模型上下文,要求模型逐字复现指定函数的前N行,从而量化 positional recall(位置记忆精度),而非简单的命名实体检索。项目支持多语料(如http_server、jquery.js)、多模型(本地或API托管)的灵活配置与自动化评测,并提供可视化分析模块。适用于LLM长上下文能力对比、代码理解模型选型及RAG系统中检索精度验证等场景。
Python
301
Stars
53
Forks
7
Watchers
3
Issues
Star 增长
今日0
近 7 天0
近 30 天+1
综合评分39.3
默认分支main