--- type: project status: active project_type: rag-eval # 可选:rag-eval / agent-tool-eval / code-agent-eval / text-to-sql created: 2026-08-21 --- # 项目名称 > **模板使用说明:** 复制整个 `_template/` 文件夹为 `03-Practice/2026-项目名/`,逐项填写。各节的权威方法与表格见 [[02-First-Week-Worksheet|首周工作表]] 与 [[01-LLM-Evaluation-Roadmap|实战路线图]];本模板只做骨架,不重复内容。 ## 问题与范围 - 任务名称: - 用户输入: - 系统输出: ## 一句话成功条件 > (示例:关键事实可由文档支持;资料不足时明确说明) ## 三类失败 1. 2. 3. ## 非目标 - (示例:不评价文档外的常识正确性) ## 数据来源 / 许可 - 来源:/ URL:/ 日期: - 许可:/ PII 政策: ## 主要风险 - (示例:无依据补全、过度拒答、引用错位) ## 当前版本 - dataset_version:v0.1 / rubric_version:v0.1 / 最近 run: ## 关键链接 - 工作表:[[02-First-Week-Worksheet|首周工作表]] - 代码仓库:(GitHub URL) - 数据集:`datasets/eval-v0.1.jsonl` - 最近报告:`reports/report-v0.1.md` ## 下一步最小动作 - [ ] --- 返回 [[01_Projects/Personal-Tech/LLM_Evaluation/03-Practice/README|项目实践入口]]。