Files
my-vault/01_Projects/Personal-Tech/LLM_Evaluation/03-Practice/_template/00-项目概览.md
T

59 lines
1.3 KiB
Markdown
Raw Normal View History

---
type: project
status: active
project_type: rag-eval # 可选:rag-eval / agent-tool-eval / code-agent-eval / text-to-sql
created: 2026-08-21
---
# 项目名称
> **模板使用说明:** 复制整个 `_template/` 文件夹为 `03-Practice/2026-项目名/`,逐项填写。各节的权威方法与表格见 [[02-First-Week-Worksheet|首周工作表]] 与 [[01-LLM-Evaluation-Roadmap|实战路线图]];本模板只做骨架,不重复内容。
## 问题与范围
- 任务名称:
- 用户输入:
- 系统输出:
## 一句话成功条件
> (示例:关键事实可由文档支持;资料不足时明确说明)
## 三类失败
1.
2.
3.
## 非目标
- (示例:不评价文档外的常识正确性)
## 数据来源 / 许可
- 来源:/ URL:/ 日期:
- 许可:/ PII 政策:
## 主要风险
- (示例:无依据补全、过度拒答、引用错位)
## 当前版本
- dataset_versionv0.1 rubric_versionv0.1 最近 run
## 关键链接
- 工作表:[[02-First-Week-Worksheet|首周工作表]]
- 代码仓库:(GitHub URL
- 数据集:`datasets/eval-v0.1.jsonl`
- 最近报告:`reports/report-v0.1.md`
## 下一步最小动作
- [ ]
---
返回 [[01_Projects/Personal-Tech/LLM_Evaluation/03-Practice/README|项目实践入口]]。