- fix stage-numbering conflict (README vs 05-Progress) and unify stage-1 reading scope - resolve AWS workshop prerequisite contradiction in 04-Reference/01 - convert medium-path wikilinks to vault-root paths (~30 links), fix .pyy typos, annotate ragas fork, unify archive status, add 01-/02- README hubs - compress old-version guidebook notes (01, 05) into pointers; add 2026 reading guidance to 00-Overview - dedupe project templates and remove embedded template copy in 03-Practice/README
1.3 KiB
1.3 KiB
type, status, project_type, created
| type | status | project_type | created |
|---|---|---|---|
| project | active | rag-eval | 2026-08-21 |
项目名称
模板使用说明: 复制整个
_template/文件夹为03-Practice/2026-项目名/,逐项填写。各节的权威方法与表格见 02-First-Week-Worksheet 与 01-LLM-Evaluation-Roadmap;本模板只做骨架,不重复内容。
问题与范围
- 任务名称:
- 用户输入:
- 系统输出:
一句话成功条件
(示例:关键事实可由文档支持;资料不足时明确说明)
三类失败
非目标
- (示例:不评价文档外的常识正确性)
数据来源 / 许可
- 来源:/ URL:/ 日期:
- 许可:/ PII 政策:
主要风险
- (示例:无依据补全、过度拒答、引用错位)
当前版本
- dataset_version:v0.1 / rubric_version:v0.1 / 最近 run:
关键链接
- 工作表:02-First-Week-Worksheet
- 代码仓库:(GitHub URL)
- 数据集:
datasets/eval-v0.1.jsonl - 最近报告:
reports/report-v0.1.md
下一步最小动作
返回 01_Projects/Personal-Tech/LLM_Evaluation/03-Practice/README。