一页纸概览 产品需求文档 竞品分析 评测集设计 迭代记录 技术方案 问答实例集
版本对应 35 篇真实服装设计论文、20 题金标、hash 嵌入、大模型生成与引用校验。
研究生撰写学位论文时,关键工作往往不是继续检索新文献,而是判断已经入库的论文能否支撑当前任务。现有工具把两件事混在一起:发现尚未阅读的论文,以及对已经入库的论文提问、对照、核对引用。混在一起的后果是,模型依据训练语料补全表述,使用者难以区分句子来自本地文献还是模型记忆。开题、综述、方法、写作、结题对合格答案的要求并不相同,通用问答却只有一种输出形态。
在用户自己的 PDF 库内,按研究阶段给出有出处、可拒答、不代写的工作稿。
| 目标 | 验收标准 |
|---|---|
| 仅依据库内文本作答 | 库中无对应结论时输出「未找到依据」,不得编造文献 |
| 阶段对应研究任务,而非代写 | 开题说明覆盖与缺口,综述做对照,方法拆解做法,写作核对事实,结题整理可回溯原话 |
| 引用可回溯 | 每条引用指向本轮命中文献的标题、章节与页码 |
| 效果可复验 | 20 题可重复运行,不同实验条件的分数分开记录 |
服装设计或设计学方向研究生。手头已有数十篇 PDF,并处于开题至结题之间的某一阶段。
需要本地文献库、不便将全文上传至公有云的研究者。当前版本以本机运行为默认形态,云端部署属于后续运维,不是本阶段需求。
| 阶段 | 用户任务 | 预期产出 | 应避免的产出 |
|---|---|---|---|
| 开题 | 判断研究方向能否成立 | 说明已覆盖的框架与要素,并标出缺口 | 生成开题报告 |
| 综述 | 对照既有文献的立场 | 归纳异同与边界,并标注出处 | 可直接粘贴的 Related Work |
| 方法 | 寻找可借鉴的做法 | 整理步骤、分类与工艺 | 提出新的技术方案 |
| 写作 | 核对事实、数字与出处 | 一句可引用事实及其页码 | 扩写为论文正文 |
| 结题 | 准备答辩表述 | 可回溯至原文的要点;没有则明确说明 | 用无关段落勉强作答 |
| 需求 | 优先级 | 现状 |
|---|---|---|
| 上传 PDF,解析后进入可检索库 | P0 | 已实现 |
| 列表展示标题、年份、作者与解析状态 | P0 | 已实现 |
| 按标题或作者筛选,删除后重建索引 | P0 | 已实现 |
| 无文字层标注为扫描件,不视为已读 | P0 | 已实现 |
| 中文文件名优先于 PDF 内英文题名 | P0 | 已实现 |
| 需求 | 优先级 | 现状 |
|---|---|---|
| 关键词与语义混合检索,合并去重 | P0 | 已实现 |
| 按阶段重排:章节提示与正文用语 | P0 | 已实现,效果仍弱 |
| 分阶段工作稿:覆盖、对照、做法、事实、原话 | P0 | 已实现 |
| 引用必须来自本轮命中,编造引用则删除该句 | P0 | 已实现 |
| 无依据时明确拒答 | P0 | 大模型路径已验证 |
| 「用到的原文」展示 PDF 页图 | P1 | 已实现 |
| 年份区间默认关闭 | P1 | 已实现 |
| 需求 | 优先级 | 现状 |
|---|---|---|
| 20 题可命令行复跑 | P0 | 已实现 |
| 报告含总分、分阶段、分难度与逐题结果 | P0 | 已实现 |
| 样例库与真库分数禁止混报 | P0 | 文档约定 |
| 项 | 要求 |
|---|---|
| 知识边界 | 答案仅允许来自本轮检索片段 |
| 拒答 | 无对应结论时输出「未找到依据」,并说明命中文本实际讨论的内容 |
| 引用 | 引用可追溯须为 1.00;启用大模型后若低于 0.9,视为回归 |
| 代写防护 | 写作阶段只提供可引用事实,不输出可直接作为正文的长段落 |
本机原型的问答时延以数秒计,库规模先服务数十至一两百篇,当前验收库为 35 篇。双栏或三栏中文 PDF 尽量还原阅读顺序,扫描件不承诺文字识别。默认情形下,PDF、索引与对话不出本机。用户须能看到当前阶段说明、命中篇名、章节或页码,以及对应 PDF 页,而不能只得到一段无出处结论。
20 题覆盖五个阶段与四个难度。每题绑定目标文献;库外题目的目标文献为空。难度 1 接近标题或摘要用语,难度 2 为同义改写,难度 3 为近义或跨段归纳,难度 4 为跨篇综合、数字核对或库中无依据。指标定义与当前分数见 评测集设计 与 评测结果。
每次实验只改变一类条件。样例库与真实论文库题目不同,分数不得作为同一条进步曲线。须单独观察:库外题必须整题拒答;近义提问「服装如何讲故事」目标文献已召回但排序偏后;写作题中的百分比须与原文一致。
| 轮次 | 假设 | 动作 | 状态 |
|---|---|---|---|
| 流程打通 | 链路可测 | 样例库与原文抽取 | 完成 |
| 替换真实语料 | 真库与样例不可比 | 35 篇论文与新 20 题 | 完成 |
| 仅调整生成 | 可读性与拒答主要取决于生成 | 启用大模型与引用校验 | 完成 |
| 界面与文献库 | 控件会影响品类理解 | 隐藏年份、工作稿、原页展示 | 完成 |
| 替换语义表示 | 占位表示限制近义排序 | 仅更换嵌入方法 | 下一步 |
| 章节结构化 | 阶段应改变检索分布 | 识别中文摘要、引言与结论 | 未开始 |
停止条件:启用大模型后引用可追溯低于 0.9,视为回归;写作阶段若开始输出可直接粘贴的长段落,即使分数上升也视为产品回归。原则是先证明用自己的库也能问清楚,再讨论发现层与多模态。完整轮次见 迭代记录。