一页纸概览 产品需求文档 竞品分析 评测集设计 迭代记录 技术方案 问答实例集

一页纸概览

文献工作台

面向研究生的本地论文库研究助手:不在网上继续检索论文,只在用户已经入库的 PDF 中查找原文,按开题至结题的任务约束作答;找不到依据即明确说明。

它不是知网或 Elicit 式的学术搜索,不是 NotebookLM 式的通用笔记,也不是代写工具。

文档召回
1.00
目标文献进入前 10
nDCG@10
0.89
近义提问排序仍弱
忠实度
0.82
词重叠估计
引用可追溯
1.00
引用均指向本轮结果

同一 35 篇论文、同一 20 题,仅将原文抽取替换为大模型生成并校验引用。对照的抽取结果为 0.95 / 0.84 / 0.63 / 1.00。库外题在抽取路径下硬编,在大模型路径下拒答。

已完成事项

版本摘要

版本条件变化结果
样例打通3 篇演示文献链路可运行,不能外推
真实语料 + 原文抽取35 篇论文与新 20 题可读性差,库外题未拒答,近义排序偏弱
仅调整生成大模型与引用校验上表四项;库外题拒答;近义排序未改善
界面与文献库隐藏年份、工作稿、原页不改变检索实验口径

已知短板与下一步

  1. 阶段区分主要体现在生成结构,检索策略尚未拉开。
  2. 语义表示仍为占位方案,近义提问「服装如何讲故事」召回完整而排序偏后。
  3. 忠实度为词重叠估计,不是人工逐句审阅。
  4. 部分扫描件无文字层,部分文件的文本层本身不可用。

下一步仅更换语义表示,题集不变;随后识别中文章节,使阶段真正改变检索。启用大模型后引用可追溯若低于 0.9,或写作阶段开始输出可粘贴长段落,均视为回归。