Skip to content

PROJECT + ENGINEERING PRACTICE

PaperLoom

PaperLoom 把研究论文 PDF 建成 Reading Model。Agent 可以自主检索和阅读,每个内容声明都必须引用当前会话授权过的原文。

NOW

Qdrant 词法检索已经通过切换验收,当前工作集中在 Agent 如何选择、读取和引用已经出现的 Evidence,以及控制长研究回合的上下文增长。

查看当前问题

HOW IT READS

从 PDF 到可重新打开的证据

解析、授权范围、共享候选检索、Agent 准确读取和历史引用都能在同一条链路里核对。

  1. 01上传研究论文 PDF
  2. 02解析MinerU 与原始产物
  3. 03建模页面、章节与阅读元素
  4. 04检索Java/Qdrant 共享候选索引
  5. 05阅读Agent 读取可核验证据
  6. 06回溯重新打开持久化引用

DESIGN QUESTIONS

四个持续校验的设计问题

READING MODEL

搜索结果需要保留论文结构,不能只剩孤立文本块。

物理页、阅读顺序、表格、图片、图表与公式都进入同一个产品阅读模型。

HARNESS_PY TOOLS

模型选择研究动作,协议判断哪些内容可以成为 Evidence。

Paper、Location 和 Evidence 逐层公开,最终提交只能引用已经准确读取的内容。

PERSISTENT EVIDENCE

每条引用都保存成可以再次定位的论文位置。

回答里的 Evidence ID 会映射到持久化 Reference,历史会话也能重新打开原文。

BEHAVIOR EVALUATION

Golden Case 分开检查 Candidate、Read、Cited 与最终结果。

评估约束证据、声明、结果形态和可见轨迹,同时允许模型用不同措辞回答。

ENGINEERING EVOLUTION

理解被事实改写的过程

时间线保留改变过系统边界的故障、实验、决策和验证,不收录临时过程稿。

查看演化时间线
把产品边界收敛到研究论文

分离产品论文与评估语料,建立明确的会话来源范围。

让错误路由失败得足够明确

把语义路由与能力执行拆开,不再用检索掩盖无法识别的任务。

建立产品自己的 Reading Model

让页面、结构化元素、Location 与视觉证据共享同一份来源语义。

检索恢复后,继续修证据使用

Sparse Qdrant 固定查询达到 48/48,MiniMax 实际只读取 29/48 份所需证据。

LATEST PRACTICE

最近的工程实践

48/48 · v2 9/24 · v3 10/24Qdrant BM25 找到 48/48 份证据后,MiniMax 为什么仍只通过 9/24产品检索从 Hybrid Qdrant 切到 Sparse BM25 后,固定查询召回达到 48/48;MiniMax 实际运行有 47/48 份证据进入候选,只读取了 29/48。四个事实论文权限与索引生命周期如何收敛为四个事实上传统一进入个人空间,管理员单独发布全局论文;处理中论文不可检索,Qdrant 每篇只保留一份可重建索引。34/48Qdrant 让 76 篇论文的广查询快了 4 倍,证据排序却退化了共享预构建索引省掉了 Python Worker 的重复加载;同预算下,指定证据命中从 BM25 的 42/48 降到 34/48。

PaperLoom · Evidence-bounded Agentic RAG