PDF 原文阅读
Original PDF Viewer
高保真渲染 PDF 原文,保留版式、图表与公式。支持选词高亮、跨页滚动、缩放与页面跳转。所有原文内容皆可被选中和复制,作为后续提问与笔记的源头。
让 AI 帮你真正读懂一篇医学文献。
五面板协同 · 六维度结构化分析 · 深度问答
“Turning dense medical PDFs into a navigable, conversational, and critique-ready knowledge base.”
↓ Scroll to read the prospectus · 向下滚动阅读项目说明书
Curated by Biorhythm · 行止集
医学研究的速度从未放缓。PubMed 每天新增的文献数以千计,每一篇都试图改写某个细分领域的认知边界。然而对研究者而言,"读文献"这件事却依然停留在二十年前的范式里——下载 PDF、翻页浏览、做笔记、查词典、回头核对方法、再翻到讨论寻找局限性。一篇三十页的论文,常常需要一个下午才能勉强"读完",却未必"读透"。
MedReader Agent 想要做的事很简单:让 AI 不只是"摘要"文献,而是真正与读者一起逐段精读、结构化拆解、随时质疑。我们设计了一个五面板协同工作区——左侧是 PDF 原文,中间是结构化解析与思维导图,右侧是 Agent 问答,下方是全文框架与段落导航。所有面板互相联动:在框架里点一个章节,原文自动滚到对应位置;在原文选中一段文字,Agent 立刻可以基于这段上下文回答问题。
更进一步,我们让 Agent 基于论文的六个核心维度——科学问题、论证思路、实验方法与结果、论证逻辑解析、创新性、局限性——主动生成结构化分析。这不是简单的"摘要"或"翻译",而是接近同行评议深度的二次解读。研究者拿到的不再是一份文本,而是一份可对话、可质疑、可引用的知识工件。
文献阅读不应是一场单方面的劳作,而应是一次与作者、与 AI、与自己的三方对谈。
段落级精读 + 结构化拆解,让每一句话都能被追问。
Agent 基于原文上下文回答,所有论断可溯源到段落。
六维度分析内置「局限性」维度,鼓励批判性阅读。
Editorial · By the MedReader Agent project
First published online · July 2026
不是五个独立的工具,而是一个连贯的阅读流:从原文到解析、从解析到导图、从导图到提问、从提问回到原文。 — Five panels, one conversation.
Original PDF Viewer
高保真渲染 PDF 原文,保留版式、图表与公式。支持选词高亮、跨页滚动、缩放与页面跳转。所有原文内容皆可被选中和复制,作为后续提问与笔记的源头。
Structured Markdown
MinerU Cloud 将 PDF 转换为结构化 Markdown:标题、段落、公式、表格、图片分块呈现。每一块都可点击、可复制、可作为提问上下文。
Mind Map
基于标题层级自动生成可交互思维导图,论文骨架一目了然。支持节点展开折叠、点击跳转原文、Dagre 自动布局。
Conversational Agent
DeepSeek 大模型驱动的对话面板。支持选中文本提问、附图提问、整篇追问。所有回答可溯源到原文段落,避免幻觉。
Outline & Navigation
AI 基于正文上下文自动识别章节结构(区分正文与期刊样板),生成可折叠的全文框架。下方段落导航按颜色区分章节,点击即可在原文中跳转高亮。
点击章节标题,左侧 PDF 自动滚动到对应位置并高亮。
在 PDF 选中任意文字,右侧 Agent 即刻以该段为上下文回答。
导图节点点击后,中间解析面板跳转到对应章节。
Agent 主动从六个核心维度对论文进行结构化分析——不是简单摘要,而是接近审稿深度的二次解读。每个维度都附带关键追问,便于读者带着问题回到原文。
这篇论文究竟想回答什么问题?问题从何而来?是否足够新颖、足够重要?
“What is being asked, and why does it matter?”
作者用什么样的逻辑链来回答问题?从前提到结论有几步?哪些步骤是关键假设?
“How does the author chain evidence to claim?”
用了什么实验/计算方法?数据规模、对照设置、统计检验是否合理?关键结果有哪些?
“What was done, and what was found?”
结果是否真的支持结论?是否存在过度推断、混淆变量、循环论证?反例与替代解释是什么?
“Do the results truly entail the claims?”
相比已有工作,新在哪里——是问题新、方法新、还是证据新?创新程度是渐进式还是范式级?
“What is genuinely new here?”
样本、方法、推广性、可重复性方面的局限是什么?哪些下一步工作能弥补这些不足?
“Where does this work stop short?”
六维度分析由 Agent 基于论文正文自动生成,分析结果嵌入"全文框架"面板, 每条分析都可点击跳转到原文对应段落,便于读者复核与质疑。
分析过程基于 MinerU 解析后的结构化正文,而非原始 PDF 文本层。 标题层级、表格、公式、图表说明均被作为上下文传入,避免幻觉与断章取义。
上传后约 30–90 秒内完成解析与结构化分析。之后所有阅读、提问、导航均在本地浏览器内进行, 响应即时。
Step I · Upload
用户上传医学文献 PDF。系统自动建立独立工作目录,按论文 ID 隔离图片与解析产物。
Step II · Parse
调用 MinerU Cloud API 将 PDF 转换为结构化 Markdown:识别标题层级、公式、表格、图片、参考文献。
Step III · Analyze
DeepSeek 基于正文 8000 字符上下文识别章节结构,生成全文框架;并按六维度主动产出分析。
Step IV · Converse
用户在五面板工作区中阅读:选段提问、跳转章节、查看导图、回看原文。所有交互双向联动。
全栈 TypeScript + 现代 React。解析能力依托 MinerU Cloud,推理能力依托 DeepSeek, 所有数据沉淀在本地 SQLite,便于长期累积个人文献库。
“From a flat PDF to a conversational knowledge artifact — in one pass.”
Deployable via Docker Compose · runs on a single Aliyun ECS instance
Landing 公开门面页与 App 工作区物理分离 —— 前者不需要登录、面向 GitHub 引流与社交分享,后者受 Next.js middleware 全量保护。两个 区域可以独立部署、独立扩容、独立迭代。
三阶段(deps → builder → runner)构建,runner 仅含 standalone 产物 + Prisma 客户端 + tini PID 1。镜像体积从全量 node_modules 的 1.2 GB 压缩到约 180 MB,冷启动 < 5 秒。
显式锁 @prisma/client@6.11.1。 v7 引入 breaking change —— schema 中 url 字段 不再支持,会直接破坏现有 SQLite 数据源配置。锁版是务实的工程妥协。
全栈容器化部署到阿里云 ECS。Docker Compose 一键拉起,Prisma db push 自动迁移,standalone server.js 直出端口 3000。 没有 Kubernetes,没有 Service Mesh,没有过度工程。
“A single VPS, a single container, a single command: bash deploy.sh.”
Docker Compose · tini PID 1 · healthcheck on /
| 版本 | 时间 | 访问形式 | 说明 |
|---|---|---|---|
| v2.0 | 当前 · 已交付 | http://<your-ecs-ip>:3000 | IP + 端口直连 Docker 容器,无域名无 HTTPS。适合内部测试与冒烟验收。 |
| v2.1 | 近期 · 1-2 周 | https://medreader.example.com | 域名 + Caddy 反向代理 + Let's Encrypt 自动签发 HTTPS 证书。Caddy 监听 80/443,反代到 127.0.0.1:3000。 |
| v2.2 | 中期 · 1-2 月 | https://app.medreader.example.com · https://medreader.example.com | 子域名分别绑定 —— 根域展示 landing 宣传页,app 子域承载工作区。物理隔离两套部署,可独立扩容。 |
Caddyfile 三行配置反代 + 自动 HTTPS · 详见仓库 README
View deploy.sh on GitHub ↗v1.0 与 v2.0 已交付,是一个可单机可生产部署的 AI 文献阅读 Agent。 接下来三个版本将依次解决域名独立、协作、知识图谱与综述生成, 最终让 MedReader 成为研究者的长期科研伙伴。
“Roadmaps are hypotheses, not promises.” — adjusted every sprint.
Track milestones on GitHub ↗从入门一个新课题,到撰写自己的论文;从准备一次组会,到审一篇同行评议—— MedReader Agent 都能成为你的第二位阅读伙伴。
Literature Review
进入新课题时,快速建立领域地图。用思维导图扫读十篇综述,用 Agent 提问锁定核心争论,用全文框架对比方法论差异。
Paper Writing
在 Introduction 与 Discussion 之间反复横跳时,用六维度分析提醒自己「局限性」是否被诚实陈述;用 Agent 帮你重写一段更紧凑的论述。
Teaching Aid
准备组会汇报或课程讲义时,把核心论文上传到 MedReader,导出思维导图作为讲义骨架,用 Agent 提前演练可能被学生问到的问题。
Journal Club
每周组会精读一篇文献,把 PDF 上传后让 Agent 提前帮你生成「科学问题—方法—结果—局限」四段式摘要,汇报时按框架展开。
Review Synthesis
撰写综述时累积数十篇文献的结构化分析,按主题聚类对比「科学问题」与「创新性」维度,找出研究空白与潜在切入点。
Peer Review
审稿时用六维度框架逐项核对——尤其是「论证逻辑解析」与「局限性」——确保自己没有遗漏作者回避的关键问题。
MedReader Agent 已开放源代码,可在你的服务器上一键部署。
Open source · Self-hostable · Built for medical researchers.