NexusRead:链接消化引擎

NexusRead 将网页、Hacker News、抖音、X、YouTube 等来源的链接自动抓取、转写并生成摘要,本地归档为两级阅读深度的资料库。

NexusRead 是一个链接消化引擎。用户提交链接,来源支持网页、Hacker News、抖音、X 和 YouTube。系统自动执行抓取、转写和摘要,结果本地归档。阅读时提供两级深度:扫读模式输出摘要,约 30 秒;精读模式提供全文或逐字稿,支持划线标注,约 3 分钟。

设计决策#

数据本地存储。 数据目录包含 SQLite 数据库、媒体文件、处理产物和备份。目录整体复制即完成迁移。发布版本为独立目录,复制到 Windows 10/11 系统即可运行,不依赖 Python 环境;系统检测 WebView2 缺失并提示安装。

划线作为核心功能。 用户选中正文或逐字稿段落即完成标注。划线支持页签跳转,导出 Markdown 时单独输出"我的划线"部分。阅读过程产生的标注保留在归档中。

模型调用设有限制。 转写和摘要使用 LLM。系统对 LLM 调用设置重试上限,供应商通过环境变量配置,可自由替换。LLM 服务不可用时,抓取和归档功能正常运行,摘要任务在服务恢复后补跑。

宽来源覆盖。 抖音和 X 页面的抓取难度高于普通网页,系统将其列入首批支持。依据是:待读清单中被放弃比例最高的内容类型是视频和推文串。

当前状态#

截至 2026-09-29,版本 v0.1 完成,包含批量修复和高亮划线功能,测试套件 185 项全部通过。系统在日常使用中。

方法论结论#

本项目与格物(前一篇文章)共享同一架构原则:模型只承担转写、摘要、意图解析等生成类任务;状态管理、数据存储和失败兜底由确定性代码承担。模型提升效率,系统保证数据正确。