MinerU OCR 到 MDX 导入
MinerU OCR 到 MDX 导入
Section titled “MinerU OCR 到 MDX 导入”将纸质或 PDF 教材通过 MinerU OCR 识别转换为 AstroLib 规范的 MDX 章节,须遵循 import-book 工作流标准。
导入操作标准流程
Section titled “导入操作标准流程”-
OCR 识别产物准备: 将 MinerU OCR 识别产物目录(形如
<书名>.pdf-<hash>/,内含full.md及关联图片)存放至根目录task/路径下。 -
章节拆分与归载:
- 依据卷、章、节目录树将
full.md拆分为独立的 MDX 文件。 - 文件采用规范命名,如
1.1-章节标题.mdx,确保自然的编号排序。
- 依据卷、章、节目录树将
-
保存至目标 Collections 目录: 目标文件路径标准为:
src/content/docs/collections/<collection-slug>/<book-slug>/。 -
语义化卡片组件封装: 将文本中的例题、练习、知识点段落转换为
<Example>、<Knowledge>、<Solution>等结构化卡片包覆。 -
注册中央图书配置: 在
src/config/collections.config.mjs中添加该图书信息(包含 slug、title、author、entryPoint 等属性)。 -
校验: 运行
node scripts/scan-mdx.mjs src/content/docs/collections/<collection-slug>/<book-slug>确认编译通过。
模块索引
书籍模块索引
正在扫描全书模块结构...
解析章节卡片并构建索引
本书智能问答
针对本书提问
默认基于本书知识片段生成答案并可跳转原文溯源;在设置中选择「深度讨论」则 AI 不默认检索,基于理解深入讨论、需要原文时按需查书。
Enter 发送 · Shift+Enter 换行
设置
「检索本书」总是把命中的 topK 片段注入答案;「深度讨论」不注入片段,AI 基于理解与上文深入讲解,需要原文时才按需调用检索工具。
模型、API Key 与端点仅保存在本机浏览器 localStorage,与全站偏好设置和习题推导统一实时同步。
历史会话
暂无历史
新高考数学你真的掌握了吗(第二版) · 章节内联关系图谱
0 章节0 跨章引用0 关联边
正在分析并生成全书章节关系拓扑...
核心知识枢纽章节
被全书其他章节引用频次最高的基石章节:
图谱交互提示
- 视角放大/缩小:使用左下角工具栏 +/- 或鼠标滚轮;
- 大书防混淆:顶部选择“按篇章/大章聚合”或“聚焦当前章”;
- 视图平移与拖拽:拖动画布或节点;双击节点直达原文。
界面显示偏好
关闭后按钮隐藏,您随时可按 Alt+G 或在此开启。