开始
先确定要读取的章节,保留表格附近的标题和说明。
选择相关章节
上传PDF,在页码选择中保留所需正文、表头和续表页。
确定提取模式
用Content extraction读取正文与表格;只整理表格时选择Table extraction。
核对阅读结构
点击Process files,检查标题归属、双栏文字顺序及跨页段落。
导出可复用内容
下载Markdown保留文本层次,或用JSON保存内容块,表格也可导出Excel。
选择相关章节
上传PDF,在页码选择中保留所需正文、表头和续表页。
确定提取模式
用Content extraction读取正文与表格;只整理表格时选择Table extraction。
核对阅读结构
点击Process files,检查标题归属、双栏文字顺序及跨页段落。
导出可复用内容
下载Markdown保留文本层次,或用JSON保存内容块,表格也可导出Excel。
PDF的视觉排版与阅读结构不完全相同,多栏和文表混排尤其容易打断内容关系。

ReadyData以内容块呈现识别结果,便于检查不同类型的信息。
解析后的内容可进入笔记和文档流程,省去从零重建正文与表格的步骤。