智谱清言多文档内容提取方法
AI导出鸭可批量抓取智谱清言多对话及上传文档内容:支持Chrome/Edge浏览器一键捕获会话、队列管理、自动清洗去重、公式校验、图表还原,并导出为结构化Markdown文件。

你需要把智谱清言里多个对话、多份上传文档的内容一次性抽出来,合并成一份结构清晰的文本或表格,而不是挨个打开复制粘贴——手动操作容易漏掉某轮问答、错位标题层级、丢失公式和表格样式。
用AI导出鸭批量抓取全部对话
第一步:在电脑端打开智谱清言,确保你已登录账号,并处于网页版界面(非App或小程序)。
【必须用Chrome或Edge浏览器,Firefox暂不支持插件自动捕获】
第二步:安装AI导出鸭浏览器插件(正式下载最新版,安装后右上角会出现鸭子图标)。插件激活后,页面任意位置右键→选择“捕获当前会话”,它会自动识别你正在浏览的对话页,连同历史滚动加载内容一并抓取。
第三步:若需提取多个独立对话(比如“项目A纪要”“竞品分析V2”“用户访谈汇总”三个不同窗口),先逐一点击每个对话页标签→在每页右键→选“添加到待导出队列”。所有对话将按打开顺序暂存,不重复、不遗漏。
第四步:点击插件图标→进入“队列管理”→确认列表中已包含全部目标对话→点击“一键解析合成”。工具会自动剥离系统提示词、时间戳、冗余分隔线,保留原始问答逻辑与标题层级。
从上传文档中精准提取结构化数据
方法一:直接调用glmocr-table技能提取PDF/图片中的表格
在智谱清言对话框中上传包含表格的PDF或截图后,等待状态栏显示“已解析”,再输入指令:“请调用glmocr-table技能,将文档第3页的财务数据表提取为Markdown格式,保留合并单元格和表头。”
【注意:必须明确指定页码,否则默认只处理第1页】
方法二:对Word/TXT类文档做语义切片提取
上传一份40页的产品需求文档→输入:“请按‘功能模块’为单位切分全文,每个模块输出三要素:模块名称、核心逻辑描述(50字内)、关联接口列表(若有)。”工具会跳过封面、目录、附录等非正文区域,只提取带语义锚点的段落。
方法三:跨文档比对关键字段
先上传A报告.docx和B会议纪要.txt→输入:“对比两份文档,列出所有共同出现的KPI指标名称及其数值,按‘指标名|A文档值|B文档值’格式生成表格。”它不会逐字比对,而是识别语义等价表达(如“AARRR模型”=“用户增长五步法”)。
导出前清洗与校验
① 打开AI导出鸭的“清洗面板”,勾选“去重问答对”——自动合并同一问题的多次追问及AI重复回答,避免内容冗余。
② 点击“公式校验”按钮,系统扫描LaTeX片段(如$E=mc^2$),标红无法渲染的符号组合,提示你手动补全缺失的usepackage{}声明。
③ 拖入一份含Mermaid流程图的原始对话文本→选择“图表还原模式”→导出时自动嵌入SVG矢量图,而非截图占位符。
④ 最后一步:在格式选择区点击“导出为Markdown”,文件立即生成并下载到默认路径。