纳米AI支持上传哪些文件格式
纳米AI支持54种文件格式直接上传,覆盖文字、表格、演示文稿、音视频、图像以及网页链接,基本不用额外预处理就能做深度解析。文档类内容会自动提取语义并建立向量索引,PDF扫描件则需要先经过OCR识别;目前暂不支持.pages和.rtf。表格一旦超过10万行,系统会自动采样前5000行;音视频内容主要解析音频轨道和关键帧;网页链接、书签,以及单层压缩包也都支持批量导入。

很多人真正头疼的,不是资料不够,而是资料太分散:Word报告躺在不同文件夹里,会议录音放在本地,产品图片单独存着,PDF合同又是一套,连网页收藏夹都零零散散。更省事的做法,其实是一次性把这些内容导入AI系统统一管理,而不是一个个先改格式、再逐个上传。纳米AI支持54种文件格式直接导入,覆盖文字、表格、演示、音视频、图像以及网页链接,基本不用额外预处理,AI就能直接做深度解析。
文档类文件上传支持
直接拖入或点击上传.doc、.docx、.pdf、.txt、.epub、.md等纯文本或排版型文档,系统会自动提取语义并建立向量索引。其中PDF若含扫描件图像,需依赖OCR模块识别;若为可选中文本,解析速度更快且保留原始段落结构。
注意:.pages(苹果页式文档)和.rtf暂不支持,上传后会提示“格式未识别”,请先导出为.docx再传。
表格与演示文件
方法一:Excel类文件
支持.xlsx、.xls、.csv、.ods,上传后AI可识别行列关系、公式逻辑与单元格注释,生成结构化问答结果。表格超过10万行时,系统将自动采样前5000行建模,避免内存溢出。
方法二:PPT类文件
支持.pptx、.ppt、.key(Keynote),AI不仅能提取每页文字,还能分析图表类型(柱状图/流程图/甘特图)、识别图例含义,并还原原始配色逻辑——这一步对后续生成风格一致的汇报PPT至关重要。
音视频与图像文件
① 音频文件:仅支持.mp3、.m4a、.wa v、.ogg,单文件≤200MB;上传后触发语音转写+发言人分离模型,前提是已录入参会人声纹或姓名列表。
② 视频文件:支持.mp4、.mov、.a vi、.webm,但
【仅解析音频轨道与关键帧画面】
③ 图像文件:支持.png、.jpg、.jpeg、.webp、.bmp、.tiff、.svg,其中SVG矢量图可被反向解析为路径指令,用于生成技术示意图;含二维码或条形码的图片,AI会自动识别并提取编码内容。
网页与特殊格式
第一步:粘贴网址
在知识库“添加内容”面板中选择“网页链接”,粘贴https://开头的URL,支持知乎专栏、微信公众号文章、Notion公开页、PDF在线地址等主流页面类型。
第二步:导入浏览器书签
点击“导入收藏夹”,选择Chrome/Firefox/Edge导出的.html书签文件,纳米AI会批量抓取所有链接的标题与首屏文本,生成带来源标注的知识节点。
第三步:上传压缩包
支持.zip、.7z、.rar(需内含上述任一受支持格式),系统自动解压并逐个解析——但