支持的输入类型
| 类型 | 当前处理方式 | 备注 |
|---|---|---|
| 原生查看、选择与摘取 | 适合保留页码来源 | |
| 图片 | 作为图片材料节点导入 | 可从 PDF 区域摘出 |
| HTML / HTM | 清除脚本并提取可读内容 | 类幻灯片 HTML 可按页识别 |
| 网页 URL | 获取成功时建立带时间戳的快照 | 动态页面可能提取不完整 |
| 纯文本 / Markdown / 代码 | 作为文本材料读取 | 受文件大小限制 |
| JSON / CSV / YAML 等文本数据 | 作为文本读取 | 不会自动执行统计分析 |
.docx | 在本地提取文字 | 复杂排版可能简化 |
.ppt / .pptx / Keynote / ODP | 暂不直接解析 | 请先导出为 PDF 或 HTML |
旧版 .doc 与电子表格 | 暂不直接解析 | 请先导出为受支持的文本、PDF 或 HTML |
支持解析不代表每份文件都能得到完整文字。扫描 PDF 可能需要文字识别,依赖脚本渲染的网页也可能只提取到部分内容。