Skip to content

支持的输入类型

版本相关Verified with 以当前仓库实现为准
类型当前处理方式备注
PDF原生查看、选择与摘取适合保留页码来源
图片作为图片材料节点导入可从 PDF 区域摘出
HTML / HTM清除脚本并提取可读内容类幻灯片 HTML 可按页识别
网页 URL获取成功时建立带时间戳的快照动态页面可能提取不完整
纯文本 / Markdown / 代码作为文本材料读取受文件大小限制
JSON / CSV / YAML 等文本数据作为文本读取不会自动执行统计分析
.docx在本地提取文字复杂排版可能简化
.ppt / .pptx / Keynote / ODP暂不直接解析请先导出为 PDF 或 HTML
旧版 .doc 与电子表格暂不直接解析请先导出为受支持的文本、PDF 或 HTML

支持解析不代表每份文件都能得到完整文字。扫描 PDF 可能需要文字识别,依赖脚本渲染的网页也可能只提取到部分内容。

ThoughtDAG 以 MIT License 开源。