🔬 FileContentParse

📖 快速开始

启动服务后通过 HTTP POST 上传文件或提供 URL 进行解析。

# 启动
npm run dev

# 测试
curl http://localhost:3000/health

# 解析文件
curl -X POST http://localhost:3000/parse \
  -F "file=@document.pdf" \
  -F 'options={"output":"text"}'

📂 文件类型

📷 图片

jpgpnggifwebpbmp

通过 LLM 对图片进行语义描述与内容提取,支持多格式输出。

texthtmljson
📋 入参说明
参数取值默认说明
detailextractdescribe设为 extract 仅提取文字,不描述画面
📦 响应结构
datameta
LLM 返回文本llmModel, llmProvider, width, height, format

📄 Word

docx

支持标题、段落、列表结构的文本提取。

text
📋 入参说明
无专用参数
📦 响应结构
datameta
纯文本(无)

📑 PDF

pdf

逐页提取文本,支持元数据。

text
📋 入参说明
无专用参数
📦 响应结构
datameta
逐页拼合文本pages, title, author

📊 PPT

pptx

按幻灯片提取文本。

text
📋 入参说明
无专用参数
📦 响应结构
datameta
[Slide N] 逐页文本slides

📈 Excel

xlsxxlscsv

多 Sheet 解析。

text
📋 入参说明
无专用参数
📦 响应结构
datameta
[Sheet名] + CSVsheets

📝 Markdown

mdmarkdown

支持 frontmatter 元数据提取,去标记渲染为纯文本。

text
📋 入参说明
无专用参数
📦 响应结构
datameta
纯文本(去标记)frontmatter

🔤 文本 / 源码

txtjstspyjsonyaml更多

未匹配专用解析器的文件自动走 Fallback 兜底,按 UTF-8 文本读取。

text
📋 入参说明
无专用参数,始终返回 text
📦 响应结构
模式datameta
textUTF-8 文件内容characters

🎵 音频

mp3wavflacaacoggm4a

通过 LLM 转录音频内容,元数据附加在响应 meta 中。

text
📋 入参说明
无专用参数,通过环境变量或面板 LLM 配置
📦 响应结构
datameta
LLM 转录内容llmModel, llmProvider, duration, sampleRate, codec

🎬 视频

mp4avimovmkvwebm

通过 LLM 分析视频内容,元数据附加在响应 meta 中。

text
📋 入参说明
无专用参数,通过环境变量或面板 LLM 配置
📦 响应结构
datameta
LLM 分析内容llmModel, llmProvider, duration, width, height, fps
🔬

选择文件类型 → 选择文件 → 点击解析

📦

添加文件 ID 和 URL → 点击提交