📖 快速开始
启动服务后通过 HTTP POST 上传文件或提供 URL 进行解析。
# 启动
npm run dev
# 测试
curl http://localhost:3000/health
# 解析文件
curl -X POST http://localhost:3000/parse \
-F "file=@document.pdf" \
-F 'options={"output":"text"}'
📂 文件类型
📷 图片
通过 LLM 对图片进行语义描述与内容提取,支持多格式输出。
texthtmljson📋 入参说明
| 参数 | 取值 | 默认 | 说明 |
|---|---|---|---|
detail | extract | describe | 设为 extract 仅提取文字,不描述画面 |
📦 响应结构
data | meta |
|---|---|
| LLM 返回文本 | llmModel, llmProvider, width, height, format |
📄 Word
支持标题、段落、列表结构的文本提取。
text📋 入参说明
| 无专用参数 |
|---|
📦 响应结构
data | meta |
|---|---|
| 纯文本 | (无) |
逐页提取文本,支持元数据。
text📋 入参说明
| 无专用参数 |
|---|
📦 响应结构
data | meta |
|---|---|
| 逐页拼合文本 | pages, title, author |
📊 PPT
按幻灯片提取文本。
text📋 入参说明
| 无专用参数 |
|---|
📦 响应结构
data | meta |
|---|---|
[Slide N] 逐页文本 | slides |
📈 Excel
多 Sheet 解析。
text📋 入参说明
| 无专用参数 |
|---|
📦 响应结构
data | meta |
|---|---|
[Sheet名] + CSV | sheets |
📝 Markdown
支持 frontmatter 元数据提取,去标记渲染为纯文本。
text📋 入参说明
| 无专用参数 |
|---|
📦 响应结构
data | meta |
|---|---|
| 纯文本(去标记) | frontmatter |
🔤 文本 / 源码
未匹配专用解析器的文件自动走 Fallback 兜底,按 UTF-8 文本读取。
text📋 入参说明
| 无专用参数,始终返回 text |
|---|
📦 响应结构
| 模式 | data | meta |
|---|---|---|
| text | UTF-8 文件内容 | characters |
🎵 音频
通过 LLM 转录音频内容,元数据附加在响应 meta 中。
text📋 入参说明
| 无专用参数,通过环境变量或面板 LLM 配置 |
|---|
📦 响应结构
data | meta |
|---|---|
| LLM 转录内容 | llmModel, llmProvider, duration, sampleRate, codec |
🎬 视频
通过 LLM 分析视频内容,元数据附加在响应 meta 中。
text📋 入参说明
| 无专用参数,通过环境变量或面板 LLM 配置 |
|---|
📦 响应结构
data | meta |
|---|---|
| LLM 分析内容 | llmModel, llmProvider, duration, width, height, fps |