使用 AI 自动解析 Zotero 条目中的 PDF 附件,生成结构化分析笔记。
.xpi 文件工具 → 插件 → ⚙️ → Install Add-on From File.xpi 安装安装后在 编辑 → 设置 → Zotero AI 中配置:
| 设置项 | 说明 | 默认值 |
|---|---|---|
| API 格式 | Chat Completions、Responses 或 Anthropic Messages | Chat Completions |
| API 端点 | API 基地址,可带或不带末尾 /v1 | https://api.openai.com |
| API 密钥 | 当前服务的 API Key | — |
| 模型名称 | 刷新远端列表后选择,或输入自定义模型 ID | gpt-4o |
| 温度参数 | 输出随机性 (0–2) | 1 |
| 最大 Token | 回复长度上限 (1–128000) | 8192 |
| 并发数量 | 同时解析的条目数 (1–20) | 3 |
| 请求超时 | 单次请求最长等待秒数 (30–1800) | 300 |
| 失败重试次数 | 网络错误/429/5xx 的自动重试次数 (0–10) | 3 |
| 系统提示词 | 指导 AI 分析的指令 | (学术论文分析模板) |
| 笔记首行标注 | 是否在笔记中显示解析元信息 | 关闭 |
模型列表只在点击 刷新列表 时请求,不会在打开偏好设置时自动联网。切换 API 格式不会清空当前端点、密钥或模型;远端列表中没有当前模型时会保留为自定义模型。
Windows x64 用户无需手动填写图片提取脚本路径。XPI 内置:
extract_figures.py 提取脚本首次使用前,在 Zotero 偏好设置的 图片提取 区域点击
安装/修复运行时。插件会把内置脚本和模型复制到 Zotero 数据目录,并在
zoteroai-runtime/win-x64/ 中安装 PyTorch CPU、PyMuPDF、doclayout-yolo 等完整依赖。
可配置项:
| 设置项 | 说明 | 默认值 |
|---|---|---|
| 图片提取运行时 | 安装或修复托管的 win-x64 Python 运行时 | 手动点击 |
| Python 路径 | 可选覆盖项,通常留空以使用托管运行时 | 留空 |
| PyMuPDF 文本提取 | 按版面阅读顺序提取文本,失败自动回退索引 | 开启 |
| 启用 Vision | 是否提取图片并发送给支持视觉输入的云端模型 | 开启 / 关闭 |
| 最大提取数量 | 每篇论文最多提取多少个图表/表格/算法 | 5 |
extract_text.py 按版面阅读顺序提取(双栏论文先读左栏再读右栏),每页附带 [PAGE N] 标记供模型引用;文本为扫描件或提取失败时自动回退 Zotero 全文索引。不缓存,每次解析现提取。[[FIGURE:Fig1.png]] 标记图片位置zoteroai-runtime/assets/。zoteroai-figures/item_<条目ID>/,包含 figures.json 和裁剪图片。Fig1.png、Table1.png、Alg1.png 等,减少正文说明和图片错配。附件或笔记本身不会单独显示解析命令。正常条目即使没有 PDF 也允许进入任务, 随后会在状态窗口中显示“没有 PDF 附件”。
npm install # 安装依赖
npm start # 开发模式(热重载)
npm run build # 生产构建
npm run release # 发布
zotero-ai/
├── addon/
│ ├── bootstrap.js # 插件生命周期入口
│ ├── manifest.json # 插件清单
│ ├── prefs.js # 默认设置
│ ├── content/
│ │ ├── preferences.xhtml # 设置面板 UI
│ │ └── icons/ # 图标
│ ├── python/ # 打包进 XPI 的提取脚本和模型
│ │ ├── extract_figures.py # PDF 图表提取(DocLayout-YOLO)
│ │ └── extract_text.py # PDF 版面文本提取(PyMuPDF)
│ ├── runtime/ # 打包进 XPI 的 win-x64 最小 Python 运行时
│ └── locale/ # 中英文翻译
├── python/
│ ├── requirements.txt # 开发环境 Python 依赖
│ ├── download_model.py # 开发时下载模型
│ └── extract_figures.py # PDF 图表提取 CLI 源文件
└── src/
├── index.ts # 入口
├── addon.ts # 插件主类
├── hooks.ts # 生命周期 & 菜单 & 状态窗口
├── modules/
│ ├── aiClient.ts # 三种 API 协议、模型列表与错误适配
│ ├── aiParse.ts # AI 解析核心 + 图表提取调度 + Markdown 渲染
│ ├── textExtract.ts # PyMuPDF 文本提取调度与索引回退
│ ├── runtime.ts # 托管 Python 运行时和内置模型管理
│ └── preferenceScript.ts
└── utils/ # 工具函数
TypeScript
67.7%
Python
17.4%
PowerShell
7.3%
HTML
5.6%
Fluent
2.0%
使用 AI 自动解析 Zotero 条目中的 PDF 附件,生成结构化分析笔记。
.xpi 文件工具 → 插件 → ⚙️ → Install Add-on From File.xpi 安装安装后在 编辑 → 设置 → Zotero AI 中配置:
| 设置项 | 说明 | 默认值 |
|---|---|---|
| API 格式 | Chat Completions、Responses 或 Anthropic Messages | Chat Completions |
| API 端点 | API 基地址,可带或不带末尾 /v1 | https://api.openai.com |
| API 密钥 | 当前服务的 API Key | — |
| 模型名称 | 刷新远端列表后选择,或输入自定义模型 ID | gpt-4o |
| 温度参数 | 输出随机性 (0–2) | 1 |
| 最大 Token | 回复长度上限 (1–128000) | 8192 |
| 并发数量 | 同时解析的条目数 (1–20) | 3 |
| 请求超时 | 单次请求最长等待秒数 (30–1800) | 300 |
| 失败重试次数 | 网络错误/429/5xx 的自动重试次数 (0–10) | 3 |
| 系统提示词 | 指导 AI 分析的指令 | (学术论文分析模板) |
| 笔记首行标注 | 是否在笔记中显示解析元信息 | 关闭 |
模型列表只在点击 刷新列表 时请求,不会在打开偏好设置时自动联网。切换 API 格式不会清空当前端点、密钥或模型;远端列表中没有当前模型时会保留为自定义模型。
Windows x64 用户无需手动填写图片提取脚本路径。XPI 内置:
extract_figures.py 提取脚本首次使用前,在 Zotero 偏好设置的 图片提取 区域点击
安装/修复运行时。插件会把内置脚本和模型复制到 Zotero 数据目录,并在
zoteroai-runtime/win-x64/ 中安装 PyTorch CPU、PyMuPDF、doclayout-yolo 等完整依赖。
可配置项:
| 设置项 | 说明 | 默认值 |
|---|---|---|
| 图片提取运行时 | 安装或修复托管的 win-x64 Python 运行时 | 手动点击 |
| Python 路径 | 可选覆盖项,通常留空以使用托管运行时 | 留空 |
| PyMuPDF 文本提取 | 按版面阅读顺序提取文本,失败自动回退索引 | 开启 |
| 启用 Vision | 是否提取图片并发送给支持视觉输入的云端模型 | 开启 / 关闭 |
| 最大提取数量 | 每篇论文最多提取多少个图表/表格/算法 | 5 |
extract_text.py 按版面阅读顺序提取(双栏论文先读左栏再读右栏),每页附带 [PAGE N] 标记供模型引用;文本为扫描件或提取失败时自动回退 Zotero 全文索引。不缓存,每次解析现提取。[[FIGURE:Fig1.png]] 标记图片位置zoteroai-runtime/assets/。zoteroai-figures/item_<条目ID>/,包含 figures.json 和裁剪图片。Fig1.png、Table1.png、Alg1.png 等,减少正文说明和图片错配。附件或笔记本身不会单独显示解析命令。正常条目即使没有 PDF 也允许进入任务, 随后会在状态窗口中显示“没有 PDF 附件”。
npm install # 安装依赖
npm start # 开发模式(热重载)
npm run build # 生产构建
npm run release # 发布
zotero-ai/
├── addon/
│ ├── bootstrap.js # 插件生命周期入口
│ ├── manifest.json # 插件清单
│ ├── prefs.js # 默认设置
│ ├── content/
│ │ ├── preferences.xhtml # 设置面板 UI
│ │ └── icons/ # 图标
│ ├── python/ # 打包进 XPI 的提取脚本和模型
│ │ ├── extract_figures.py # PDF 图表提取(DocLayout-YOLO)
│ │ └── extract_text.py # PDF 版面文本提取(PyMuPDF)
│ ├── runtime/ # 打包进 XPI 的 win-x64 最小 Python 运行时
│ └── locale/ # 中英文翻译
├── python/
│ ├── requirements.txt # 开发环境 Python 依赖
│ ├── download_model.py # 开发时下载模型
│ └── extract_figures.py # PDF 图表提取 CLI 源文件
└── src/
├── index.ts # 入口
├── addon.ts # 插件主类
├── hooks.ts # 生命周期 & 菜单 & 状态窗口
├── modules/
│ ├── aiClient.ts # 三种 API 协议、模型列表与错误适配
│ ├── aiParse.ts # AI 解析核心 + 图表提取调度 + Markdown 渲染
│ ├── textExtract.ts # PyMuPDF 文本提取调度与索引回退
│ ├── runtime.ts # 托管 Python 运行时和内置模型管理
│ └── preferenceScript.ts
└── utils/ # 工具函数
TypeScript
67.7%
Python
17.4%
PowerShell
7.3%
HTML
5.6%
Fluent
2.0%