一聚教程网:一个值得你收藏的教程网站

最新下载

热门教程

seerai:实践指南

时间:2026-10-07 09:24:01 编辑:袖梨 来源:一聚教程网

准备试用seerai之前,先别急着安装;这个项目提供的是Zotero AI 插件 Zotero 10 的研究助理,与您的图书馆聊天、运行联合学术搜索、RAG、OCR、系统评论以及管理云存储。把它放到研究与论文处理流程中,最容易暴露的是来源证据、引用和结论容易脱节,不能只看演示是否顺利。试跑可以从拿一篇熟悉的论文或研究问题跑完整流程开始,并把证据定位、引用准确性和结论可复核性写进验收记录。对需要整理研究证据并愿意复核原文的读者来说,这个仓库值得继续验证;只求即装即用的人则要先看维护成本。

dralkh/seerai 项目截图 1

seerai — Zotero 的 AI 研究助理插件

seerai 是 Zotero 9/10 的智能研究助理插件,它将 AI- 支持的聊天、高级搜索、结构化数据提取和系统评审工作流程直接集成到您的研究工作流程中。与您的论文聊天,提取结构化数据,运行 PRISMA- 风格的评论,并通过本地优先、注重隐私的设计加速您的文献评论。

安装

来自GitHub(推荐)

  1. 从 版本 下载最新版本(.xpi 文件)。
  2. 在 Zotero 中,转到工具 → 附加组件。
  3. 单击齿轮图标 ⚙ 并选择 从文件安装附加组件...。
  4. 选择下载的.xpi文件。
  5. 重新启动佐特罗。

从源头

# Clone the repository
git clone https://github.com/dralkh/seerai.git
cd seerai

# Install dependencies
npm install

# Build the plugin
npm run build

# 根目录下会生成.xpi文件

特点

AI-Powered 聊天界面

  • 情境对话:与 AI 就您所选的论文进行全面的情境感知聊天。
  • 智能上下文优先级:自动确定内容源的优先级:
    1. Zotero 注释(OCR 注释,以及其他最高优先级的注释)
    2. 索引PDF文本(快速、高效,但消耗大量代币并可能导致限制问题)
    3. OCR(没有索引文本的扫描文档的后备)
  • 多论文支持:将多篇论文添加到单个对话中以进行比较分析。
  • 流式响应:实时、逐个令牌响应呈现。
  • Markdown 和数学:响应采用语法突出显示和 LaTeX 数学支持进行格式化。
  • 视觉支持:将图像直接粘贴到聊天中以进行多模式分析。
  • 多模式生成:直接从聊天生成图像、视频、语音转文本和文本转语音。
  • 附件上传:通过上下文菜单将文件添加到对话中。
  • 互动跟进:通过直播跟进问题加深对话。
  • 可配置的引用:为 AI 见解和聊天选择您喜欢的引用样式。
  • 智能复制:直接从聊天气泡中选择并复制保留格式(Markdown)的文本。
  • 增强的按键绑定:
    • Enter:插入新行
    • Shift+Enter:发送消息
    • Ctrl+Shift+S:Toggle/Focus 可拆卸窗户
  • 可拆卸窗口:将 seerai 界面弹出到独立的可调整大小的浮动窗口中,以便在浏览图书馆时保持聊天访问。
  • 主题 UI:增强的对话框和组件,具有完整的主题支持,可在 Zotero 的浅色和深色模式中保持一致的外观。
  • 响应式布局:聊天、表格和搜索选项卡动态适应面板宽度变化。

语义搜索与发现

  • RAG(检索增强生成):针对大型文档的基于上下文的嵌入,具有分块、向量存储和语义检索。父项目(书籍)和直接选择的 PDF 附件的索引和检索方式相同。
  • 批量向量索引:从首选项→向量索引(Index Current Collection、Index Entire Library、Index Selected Items)或右键单击→智能上下文索引为整个集合或库预构建嵌入,具有进度、取消和自动跳过最新项目的功能。
  • 网页搜索:集成 Firecrawl、Tavily 和 You.com 支持查找高质量全文内容。
  • 联合学术搜索:同时搜索 11 个提供商 — Semantic Scholar、arXiv、PubMed、bioRxiv、medRxiv、IACR、欧洲 PMC、 CORE、BASE、Zenodo 和 HAL — 具有跨源重复数据删除和等级融合。
    • 智能模式:一键式预设(广泛、生物医学、预印本、密码学、存储库)针对正确的提供者集,或手动选择来源。
    • AI 查询细化:AI 步骤一次提取您的概念和同义词,然后将它们编译到每个提供商的本机查询语法中 - 因此您无需学习 11 种查询方言即可获得精确的结果。
    • 高级过滤器:按年份、地点和引用计数微调结果。
    • AI 见解配置:直接从搜索面板配置见解生成。
    • 导出:将结果导出到BibTeX或CSV。
  • 智能导入:
    • 联合导入:使用提供商 IDs、DOI、PMID/PMCID 从 Semantic Scholar、arXiv、PubMed、欧洲 PMC、存储库和预印本源导入论文, URLs,或搜索结果。
    • 快速代理导入:一旦创建或重用 Zotero 项目,代理导入就会返回,然后在后台对 PDF 发现进行排队。
    • PDF 发现:在导入期间自动查找并附加 PDFs,具有有限的后台并发性。
    • 可配置的导入 OCR:默认情况下启用自动 OCR 导入,并且可以在聊天设置中禁用以完全跳过 OCR。
    • 源链接:如果 PDFs 不可用,则回退到源链接。
    • 状态指示器:有关导入状态的清晰反馈(⬇导入,✅导入,⚠失败)。
  • 全球搜索范围:搜索现在扩展到所有图书馆,包括个人和团体馆藏。
  • 高级布尔搜索:对嵌套逻辑 (AND/OR/NOT)、隐式短语和 markdown 感知匹配的强大支持。
  • 智能正则表达式匹配:通过智能处理单词边界和特殊字符来提高搜索精度。

代理聊天和工具使用

  • 自主代理:AI 可以使用工具与您的 Zotero 库、网络和工作区进行交互。
  • 研究模式:You.com 用于多源答案合成的研究模式。
  • 丰富的工具套件:
    • 搜索工具:使用高级过滤器搜索您的图书馆。
    • 收藏工具:管理收藏和移动项目。
    • 笔记工具:阅读、创建和编辑现有项目笔记以实现无缝研究更新。
    • 标签工具:自动生成相关标签并将其应用到您的研究中。
    • 阅读工具:从PDFs中提取文本和项目进行深入分析。
    • 引文工具:生成引文和参考书目。
    • 表格工具:与纸质表格交互并生成数据。
    • 网络工具:使用 Firecrawl、Tavily 或 You.com 搜索网络并获取内容。
    • 工作区工具:直接在工作区中创建、读取、编辑和删除文件。
    • 待办事项工具:为复杂的多步骤研究工作流程创建和管理任务列表。
    • 技能工具:从包含约 148 种座席技能的捆绑库中发现并加载按需指令。
    • 系统审查工具:通过聊天创建和更新审查方案、来源和筛选决策。
  • 代理技能库:代理仅在相关时加载的自包含技能包(科学计算、生物信息学、文档生成、搜索等)的精选库 - 源自 K-Dense-AI/scientific-agent-skills。添加您自己的捆绑技能、工作区技能或自定义技能。
  • 工具活动通知:内联状态指示器显示代理何时调用工具、运行工作区命令或等待外部结果。
  • 任务完成信号:代理明确发出完成信号以实现干净的多步骤工作流程。
  • 高级编排:通过工具过滤、迭代跟踪和可观察性跟踪改进了工具调用逻辑。
  • 模型即工具:与 LLM 工具调用功能无缝集成。

论文表

  • 结构化提取:从多篇论文中提取特定数据点到比较表中。
  • AI-Powered Columns:使用 AI 提示定义自定义列(e.g.、“方法”、“样本大小”)。
  • 内联编辑:用于列标题和提示的创新内联编辑器。
  • 一键生成:立即生成单个单元格或整个列的数据。
  • 批量操作:重新生成内容或将选定的论文批量添加到集合中。
  • 侧边栏操作:用于添加、删除列、生成触发器和设置的统一控件。

系统审查

直接内置于 Zotero 中的端到端系统审核工作流程:

  • 协议生成器:定义您的研究问题并选择结构化框架 - PICO、PICOS、PICOT、PICOTS、PICOTT、PECO、PICo、 PEO、SPIDER、SPICE 或 PCC。
  • 资格标准:AI- 协助 inclusion/exclusion 规则提供关键字帮助、基本原理和完整的修订历史记录。
  • 搜索策略:将审查范围的策略编译为每个学术来源的本机查询,或使用 AI 对其进行细化并将其直接推入搜索输入。
  • 来源:从 Zotero 收藏中导入论文作为评论来源;跟踪每个源的计数、重叠和重复数据删除。
  • PRISMA 流程图:可视化 title/abstract → 全文 → 带实时计数的最终筛选流程。
  • 筛选:Title/abstract 和全文筛选,包括 include/exclude/maybe 决策、原因、置信度分数和 AI 建议。
  • 数据提取:AI-支持的结构化提取,具有可定制的模板、结果、效果测量(OR、RR、HR、MD、SMD)、置信区间、时间点和建议→验证→拒绝工作流程。
  • 证据合成:随机效应和共效应荟萃分析、森林图、I²异质性和汇总效应大小。
  • 差距分析:AI-生成研究差距识别和严重性评分。
  • 提取健康检查:针对缺失效应大小、缺失 CIs、缺失时间点、负方差、极端效应大小、低样本量和潜在重复提取的自动警告。
  • 审查导出:导出系统审查数据和综合输出以进行报告和下游分析。
  • 异步作业:在后台运行提取和分析作业,并进行进度跟踪和取消。

工作区和文件管理

  • 内置文件工作区:您和您的 AI 代理可以访问的持久文件系统工作区。
  • 文件树导航:带有完整文件树的侧边栏,用于浏览、创建和组织文件和文件夹。
  • 代码编辑器:内置摩纳哥风格的编辑器,具有语法突出显示、行号和自动保存功能。
  • Git 集成:直接在工作区中初始化存储库、阶段更改、提交和查看差异。
  • 差异查看器:用于查看文件更改的并排或统一差异视图。
  • 文件查看器:渲染工作区文件,并在多种格式中突出显示语法。
  • DOCX 转换器:转换文档 to/from DOCX 格式,以便与文字处理器进行互操作。
  • 自定义工作空间路径:为工作空间文件配置自定义目录。

云存储集成

  • 多提供商支持:连接到 Google Drive、Dropbox、Box、OneDrive 或 Nextcloud。
  • OAuth 2.0 + PKCE:适用于所有云提供商的安全身份验证流程。
  • 云驱动选项卡:直接在 Zotero 中浏览、搜索和管理云文件。
  • 云上下文:将云存储的文件作为上下文包含在 AI 对话中。
  • 文件同步:在工作区和云存储之间无缝上传和下载文件。

OCR & 文本提取

  • 灵活的 OCR 选项:
    • Mistral OCR:高质量云 OCR(推荐)。
    • DataLab.to:可靠的基于云的提取。
    • 本地标记:运行您自己的本地 OCR 服务器进行免费、私人处理。
  • 自动处理:在需要时自动处理未索引的 PDFs。

可定制AI

  • 持久 API 密钥:API 密钥在所有配置的提供程序中保存并保留。

  • 模型预设:流行提供商的预配置设置:

    • OpenAI,人类,谷歌,xAI
    • DeepSeek、米斯特拉尔、Groq、在一起、烟花、Cohere、OpenRouter
    • 本地模型(Openai 兼容端点)
      • 4-8g 内存 - Qwen3.5 2B / Qwen3.5 4B
      • 12-16g 内存 - Qwen3.5 9B / Gemma 4 12B
      • 24-32g 内存 - Qwen3.6 27B / Qwen3.6 35B A3B / Gemma 4 31B / Gemma 4 26B A4B
      • 48-96g Vram - Qwen3.5 122B A10B / Mistral Medium 3.5 / NVIDIA Nemotron 3 Super /
      • 128g 内存 - MiniMax-M3 / MiMo-V2.5-Pro / GLM-5.2 / Kimi K2.6 / DeepSeek V4 Pro / Nemotron 3 Ultra / Qwen3.5 397B A17B / DeepSeek-V4-Flash
  • 本地 CLI 代理:通过您已安装并登录的 CLI 路由聊天 - Codex、Claude Code、反重力 (agy)、Hermes (Nous)、OpenClaw 或 光标代理 (cursor-agent)。 seerai 不存储凭证;它重用了 CLI 自己的会话。二进制文件直接从磁盘解析(Homebrew、npm/yarn/bun、nvm/fnm/mise/asdf/n),因此即使从 GUI 启动 Zotero 也能找到它们。

  • CLI MCP Harness:本地 CLI 代理可以选择连接到捆绑的 seerai MCP 服务器,以便他们可以在您聊天时读取您的 Zotero 库并对其进行操作。

  • 基于功能的路由:为每个功能分配单独的模型 - 聊天、嵌入、图像、视频、文本到语音和语音到文本 - 并将每个请求自动路由到正确的端点。

  • 智能速率限制:针对并发、RPM 和 TPM 的每个模型配置,以防止提供程序错误。

  • 每个对话模型:根据任务复杂性动态切换模型。

配置

转到 Zotero → 设置 → seerai 配置您的 AI 提供商和服务。

1. AI型号

使用 添加配置 按钮设置您的 AI 模型。

  • 预设:从内置预设(OpenAI、Anthropic、Ollama 等)中进行选择以进行快速设置。
  • 自定义:为任何 OpenAI-compatible 提供商手动配置 API URL、密钥和型号 ID。
  • 默认:将首选模型设置为新对话的默认模型。

2. OCR服务

选择您喜欢的文本提取引擎:

  • Mistral OCR:需要 Mistral API 密钥。最适合准确性。
  • 云 (DataLab.to):需要 DataLab API 密钥。
  • 本地标记服务器:需要运行本地 Python 服务器。
    • URL:http://localhost:8001(默认)
    • 请参阅 标记项目 进行设置。

3. 搜索集成

  • 语义学者:添加您的 API 密钥 以获得更高的速率限制和更快的搜索。
  • Firecrawl:添加 API 密钥 以启用深层网络搜索功能 - 带有 (GitHub) 的本地实例。
  • 方便:添加 API 密钥,以获得为 AI 代理量身定制的优化搜索结果。
  • You.com:添加 API 密钥 用于网络搜索和研究模式。

4. 工作区

  • 本地路径:为工作区文件配置自定义目录路径(设置 → seerai → 工作区)。
  • Git 集成:启用 Git 版本控制以实现自动版本控制和协作。
  • AI 代理可以通过工作区工具访问在工作区中创建的文件。

5、云存储

  • 支持的提供商:Google Drive、Dropbox、Box、OneDrive、Nextcloud。
  • 身份验证:使用 PKCE 流程保护 OAuth 2.0 — 不存储密码。
  • 通过工作区侧栏中的云选项卡进行连接,以浏览、同步云文件并将其用作 AI 上下文。

6. MCP 服务器 & API

Seer-AI 现在包括模型上下文协议 (MCP) 服务器和用于外部集成的本地 API。

  • MCP 服务器:位于 mcp-server/。允许外部 LLMs(如 Claude Desktop)与您的 Zotero 库交互。有关配置说明,请参阅 MCP 设置指南。
  • 本地 API:提供用于聊天、工具执行和库管理的端点。
    • 设置 → seerai → API。
    • 默认端口:23119

此模式需要具有强大 tool/function-calling 功能的复杂模型才能正常运行。

使用指南

与论文聊天

  1. 在您的图书馆中选择一篇(或多篇)论文。
  2. 打开 seerai 侧边栏选项卡。
  3. (可选)通过设置图标(摘要、注释)自定义上下文包含内容。
  4. 输入您的问题或使用 提示库(书籍图标)中的模板。

可拆卸窗户

  • 弹出:点击seerai标签栏中的⇱按钮,打开浮动窗口。
  • 热键:按 Ctrl+Shift+S 立即分离、切换或聚焦窗口。
  • 自动同步:当您在 Zotero 中选择不同的项目时,分离的窗口会自动更新其上下文。
  • 附加:关闭浮动窗口或单击停靠按钮(位于侧边栏占位符内)以返回侧边栏。

创建数据表

  1. 在主视图中打开 Tables 选项卡。
  2. 单击侧边栏上的 + 以添加新列。
  3. 定义列标题和 AI 提示(e.g.,“样本大小是多少?”)。
  4. 将纸张拖放到表格中。
  5. 单击单元格上的“生成”以提取数据。

提示库

  • 通过聊天中的 图书图标 进行访问。
  • 使用内置模板(总结、批评、比较)。
  • 使用占位符创建自定义模板:
    • !:已保存的提示
    • /:论文
    • ^:文件夹
    • ~: 标签
    • @:作者
    • #:主题

使用工作区

  1. 使用聊天面板中的文件夹图标打开工作区侧边栏。
  2. 使用 + 按钮或通过 AI 代理命令创建文件和文件夹。
  3. 使用具有语法突出显示功能的内置代码编辑器编辑文件。
  4. 在“设置”→“seerai”→“工作区”中启用 Git 集成以进行版本控制。
  5. 通过“云”选项卡连接云存储(Google Drive、Dropbox 等)。
  6. AI 代理可以作为其工具套件的一部分读取、写入和修改工作区文件。

未来的实施想法

  • 在线群组同步和共享工作空间:在分离的窗口和侧边栏实例之间保持聊天、表格、搜索、审阅和云状态实时同步,并为特定 Zotero 群组或邀请的协作者提供团队范围内的同步,以创建基于 Zotero 项目的共享工作空间。
  • PDF 文本引用和突出显示:引用聊天或提取结果中的特定段落,并直接在 Zotero 的内置 PDF 查看器中打开相应位置,支持持久突出显示和注释。
  • 自动完成:在您键入时为标签、创建者和集合提供智能建议。
  • 复杂查询:支持布尔逻辑(AND/OR)和嵌套搜索条件(e.g.,“标题包含X AND年份> 2020”)。
  • 特定领域搜索:标题、作者、年份和标签的专用过滤器。
  • 引文参考:表格内的内联引用和生成过程中的聊天。
  • 内部 MCP 预设:对 MCP JSON 预设的自定义支持,以简化集成。

发展

先决条件

  • Node.js 18+
  • 佐特罗 9 或 10

项目结构

代码库遵循模块化架构:

seerai/
├── addon/                 # Zotero integration files (XUL/XHTML)
├── src/
│   ├── modules/           # Core feature modules
│   │   ├── chat/          # Chat engine & state
│   │   │   ├── rag/       # RAG pipeline (chunker, embeddings, retrieval, vector store)
│   │   │   ├── tools/     # Agentic tool system (search, note, table, web, workspace, skills, etc.)
│   │   │   ├── cli/       # Local CLI providers (Codex, Claude, Antigravity, Hermes, OpenClaw, Cursor)
│   │   │   ├── skills/    # Agent skills registry
│   │   │   └── workspace/ # File workspace (editor, sidebar, git CLI, diff viewer, store)
│   │   ├── search/        # Federated scholarly search (11 providers, query IR + compilers)
│   │   ├── systematicReview/ # PRISMA systematic review workflow
│   │   ├── cloud/         # Cloud storage tab
│   │   ├── drive/         # Cloud providers (Google, Dropbox, Box, OneDrive, Nextcloud)
│   │   ├── assistant.ts   # Main assistant logic
│   │   ├── firecrawl.ts   # Firecrawl integration
│   │   ├── tavily.ts      # Tavily search integration
│   │   ├── youdotcom.ts   # You.com search & research integration
│   │   ├── ocr.ts         # OCR implementation
│   │   ├── openai.ts      # LLM & multimodal client
│   │   ├── semanticScholar.ts # Semantic Scholar integration
│   │   ├── fileViewer.ts  # File rendering & viewing
│   │   ├── docxConverter.ts # Document format conversion
│   │   ├── webSearchProvider.ts # Provider abstraction (Firecrawl/Tavily/You.com)
│   │   └── preferenceScript.ts # Preferences logic
│   ├── utils/             # Utility functions
│   └── hooks.ts           # Zotero event listeners
├── skills/                # ~148 bundled agent skill packages
└── package.json

命令

npm start       # Start dev server with hot reload
npm run build   # Build for production
npm run lint:fix # Fix code style issues

热门栏目