1. Conduit
  2. 用例
  3. 文档

文档

和你的文档对话,准确看到是哪一份回答了你

把你自己的文本、Markdown、CSV、Word 和 PDF 文件加入一个集合,把它附加到一次对话中, 然后提问。Conduit 会同时按语义和按精确字词检索,每个回复都会指出它参考了哪些文件—— 点击其中一个即可读到那段原文。

  • 文本、Markdown、CSV、Word 和 PDF
  • 混合检索——同时按语义和按精确字词
  • 每个回答都引用它所使用的段落

问题

你问助手一个关于自己文件的问题,它自信地给出了答案——但你没法判断它读的到底是真正 重要的那段、一份过时的草稿,还是根本什么都没读。 每次都手动把相关那一页粘进聊天窗口,算不上一种工作流程,而是一种应付 “无法信任答案”的权宜之计。

Documents 能给你什么

一个可以核实的答案,而不只是读一读

你的文件被正确地检索,并且每次都能追溯回原始来源。

五种文件类型,一个集合

文本、Markdown、CSV、Word(.docx)和 PDF。把文件拖到窗口的任意位置即可添加,或者从侧边栏建立一个集合,把整个集合附加到一次对话中。

按语义、也按精确字词找到

一个向量检索和一个 SQLite 全文检索在同一批段落上同时运行,并被融合成一份排名——因此措辞不同的问题,和依赖某个精确术语的问题,都能命中。

不需要另外运行一套索引

索引以普通行的形式存在于和你聊天记录同一个本地 SQLite 数据库中——不需要单独安装、托管或备份一个向量数据库。

工作原理

三个步骤,不需要单独的工具

一切都在 Conduit 内部完成——不需要先把文件导出给第三方索引服务。

  1. 建立一个集合

    在侧边栏打开 Documents,创建一个集合。把文件拖到窗口的任意位置即可添加,或者逐个添加文本、Markdown、CSV、Word 或 PDF 文件。

  2. 把它附加到一次对话

    在该对话的 composer 中选择这个集合。第一次用某个提供商建立索引时,Conduit 会在发送任何内容之前先征求同意。

  3. 提问,并核实来源

    回复会把它检索过的文件作为标签显示在你的问题下方。点击一个标签即可打开它所使用的确切段落——不是摘要,而是原文本身。

实际示例

一个设计问题,追溯回给出答案的那条笔记

一个工程团队在一个集合里保存了四份文件:一份架构概览、认证设计笔记、一份处理同步积压的 运行手册,以及一份 API 参考。一位新同事问,为什么客户端在让用户登出之前要重试两次认证。

Conduit 会同时检索全部四份文档——按语义检索,所以一个没有出现“刷新竞争”这个词的问题 依然能找到讲它的那一段;按精确字词检索,所以像 409 refresh_reused 这样的错误码能被直接命中。回复会指出它参考的文件,并根据设计笔记解释这两次重试。

点击被引用的文件不会打开一份摘要,而是打开答案所使用的实际段落,上方还显示着 该文件在磁盘上的路径——核实答案只需一次点击,不用再翻一遍原始文档。

Documents 的工作原理,见文档

数据去了哪里

两次不同的网络请求,而不是一次

为文件建立索引和提出关于它的问题,会发送不同的内容,去往不同的地方。

步骤发往
用 OpenAI、Gemini 或 OpenRouter 建立索引该提供商会收到文档的全文,仅一次
用 Ollama 建立索引不发往任何地方——嵌入在你的机器上完成
提出问题你的聊天提供商会收到检索到的段落,作为提示词的一部分

Anthropic 没有提供嵌入 API,所以 Claude 从来都不是索引的选项——只能用于聊天。查看 隐私页面,了解 Conduit 产生的每一种网络流量,不只是这一种。

限制

它能做什么,不能做什么

它能做什么

  • 把文本、Markdown、CSV、Word 和 PDF 文件加入你掌控的集合,并同时按语义和精确字词检索它们。
  • 准确显示答案参考了哪些文件,可点击直达来源段落。
  • 在你的机器上解析文件——Conduit 没有自己的服务器可供上传。
  • 让你选择嵌入提供商,也可以随时改变主意:同意是按提供商分别给出的,可以在文档页面撤回。
  • 把索引保存在和你聊天记录同一个本地 SQLite 数据库中,不需要单独运行向量服务。
  • 当你为嵌入和聊天都选择 Ollama 时,完全在本机运行。

它不能做什么

  • 无法读取没有文字层的扫描版 PDF——这里没有 OCR 步骤,这类文件不会产生任何文本。
  • 不能用 Claude 建立索引——Anthropic 没有嵌入 API,即使聊天由 Claude 回答,索引部分也要选择 OpenAI、Gemini、OpenRouter 或 Ollama。
  • 除非你选择 Ollama,否则无法让文档文本不经过网络——云端嵌入按设计会发送一次全文。
  • 除非你已经开启静态加密,否则不会加密文档分块——默认是关闭的,在你开启之前一切都是明文。
  • 不会止步于来源摘录——检索到的段落会作为提示词的一部分继续发给你的聊天提供商,因此该提供商自己的政策同样适用于这些内容。
  • 仅本地模式开启时不允许使用云端嵌入提供商——那种模式下 Conduit 只会选择 Ollama。

和文档对话——问题,说得明明白白

我可以和哪些文件类型对话?

纯文本、Markdown、CSV、Word(.docx)和 PDF。把它们中的任意一个拖到 Conduit 窗口上即可加入一个集合,也可以从侧边栏的 Documents 部分逐个添加文件。这里没有 OCR 步骤,所以底层没有文字层的扫描版 PDF 无法被读取——它只会得到空白结果。

我的文档会离开我的电脑吗?

无论哪种情况,文件都会在你的机器上解析。为了让索引生效,文档的全文会被发送一次给你选择的嵌入提供商——除非你选择 Ollama,它会在本机完成嵌入,什么都不发送。之后,当你提出问题时,从你的文件中检索到的段落会作为提示词的一部分发给你的聊天提供商,和你输入的其他任何内容一样。所以只有当 Ollama 负责嵌入、并由本地模型回答时,一个集合才会完全留在本机。

为什么我不能用 Claude 给我的文档建立索引?

Anthropic 没有提供嵌入 API,所以 Claude 不是把你的文件变成可检索索引的可选项之一。索引请选择 OpenAI、Gemini、OpenRouter 或 Ollama——聊天本身,以及从文档中检索到的段落,仍然可以发给 Claude 来回答。

我可以完全离线地和文档对话吗?

可以,让 Ollama 同时负责两项工作——嵌入你的文件和回答聊天——运行你已经在本地拥有的模型。开启仅本地模式后,Conduit 会替你强制执行这一点——云端嵌入提供商会被直接拒绝,因此一个集合不会悄悄开始联网。

Conduit 是怎么决定使用哪个段落的?

两种检索会同时在同一个本地数据库上运行——一个按语义匹配的向量检索,一个按精确字词匹配的 SQLite 全文检索——然后用 reciprocal rank fusion 把两份排名合并。这个组合既能应对措辞和原文不同的问题,也能应对依赖某个精确术语(比如产品编号或名称)的问题。答案所依据的文件会作为标签显示在你消息下方——点击其中一个即可读到那段原文,而不是它的摘要。

我的文档索引会加密吗?

只有在你已经于 Settings 中开启静态加密时才会——默认是关闭的。开启后,文档分块会被加密,密钥与你的操作系统钥匙串绑定,和附件、工件、记忆条目一样。关闭时,索引和你的聊天记录位于同一个本地数据库中,未加密,只受你操作系统自身文件权限的保护。

向你自己的文件提问,看看是谁回答的

免费、开源,在你建立第一个集合之前就已经在自己的机器上运行了。

这是一个发布候选版本:安装包尚未通过操作系统级代码签名,首次启动时可能会看到 SmartScreen 或 Gatekeeper 的提示。