Skip to main content
Linkly AI 之所以能秒搜到你电脑上的文档,是因为它在后台默默做了一件事:索引。这一页把 设置 → 索引 里的每一个开关讲清楚,并给出索引出问题时的排查路径。 如果你刚装好应用还没添加自己的文档,请先看快速开始

索引是怎么工作的

Linkly AI 的索引是分层的——不是”全做完才能用”,而是每完成一层就多一种搜索能力。
1

第一层:文件名(秒级)

扫描到文件后立刻把路径和文件名写进索引。这一层几乎是瞬间完成的,所以刚添加完文件夹你就能按文件名搜到东西。
2

第二层:全文(关键词)

解析文档正文写入本地全文索引,支持关键词匹配。这一层完成后,搜”预算表”能命中正文里出现过这三个字的文档。
3

第三层:语义(向量)

用本地嵌入模型把正文切块转成向量。这一层完成后,搜”去年花了多少钱”也能命中标题里完全没有这几个字的财务报告。
在这三层之外,还有两个可选的内容提取器,负责把本来没有文字的文件变成有文字的文件,再送进上面三层:
  • 文字识别(OCR):从图片和扫描版 PDF 里认出文字
  • 音视频文本提取(ASR):把音频和视频里的说话内容转成文本

设置 → 索引 页导览

打开 设置 → 索引,从上到下是四块内容:

状态明细怎么看


索引的设置项

1. 性能模式

它做什么:控制后台索引可以占用多少计算资源。 默认值:自动(推荐)

2. 省电模式

它做什么:笔记本用电池时,暂停耗电的重任务。 默认值:关闭
生效条件是「开关打开正在用电池供电」两个条件同时成立。
电池供电时会被暂停的:
  • 图片 OCR
  • 扫描版 PDF 转结构化 Markdown
  • 语义索引(向量生成)
  • 音视频转写
  • 云端知识库的自动同步
  • 数据库整理优化
不受影响、照常跑的:文件名索引、全文(关键词)索引。所以即使在省电模式下,新文件依然搜得到。 什么时候该动它:笔记本用户建议直接打开并且不再管它。台式机用户开不开都一样。

3. 空闲时模型自动休眠

它做什么:本地 AI 模型闲置一段时间后释放内存,需要时自动重新加载。 默认值:开启 本地模型(语义嵌入、OCR、语音识别)空闲约 **300 秒(5 分钟)**后自动卸载释放内存。 关闭后模型常驻内存,三个加起来约使用 1 GB 左右内存。 什么时候该动它:内存紧张(8 GB 及以下)就保持默认开启。

4. 图片文字识别(OCR)

它做什么:用本地 OCR 模型认出图片里的文字,以及把扫描版 PDF 转成结构化 Markdown 默认值:开启

5. 语义搜索

它做什么:开启后能让用自然语言、描述性的说法搜到文档。 默认值:开启

6 / 7. 音频解析 与 视频解析

它们做什么:用本地语音识别模型把音频和视频里的说话内容转成文本,然后送进全文和语义索引。 默认值:两个都是关闭 ⚠️
**关闭不等于不索引。**音视频文件照常被登记进索引,能按文件名搜到,但搜不到里面说了什么
什么时候该动它:有会议录音、播客、课程视频要检索时打开。

索引优化和重建

索引存储优化

用更紧凑的方式重建向量索引。这是一个几乎无损的收益
  • 磁盘占用约减少 80%(实测能缩小 11.6 倍)
  • 搜索速度更快
中途退出应用是安全的,不会损坏数据,下次启动会自动继续。
已经是最优状态时,点这个按钮没有任何作用,只会提示「索引已是最优状态」,也无法手动强制重跑

重建索引

这是危险操作,按钮是红色的。它会:
  • 删除:全文索引目录、所有向量、以及每篇文档的索引进度标记
  • 不删除:你的原始文件、已经提取出来的文本缓存、已下载的模型文件
正因为文本缓存和模型都保留着,重建通常比首次索引快得多——省掉了最慢的解析和 OCR 环节。 重建期间搜索返回空结果(不是报错)。
以下四种情况点了会被拒绝,按钮不会生效:
  • 后台还有 OCR 或音视频转写任务在跑
  • 索引已被暂停(在托盘菜单里暂停过)
  • 正在扫描或正在索引
  • 已经有一个重建在跑

索引状态

状态一共 5 个取值: 「监听中」是你希望看到的最终状态。

如何暂停索引?

「暂停索引」只存在于系统托盘菜单里——点击托盘的 L 图标打开菜单,里面有「⏸ 暂停索引」/「▶ 开始索引」。

常见问题

因为音频解析和视频解析默认是关闭的。关闭时媒体文件仍然会被登记进索引(所以文件名搜得到),但里面说了什么没有被转写。设置 → 索引 打开「音频解析」和「视频解析」,应用会下载 161 MB 的语音识别模型,然后自动把存量文件全部补做完——不需要重新扫描,也不需要重建索引。例外:如果媒体文件旁边有同名的 .srt / .vtt 字幕,或者以前转写过缓存还在,那么开关关着也能搜到内容。
先去 设置 → 索引 看「图片文字识别 (OCR)」这个开关是不是关着。注意:这个开关同时控制图片 OCR 和扫描版 PDF 的文字提取——虽然标签只写了「图片」。关掉它,扫描版 PDF 也会变成”只有文件名、没有正文”。如果开关是开着的,再看状态明细里「文字识别 (OCR)」那一行:显示「准备中」说明模型还在下载或加载,等一会儿即可。
最常见的原因是索引被暂停了。这个开关只在系统托盘菜单里——点托盘图标,如果看到「▶ 开始索引」,说明当前是暂停状态,点一下恢复。判断依据:设置页状态显示「空闲」且下方有一行英文小字 Indexing paused,就是被暂停了。如果不是暂停,再确认一下 设置 → 文件夹 里是否已经添加了你自己的目录——引导流程只会索引内置样例文档。
按这个顺序排查:
  1. 设置 → 索引 状态明细里的「语义搜索」是不是显示「已禁用」?是的话说明开关被关了,打开即可(会自动补跑,不用重建)。
  2. 显示「准备中」或「排队中」?说明还在建向量,等它跑完。
  3. 两者都不是的话,去 设置 → AI → 嵌入模型 看模型是不是还在下载或者下载失败了——这种情况在搜索界面完全没有提示,搜索会静默退化成纯关键词。失败的话点卡片上的「重试」。
「暂停索引」只在系统托盘菜单里,设置页不提供。点击托盘的 L 图标 → 「⏸ 暂停索引」。恢复也是同一个位置,菜单项会变成「▶ 开始索引」。暂停期间无法执行「重建索引」,需要先恢复。
设置 → 索引 → 维护,点「索引存储优化」。它会用更紧凑的方式重建向量索引,磁盘占用约减少 80%,代价是约 1% 的召回率损失,同时搜索还会变快。如果按钮提示「索引已是最优状态」,说明你的索引已经是新格式了,没有可优化的空间,也无法强制重跑。
先别急。重建是最后的手段,期间搜索会返回空结果。按这个顺序试:
  1. 确认对应的开关没关(OCR / 语义搜索 / 音视频解析)
  2. 确认索引没被暂停(托盘菜单)
  3. 确认状态已经到了「监听中」,而不是还在「索引中」
以上都排除了才考虑 设置 → 索引 → 维护 → 重建。重建不会删除你的原始文件,也不会删除已经提取出来的文本缓存和模型文件,所以通常比首次索引快得多。
不能。性能模式只控制索引占用多少线程、多频繁让位,不控制”要不要跑”。选「均衡」只是让它慢一点、更不打扰你。真正要停,用托盘菜单的「暂停索引」。另外,「自动」模式只看键盘鼠标是否空闲(超过 120 秒算空闲)——它不看电池、不看 CPU 负载。在纯 Wayland 的 Linux 桌面上拿不到这个信号,「自动」会一直等价于「均衡」。
这是正常的。省电模式的生效条件是「开关打开正在用电池供电」。插着电源、或者台式机没有电池时,它完全不起作用。正因为如此,它可以常年开着,不需要在出门前手动打开、回家后手动关掉。
按影响从小到大:
  1. 性能模式改成「均衡」(立即生效,正在跑的任务会按新预算重新领取)
  2. 临时关掉「音频解析」和「视频解析」——媒体转写是最重的任务,而且和 OCR 抢同一个全局单槽
  3. 还是卡的话,用托盘菜单「暂停索引」,等空闲时再恢复

延伸阅读