> ## Documentation Index
> Fetch the complete documentation index at: https://linkly.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# 官方模型服务

> Linkly AI 官方提供的云端模型服务：登录即用、无需自备 API 密钥，按共享额度池计费。

## 模型服务是什么

桌面应用里的 [Chatbot](/docs/zh/use-chatbot) 需要一个语言模型来驱动。以往这意味着你得先去某个供应商注册、开通付款、创建 API 密钥、再回来填一堆配置。

**模型服务**是 Linkly AI 官方运营的云端模型接入：**登录账号就能直接开聊，不用自备任何 API 密钥，也不用绑卡**。它精选了我们测试后表现更好的一批模型。

<CardGroup cols={2}>
  <Card title="零配置起步" icon="bolt" iconType="duotone">
    登录即可用，免费账户也有额度，不需要信用卡
  </Card>

  <Card title="统一额度池" icon="gauge" iconType="duotone">
    不按 token、不按请求数，所有模型共用一个额度池
  </Card>
</CardGroup>

<Note>模型服务只负责**对话推理**这一环。文档的索引、文字识别（OCR）、语音转写（ASR）**全部在你本机运行**，和这个服务无关——即使完全不用官方模型，检索照样能用。</Note>

***

## 怎么开始用

<Steps>
  <Step title="登录账户">
    打开 **设置 → 账户**，点「登录」。浏览器会打开授权页，完成后自动回到应用，API 密钥由应用自动获取并保存，你不需要手动复制粘贴。

    如果浏览器唤起失败，可以展开账户页下方的「**可选：通过手动设置 API Key 完成账户连接**」，把 [控制台](https://linkly.ai/dashboard/integrations) 里以 `lkai_` 开头的密钥粘进去，效果一样。
  </Step>

  <Step title="确认提供商已就绪">
    打开 **设置 → AI → 模型提供商**，「Linkly Official」这张卡片应显示为「就绪」。如果显示「需要设置」，说明还没登录，回到上一步。

    点卡片上的「设置」打开对话框，里面的「刷新」（已有模型时）或「添加模型」（还没有模型时）会从服务端拉取当前可用的模型列表——服务端更新目录后，点一次就能同步过来。
  </Step>

  <Step title="选模型开聊">
    打开 Chatbot，模型选择器在**输入框右侧的工具栏**里，按提供商分组。官方模型会带一个倍率徽章，鼠标悬停能看到「每次请求约消耗多少次配额」。

    在 **设置 → AI** 里还可以设定新建对话默认使用的模型，以及固定的回复语言。
  </Step>
</Steps>

***

## 有哪些模型

官方目录分两档：

* **基础模型** —— 所有人可用，并提供了免费额度，适合日常问答和体验。
* **前沿模型** —— 需要 Pro 订阅，能力更强。

<Note>**具体有哪些模型、各自的倍率和上下文窗口，以应用内模型选择器里实际显示的为准。** 目录由服务端下发，会随供应商价格和新模型发布而调整。</Note>

免费账户在列表里**看不到前沿模型**（服务端会直接过滤掉），所以不会出现「选了才发现用不了」的情况。

***

## 额度

这一节值得花两分钟读完——它决定了你「到底能用多少」。

### 一个共享额度池，不是按 token 也不是按次数

官方模型**不按 token 计费，也不给每个模型单独分配次数**。所有模型共用**同一个额度池**，每个模型有自己的**倍率**，一次请求从池子里扣掉对应的量：

> **1 次额度 = 倍率 ×1 的模型发一次请求。**

倍率越低的模型越省额度：倍率 ×0.5 的模型发一次只扣半次，倍率 ×4 的模型发一次扣四次。每个模型的倍率就标在模型选择器的徽章上，悬停能看到它大致消耗多少配额。

<Tip>**日常问答用基础模型、真正需要深度推理时才切前沿模型**，是最划算的用法——同样一池额度，倍率差几倍，能聊的轮数就差几倍。</Tip>

### 三个并行的时间窗口

额度池有**三个时间窗口：5 小时、7 天、30 天**，各自独立计算，**任意一个打满都会被限流**——哪怕另外两个还有余量。5 小时窗口防止短时间内集中消耗，7 天和 30 天窗口约束整体用量。

Pro 账户三个窗口的额度都显著高于免费账户。

<Note>**各档位的具体额度以应用内配额面板和[官网](https://linkly.ai/pricing)为准。** 点 Chatbot 左侧栏底部的**配额按钮**，能看到三个窗口的实时余量和各自的重置时刻</Note>

<Note>窗口是采用与ChatGPT / Claude类似的**固定窗口**：它从你在这个周期里的第一次计费请求开始计时，到点后**额度一次性全部恢复**</Note>

### 什么会扣额度、什么不会

| 行为                        | 是否扣额度 |
| ------------------------- | ----- |
| 你发一条新消息（发起新一轮问答）          | **扣** |
| AI 在这一轮里反复调用检索工具、读文档      | 不扣    |
| 自动生成会话标题、`/compact` 压缩上下文 | 扣     |
| 查看配额面板                    | 不扣    |
| 使用第三方或本地模型                | 不扣    |

**工具调用不单独计费**是个重要设计：一轮问答里 AI 可能检索七八次、读十几个文件，这些全部共享你发那条消息时的那一次扣减。所以「我今天问了几个问题」就约等于「我用了多少额度」，不会因为 AI 干活勤快而被多扣。

***

## 在哪看额度、用完会怎样

### 在哪看

两个入口：

1. Chatbot 窗口左侧栏底部的**配额按钮**（仪表盘图标）。点开是「**模型配额**」面板，三个窗口各一行——「5 小时配额」「7 天配额」「30 天配额」，每行显示**剩余 / 总量**和**什么时候重置**。
2. 网页[控制台](https://linkly.ai/dashboard)首页。

<Note>没登录时这里显示「登录 Linkly 账户后查看配额」；断网时显示「暂时无法获取配额，请检查网络」——**官方模型需要联网**，这是它和本地模型最实际的一个差别。</Note>

### 用完会怎样

某个窗口打满之后，你**照常发消息**，但这一轮会立刻失败，对话里出现一条提示条，直接告诉你是哪个窗口满了、什么时候恢复：

| 打满的窗口 | 提示条上会写                                            |
| ----- | ------------------------------------------------- |
| 5 小时  | Linkly AI 配额已达上限（**5** 小时内 **N** 次）。**HH:MM** 恢复。 |
| 7 天   | 本周配额已达上限（7 天内 **N** 次）。**日期** 恢复。                 |
| 30 天  | 本月配额已达上限（30 天内 **N** 次）。**日期** 恢复。                |

加粗的部分由应用按你的实际档位填入：**N** 是该窗口的额度总量，后面跟的是具体的恢复时刻。所以你不需要自己去算什么时候能继续——提示条上直接就写着。

几点值得知道：

* **已有的对话不会丢**。限流只影响这一次请求，历史消息、会话列表、检索索引都不受影响。
* **是整个池子被限，不是某个模型被限**。三个窗口共用同一个额度池，所以打满之后**换成倍率更低的官方模型也没用**——低倍率省的是「每次扣多少」，不是「能不能发」。
* **第三方和本地模型完全不受影响**，它们走的是另一条路，不经过官方配额（见下一节）。
* **不需要申请**，到点自动全额恢复。

所以遇到限流，实际只有两条路：**等窗口重置**，或者**切到第三方 / 本地模型**继续。真正省额度的做法是在没被限之前就养成习惯——日常问答用基础模型，需要深度推理时才切前沿模型。

***

## 也可以不用官方服务（BYOK）

官方模型服务不是必选项。Chatbot 支持**任意 OpenAI 兼容端点**，在 **设置 → AI → 模型提供商 → 自定义提供商** 里添加。

添加时提供 12 个预设可快速填入地址：

| 分组 | 预设                                      |
| -- | --------------------------------------- |
| 云端 | OpenAI、DeepSeek、Mistral、Groq、OpenRouter |
| 中国 | Qwen、MiniMax、Moonshot、Zhipu、SiliconFlow |
| 本地 | Ollama、LM Studio                        |

<Note>预设**只预填 Base URL**，不含模型列表。填完地址后可以从该端点的 `/v1/models` 自动发现模型，也可以手动输入模型 id。本地服务（Ollama / LM Studio）通常**不需要填 API 密钥**，留空即可。</Note>

### 怎么选模型服务？

| 方式            | 要不要自备密钥 | 额度 / 计费     | 数据去向                 | 适合谁               |
| ------------- | ------- | ----------- | -------------------- | ----------------- |
| **Linkly 官方** | 不用      | 共享额度池，免费档可用 | 经 Linkly 服务器转发给供应商   | 想立刻开始用、不想折腾配置     |
| **第三方端点**     | 要       | 你和该供应商直接结算  | 直连该供应商 API，不经 Linkly | 已有 API 额度、想指定特定模型 |
| **本地模型**      | 不用      | 免费，消耗你自己的算力 | **完全不出本机**           | 对数据外发零容忍          |

<Warning>自定义提供商如果不返回 `context_length` 字段（本地 Ollama / LM Studio 很常见），应用就不知道模型的上下文窗口有多大——**用量百分比显示不出来，自动压缩也不会触发**。这类模型请自己留意对话长度，适时手动 `/compact` 或新建会话。详见[使用 Chatbot](/docs/zh/use-chatbot)。</Warning>

***

## 数据流向与隐私

诚实地说清楚每条路径上数据会去哪：

| 能力                   | 数据去向                              |
| -------------------- | --------------------------------- |
| **语言模型 · Linkly 官方** | 数据先到 Linkly AI 服务器，再由我们转发精选的模型供应商 |
| **语言模型 · 直连第三方**     | 直连该供应商的 API，不经过 Linkly            |
| **语言模型 · 本地模型**      | 切换到 Ollama 或自定义本地模型时，对话不出本机       |
| **向量生成（Embedding）**  | 本地运行，仅首次启动时从官方 CDN 下载模型文件         |
| **文字识别（OCR）**        | 本地运行，仅首次使用时联网下载模型文件               |

<Warning>用官方模型服务，就意味着你发送的消息内容（包括 AI 为回答而检索到的文档片段）**会经过 Linkly AI 的服务器，再转发给上游模型供应商**。这是中转型服务的固有代价，我们不回避。</Warning>

应用内 **设置 → 隐私** 页面会实时列出当前有哪些能力在向外发送数据，可以随时自查。

<Note>每次对话请求会附带**应用名和版本号**（HTTP header），用于第三方供应商归因，**不含任何身份信息**。</Note>

***

## 常见问题

<AccordionGroup>
  <Accordion title="不登录能用 Chatbot 吗？">
    能，但需要自己配一个模型来源——在 **设置 → AI**
    里添加第三方端点或本地的 Ollama / LM
    Studio。官方模型服务是唯一需要登录的部分；[搜索](/docs/zh/use-launcher)、索引、MCP
    等本地能力都不需要账号。
  </Accordion>

  <Accordion title="额度是「一天多少次」这种吗？">不是。三个窗口（5 小时 / 7 天 / 30 天）**同时生效、各自独立**，任意一个打满都会限流。所以短时间内密集使用可能先撞到 5 小时窗口，而长期慢用则更容易受 30 天窗口约束。</Accordion>

  <Accordion title="换个便宜模型能多聊多少？">直接看倍率——它就是倍数关系：倍率相差五倍，同样一池额度能聊的轮数就相差五倍。模型选择器里每个官方模型的徽章上都标着倍率，切换前扫一眼即可估算。</Accordion>

  <Accordion title="模型服务的额度会影响云端知识库检索吗？">不会，这是**两条完全独立的线**。对话额度只统计模型推理；[云端知识库](/docs/zh/use-cloud-library)的检索和[远程访问](/docs/zh/use-in-remote)有各自的规则，互不占用。</Accordion>

  <Accordion title="为什么预设里没有 Gemini？">
    Gemini 的 OpenAI 兼容端点要求把密钥放在 URL 的 `?key=` 参数里，而不是标准的
    `Authorization: Bearer`
    请求头，当前的对话链路还不支持这种鉴权方式。

    此外 Gemini 对工具调用支持度还不够，我们会密切关注，完善后添加。
  </Accordion>

  <Accordion title="换电脑要重新配吗？配额面板显示要我登录？">
    官方模型服务只要在新设备上登录同一个账号即可，额度**跟账号走**（三个窗口按账号统计，不按设备）。配额面板提示「登录 Linkly 账户后查看配额」就是这台设备还没连上账户，去 **设置 → 账户** 点登录即可；已登录仍提示的多半是密钥失效，退出后重新登录一次。自定义提供商的地址和密钥保存在本机，换机需要重新添加。
  </Accordion>
</AccordionGroup>

***

## 延伸阅读

* [使用 Chatbot](/docs/zh/use-chatbot) —— 对话窗口的完整用法、`@` 引用与上下文压缩
* [使用云端知识库](/docs/zh/use-cloud-library) —— 让知识库脱离本机 24 小时在线
* [远程访问](/docs/zh/use-in-remote) —— 让云端 AI 穿透访问本机文档
* [常见问题](/docs/zh/faq) —— 其他高频疑问
* [账号](/docs/zh/linkly-account) —— 登录方式、API 密钥与 Pro 权益
