Skip to main content

模型服务是什么

桌面应用里的 Chatbot 需要一个语言模型来驱动。以往这意味着你得先去某个供应商注册、开通付款、创建 API 密钥、再回来填一堆配置。 模型服务是 Linkly AI 官方运营的云端模型接入:登录账号就能直接开聊,不用自备任何 API 密钥,也不用绑卡。它精选了我们测试后表现更好的一批模型。

零配置起步

登录即可用,免费账户也有额度,不需要信用卡

统一额度池

不按 token、不按请求数,所有模型共用一个额度池
模型服务只负责对话推理这一环。文档的索引、文字识别(OCR)、语音转写(ASR)全部在你本机运行,和这个服务无关——即使完全不用官方模型,检索照样能用。

怎么开始用

1

登录账户

打开 设置 → 账户,点「登录」。浏览器会打开授权页,完成后自动回到应用,API 密钥由应用自动获取并保存,你不需要手动复制粘贴。如果浏览器唤起失败,可以展开账户页下方的「可选:通过手动设置 API Key 完成账户连接」,把 控制台 里以 lkai_ 开头的密钥粘进去,效果一样。
2

确认提供商已就绪

打开 设置 → AI → 模型提供商,「Linkly Official」这张卡片应显示为「就绪」。如果显示「需要设置」,说明还没登录,回到上一步。卡片上的「发现模型」会从服务端拉取当前可用的模型列表——服务端更新目录后,点一次就能同步过来。
3

选模型开聊

打开 Chatbot,模型选择器在输入框右侧的工具栏里,按提供商分组。官方模型会带一个倍率徽章,鼠标悬停能看到「每次请求约消耗多少次配额」。设置 → AI 里还可以设定新建对话默认使用的模型,以及固定的回复语言。

有哪些模型

官方目录分两档:
  • 基础模型 —— 所有人可用,并提供了免费额度,适合日常问答和体验。
  • 前沿模型 —— 需要 Pro 订阅,能力更强。
具体有哪些模型、各自的倍率和上下文窗口,以应用内模型选择器里实际显示的为准。 目录由服务端下发,会随供应商价格和新模型发布而调整。
免费账户在列表里看不到前沿模型(服务端会直接过滤掉),所以不会出现”选了才发现用不了”的情况。

额度

这一节值得花两分钟读完——它决定了你”到底能用多少”。

一个共享额度池,不是按 token 也不是按次数

官方模型不按 token 计费,也不给每个模型单独分配次数。所有模型共用同一个额度池,每个模型有自己的倍率,一次请求从池子里扣掉对应的量:
1 次额度 = 倍率 ×1 的模型发一次请求。
倍率越低的模型越省额度:倍率 ×0.5 的模型发一次只扣半次,倍率 ×4 的模型发一次扣四次。每个模型的倍率就标在模型选择器的徽章上,悬停能看到它大致消耗多少配额。
日常问答用基础模型、真正需要深度推理时才切前沿模型,是最划算的用法——同样一池额度,倍率差几倍,能聊的轮数就差几倍。

三个并行的时间窗口

额度池有三个时间窗口:5 小时、7 天、30 天,各自独立计算,任意一个打满都会被限流——哪怕另外两个还有余量。5 小时窗口防止短时间内集中消耗,7 天和 30 天窗口约束整体用量。 Pro 账户三个窗口的额度都显著高于免费账户。
各档位的具体额度以应用内配额面板和官网为准。 点 Chatbot 左侧栏底部的配额按钮,能看到三个窗口的实时余量和各自的重置时刻
窗口是采用与ChatGPT / Claude类似的固定窗口:它从你在这个周期里的第一次计费请求开始计时,到点后额度一次性全部恢复

什么会扣额度、什么不会

工具调用不单独计费是个重要设计:一轮问答里 AI 可能检索七八次、读十几个文件,这些全部共享你发那条消息时的那一次扣减。所以”我今天问了几个问题”就约等于”我用了多少额度”,不会因为 AI 干活勤快而被多扣。

在哪看额度、用完会怎样

查看入口
  1. Chatbot 窗口左侧栏底部的配额按钮(仪表盘图标)。
  2. Web 界面首页。
遇到限流又想马上继续,有三条路:换一个倍率更低的模型、等窗口重置、或者切到第三方 / 本地模型(见下一节)。

也可以不用官方服务(BYOK)

官方模型服务不是必选项。Chatbot 支持任意 OpenAI 兼容端点,在 设置 → AI → 模型提供商 → 自定义提供商 里添加。 添加时提供 12 个预设可快速填入地址:
预设只预填 Base URL,不含模型列表。填完地址后可以从该端点的 /v1/models 自动发现模型,也可以手动输入模型 id。本地服务(Ollama / LM Studio)通常不需要填 API 密钥,留空即可。

怎么选模型服务?

自定义提供商如果不返回 context_length 字段(本地 Ollama / LM Studio 很常见),应用就不知道模型的上下文窗口有多大——用量百分比显示不出来,自动压缩也不会触发。这类模型请自己留意对话长度,适时手动 /compact 或新建会话。详见使用 Chatbot

数据流向与隐私

诚实地说清楚每条路径上数据会去哪:
用官方模型服务,就意味着你发送的消息内容(包括 AI 为回答而检索到的文档片段)会经过 Linkly AI 的服务器,再转发给上游模型供应商。这是中转型服务的固有代价,我们不回避。
应用内 设置 → 隐私 页面会实时列出当前有哪些能力在向外发送数据,可以随时自查。
每次对话请求会附带应用名和版本号(HTTP header),用于第三方供应商归因,不含任何身份信息

常见问题

能,但需要自己配一个模型来源——在 设置 → AI 里添加第三方端点或本地的 Ollama / LM Studio。官方模型服务是唯一需要登录的部分;搜索、索引、MCP 等本地能力都不需要账号。
不是。三个窗口(5 小时 / 7 天 / 30 天)同时生效、各自独立,任意一个打满都会限流。所以短时间内密集使用可能先撞到 5 小时窗口,而长期慢用则更容易受 30 天窗口约束。
直接看倍率——它就是倍数关系:倍率相差五倍,同样一池额度能聊的轮数就相差五倍。模型选择器里每个官方模型的徽章上都标着倍率,切换前扫一眼即可估算。
不会,这是两条完全独立的线。对话额度只统计模型推理;云端知识库的检索和远程访问有各自的规则,互不占用。
Gemini 的 OpenAI 兼容端点要求把密钥放在 URL 的 ?key= 参数里,而不是标准的 Authorization: Bearer 请求头,当前的对话链路还不支持这种鉴权方式。此外 Gemini 对工具调用支持度还不够,我们会密切关注,完善后添加。
官方模型服务只要在新设备上登录同一个账号即可,额度跟账号走(三个窗口按账号统计,不按设备)。配额面板提示「登录 Linkly 账户后查看配额」就是这台设备还没连上账户,去 设置 → 账户 点登录即可;已登录仍提示的多半是密钥失效,退出后重新登录一次。自定义提供商的地址和密钥保存在本机,换机需要重新添加。

延伸阅读