> ## Documentation Index
> Fetch the complete documentation index at: https://linkly.ai/docs/llms.txt
> Use this file to discover all available pages before exploring further.

# Le service de modèles officiel

> Le service de modèles cloud proposé par Linkly AI : utilisable dès la connexion, sans clé API à fournir, facturé sur un pot de quota commun.

## Qu'est-ce que le service de modèles

Le [Chatbot](/docs/fr/use-chatbot) de l'application de bureau a besoin d'un modèle de langage pour fonctionner. Jusqu'ici, cela supposait de s'inscrire chez un fournisseur, d'activer un moyen de paiement, de créer une clé API, puis de revenir renseigner toute une série de réglages.

Le **service de modèles** est l'accès aux modèles cloud opéré par Linkly AI : **il suffit de se connecter à son compte pour discuter, sans fournir la moindre clé API ni enregistrer de carte bancaire**. Il regroupe une sélection de modèles retenus après nos propres essais.

<CardGroup cols={2}>
  <Card title="Zéro configuration au démarrage" icon="bolt" iconType="duotone">
    Utilisable dès la connexion ; les comptes gratuits disposent aussi d'un quota, sans carte bancaire
  </Card>

  <Card title="Un pot de quota commun" icon="gauge" iconType="duotone">
    Ni tokens ni nombre de requêtes : tous les modèles puisent dans le même pot
  </Card>
</CardGroup>

<Note>Le service de modèles ne couvre que l'**inférence conversationnelle**. L'indexation des documents, la reconnaissance de texte (OCR) et la transcription vocale (ASR) **s'exécutent intégralement sur votre machine** et n'ont rien à voir avec ce service — la recherche fonctionne parfaitement même sans jamais recourir aux modèles officiels.</Note>

***

## Comment démarrer

<Steps>
  <Step title="Se connecter à son compte">
    Ouvrez **Paramètres → Compte** et cliquez sur **Se connecter**. Le navigateur affiche la page d'autorisation ; une fois celle-ci validée, vous revenez automatiquement dans l'application, et la clé API est récupérée puis enregistrée toute seule — aucun copier-coller manuel n'est nécessaire.

    Si le navigateur ne s'ouvre pas, dépliez la section **Facultatif : connectez votre compte en saisissant une clé API manuellement**, au bas de la page Compte, et collez-y la clé commençant par `lkai_` récupérée dans le [tableau de bord](https://linkly.ai/dashboard/integrations). Le résultat est identique.
  </Step>

  <Step title="Vérifier que le fournisseur est prêt">
    Ouvrez **Paramètres → IA → Fournisseurs** : la carte **Linkly Official** doit afficher **Prêt**. Si elle affiche **Configuration requise**, c'est que la connexion n'a pas encore eu lieu — revenez à l'étape précédente.

    Ouvrez la boîte de dialogue des paramètres de la carte : **Actualiser** (si des modèles sont déjà listés) ou **Ajouter des modèles** (s'il n'y en a aucun) récupère depuis le serveur la liste des modèles actuellement disponibles : après une mise à jour du catalogue côté serveur, un clic suffit à la synchroniser.
  </Step>

  <Step title="Choisir un modèle et discuter">
    Ouvrez le Chatbot : le sélecteur de modèle se trouve dans la **barre d'outils à droite de la zone de saisie**, avec les modèles regroupés par fournisseur. Les modèles officiels portent un badge de multiplicateur ; le survol indique combien d'unités de quota une requête consomme environ.

    **Paramètres → IA** permet en outre de définir le modèle utilisé par défaut dans les nouvelles conversations, ainsi qu'une langue de réponse fixe.
  </Step>
</Steps>

***

## Quels modèles sont proposés

Le catalogue officiel se divise en deux niveaux :

* **Les modèles de base** — accessibles à tous, dotés d'un quota gratuit, adaptés aux questions du quotidien et à la découverte.
* **Les modèles de pointe** — réservés à l'abonnement Pro, nettement plus puissants.

<Note>**La liste exacte des modèles, leur multiplicateur et leur fenêtre de contexte sont ceux qu'affiche réellement le sélecteur de modèle dans l'application.** Le catalogue est diffusé par le serveur et évolue au gré des tarifs des fournisseurs et des nouvelles sorties.</Note>

Les comptes gratuits **ne voient pas les modèles de pointe** dans la liste (le serveur les filtre en amont) : impossible, donc, de sélectionner un modèle pour découvrir ensuite qu'il est hors de portée.

***

## Le quota

Cette section mérite deux minutes d'attention : c'est elle qui détermine « ce que vous pouvez réellement consommer ».

### Un pot commun, ni tokens ni nombre de requêtes

Les modèles officiels **ne sont facturés ni au token, ni avec un nombre de requêtes propre à chaque modèle**. Tous puisent dans **le même pot de quota**, et chacun possède son **multiplicateur** : une requête retire du pot la quantité correspondante.

> **1 unité de quota = une requête envoyée à un modèle de multiplicateur ×1.**

Plus le multiplicateur est bas, plus le modèle est économe : un modèle en ×0,5 ne retire qu'une demi-unité par requête, un modèle en ×4 en retire quatre. Le multiplicateur de chaque modèle figure sur le badge du sélecteur de modèle, et le survol indique approximativement ce que la requête coûtera.

<Tip>**Les modèles de base pour les questions du quotidien, les modèles de pointe uniquement lorsqu'un vrai raisonnement approfondi est nécessaire** : c'est de loin l'usage le plus avantageux — à pot de quota égal, un écart de multiplicateur se traduit par un écart équivalent sur le nombre d'échanges possibles.</Tip>

### Trois fenêtres temporelles parallèles

Le pot de quota est encadré par **trois fenêtres temporelles : 5 heures, 7 jours et 30 jours**, calculées indépendamment les unes des autres. **Dès qu'une seule d'entre elles est saturée, vous êtes limité** — même s'il reste de la marge sur les deux autres. La fenêtre de 5 heures évite une consommation concentrée sur un temps très court ; celles de 7 et 30 jours encadrent la consommation d'ensemble.

Les comptes Pro disposent, sur les trois fenêtres, d'un quota nettement supérieur à celui des comptes gratuits.

<Note>**Les valeurs exactes de chaque formule sont celles du panneau de quota de l'application et du [site officiel](https://linkly.ai/pricing).** Cliquez sur le **bouton de quota** au bas de la barre latérale du Chatbot pour voir en temps réel la marge restante sur les trois fenêtres et leur heure de réinitialisation respective.</Note>

<Note>Il s'agit de **fenêtres fixes**, sur le modèle de ChatGPT ou de Claude : le décompte démarre à votre première requête facturée du cycle, et à l'échéance **le quota est intégralement restauré d'un coup**.</Note>

### Ce qui consomme du quota, et ce qui n'en consomme pas

| Action                                                                     | Consomme du quota |
| -------------------------------------------------------------------------- | ----------------- |
| Vous envoyez un nouveau message (nouveau tour de question-réponse)         | **Oui**           |
| L'IA appelle plusieurs fois ses outils de recherche et lit des documents   | Non               |
| Génération automatique du titre de conversation, compactage via `/compact` | Oui               |
| Consultation du panneau de quota                                           | Non               |
| Utilisation d'un modèle tiers ou local                                     | Non               |

**Le fait que les appels d'outils ne soient pas facturés séparément** est un choix de conception important : dans un même tour, l'IA peut lancer sept ou huit recherches et lire une dizaine de fichiers — le tout partage l'unique décompte effectué au moment où vous avez envoyé votre message. Autrement dit, « combien de questions ai-je posées aujourd'hui » équivaut à peu près à « combien de quota ai-je consommé » : une IA zélée ne vous coûte pas davantage.

***

## Où consulter son quota, et que se passe-t-il une fois épuisé

### Où le consulter

Deux points d'entrée :

1. Le **bouton de quota** (icône de jauge) au bas de la barre latérale de la fenêtre Chatbot. Il ouvre le panneau **Quota du modèle**, avec une ligne par fenêtre — **Quota 5 h**, **Quota 7 j**, **Quota 30 j** — chacune indiquant le **restant / total** et **l'heure de réinitialisation**.
2. La page d'accueil de la [console](https://linkly.ai/dashboard) web.

<Note>Sans connexion, cet emplacement affiche « Connectez-vous à votre compte Linkly pour voir votre quota » ; hors ligne, il affiche « Impossible de charger le quota — vérifiez votre connexion ». **Les modèles officiels exigent une connexion Internet** : c'est la différence la plus concrète avec un modèle local.</Note>

### Que se passe-t-il une fois épuisé

Lorsqu'une fenêtre est saturée, vous **envoyez votre message comme d'habitude**, mais le tour échoue aussitôt et un bandeau apparaît dans la conversation, indiquant sans détour quelle fenêtre est pleine et quand elle repart :

| Fenêtre saturée | Ce que vous voyez                                                                       |
| --------------- | --------------------------------------------------------------------------------------- |
| 5 heures        | « Limite de quota Linkly AI atteinte (X utilisations sur N h). Reprise à `heure`. »     |
| 7 jours         | « Limite hebdomadaire de quota atteinte (X utilisations sur 7 jours). Reprise `date`. » |
| 30 jours        | « Limite mensuelle de quota atteinte (X utilisations sur 30 jours). Reprise `date`. »   |

Quelques points utiles à connaître :

* **Les conversations existantes ne sont pas perdues.** La limitation ne concerne que cette requête-là : historique des messages, liste des conversations et index de recherche restent intacts.
* **C'est le pot commun qui est limité, pas un modèle en particulier.** Les trois fenêtres puisent dans le même pot : une fois saturé, **passer à un modèle officiel de multiplicateur plus faible ne change rien** — un multiplicateur bas réduit « combien chaque requête retire », pas « le droit d'en envoyer une ».
* **Les modèles tiers et locaux ne sont absolument pas concernés** : ils empruntent une autre voie et ne passent pas par le quota officiel (voir la section suivante).
* **Aucune démarche à faire** : la restauration est intégrale et automatique à l'échéance.

Face à une limitation, il ne reste donc en pratique que deux options : **attendre la réinitialisation de la fenêtre**, ou **basculer sur un modèle tiers ou local** pour continuer. La vraie façon d'économiser du quota consiste à prendre l'habitude avant d'être limité : les modèles de base au quotidien, les modèles de pointe seulement quand un raisonnement approfondi est nécessaire.

***

## On peut aussi se passer du service officiel (BYOK)

Le service de modèles officiel n'a rien d'obligatoire. Le Chatbot accepte **n'importe quel point de terminaison compatible OpenAI**, à ajouter depuis **Paramètres → IA → Fournisseurs → Fournisseur personnalisé**.

À l'ajout, 12 préréglages permettent de remplir l'adresse rapidement :

| Groupe | Préréglages                                 |
| ------ | ------------------------------------------- |
| Cloud  | OpenAI, DeepSeek, Mistral, Groq, OpenRouter |
| Chine  | Qwen, MiniMax, Moonshot, Zhipu, SiliconFlow |
| Local  | Ollama, LM Studio                           |

<Note>Un préréglage **ne pré-remplit que l'URL de base**, jamais la liste des modèles. Une fois l'adresse saisie, les modèles peuvent être découverts automatiquement depuis le point de terminaison `/v1/models` du fournisseur, ou saisis manuellement par leur identifiant. Les services locaux (Ollama, LM Studio) **ne réclament généralement aucune clé API** : laissez le champ vide.</Note>

### Comment choisir son service de modèles

| Formule                        | Clé à fournir | Quota / facturation                                  | Trajet des données                                                  | Pour qui                                                |
| ------------------------------ | ------------- | ---------------------------------------------------- | ------------------------------------------------------------------- | ------------------------------------------------------- |
| **Linkly AI officiel**         | Non           | Pot de quota commun, disponible en gratuit           | Transitent par les serveurs Linkly AI puis le fournisseur           | Vous voulez démarrer tout de suite, sans configurer     |
| **Point de terminaison tiers** | Oui           | Vous réglez directement le fournisseur               | Connexion directe à l'API du fournisseur, sans passer par Linkly AI | Vous avez déjà du crédit API, ou visez un modèle précis |
| **Modèle local**               | Non           | Gratuit, au prix de votre propre puissance de calcul | **Ne quittent jamais votre machine**                                | Vous ne tolérez aucune sortie de données                |

<Warning>Si un fournisseur personnalisé ne renvoie pas le champ `context_length` (cas très fréquent avec Ollama et LM Studio en local), l'application ignore la taille de la fenêtre de contexte du modèle — **le pourcentage d'utilisation ne s'affiche pas, et le compactage automatique ne se déclenche jamais**. Avec ce type de modèle, surveillez vous-même la longueur de la conversation et lancez un `/compact` manuel ou une nouvelle conversation au bon moment. Voir [Utiliser le Chat IA](/docs/fr/use-chatbot).</Warning>

***

## Trajet des données et confidentialité

Disons les choses franchement, chemin par chemin :

| Capacité                                   | Trajet des données                                                                                                 |
| ------------------------------------------ | ------------------------------------------------------------------------------------------------------------------ |
| **Modèle de langage · Linkly AI officiel** | Les données passent d'abord par les serveurs de Linkly AI, qui les transmettent ensuite au fournisseur sélectionné |
| **Modèle de langage · tiers en direct**    | Connexion directe à l'API du fournisseur, sans passer par Linkly AI                                                |
| **Modèle de langage · modèle local**       | Avec Ollama ou un modèle local personnalisé, la conversation ne quitte pas la machine                              |
| **Génération d'embeddings**                | Exécution locale ; seul le fichier de modèle est téléchargé depuis le CDN officiel au premier lancement            |
| **Reconnaissance de texte (OCR)**          | Exécution locale ; seul le fichier de modèle est téléchargé à la première utilisation                              |

<Warning>Utiliser le service de modèles officiel signifie que le contenu des messages que vous envoyez — **y compris les extraits de documents retrouvés par l'IA pour répondre** — **transite par les serveurs de Linkly AI avant d'être transmis au fournisseur de modèles en amont**. C'est le prix inhérent à un service de relais, et nous n'allons pas prétendre le contraire.</Warning>

La page **Paramètres → Confidentialité des données** de l'application liste en temps réel les capacités qui envoient actuellement des données vers l'extérieur : vous pouvez la consulter à tout moment.

<Note>Chaque requête de conversation transmet le **nom et la version de l'application** (en-têtes HTTP), à des fins d'attribution chez le fournisseur tiers. **Aucun identifiant personnel n'y figure.**</Note>

***

## Questions fréquentes

<AccordionGroup>
  <Accordion title="Peut-on utiliser le Chatbot sans se connecter ?">
    Oui, mais il faut alors fournir soi-même une source de modèles : ajoutez un point de terminaison tiers, ou un Ollama / LM Studio local, depuis **Paramètres → IA**. Le service de modèles officiel est la seule partie qui exige une connexion ; la [recherche](/docs/fr/use-launcher), l'indexation, le MCP et les autres capacités locales n'ont besoin d'aucun compte.
  </Accordion>

  <Accordion title="Le quota, est-ce un nombre de requêtes par jour ?">Non. Les trois fenêtres (5 heures / 7 jours / 30 jours) **s'appliquent simultanément et se calculent indépendamment** : une seule saturée suffit à déclencher la limitation. Un usage intensif sur un temps court se heurte donc d'abord à la fenêtre de 5 heures, tandis qu'un usage régulier et étalé rencontrera plutôt la contrainte des 30 jours.</Accordion>

  <Accordion title="Combien d'échanges gagne-t-on en passant à un modèle moins cher ?">Regardez simplement le multiplicateur : le rapport est direct. Un écart de multiplicateur d'un facteur cinq se traduit par cinq fois plus d'échanges pour un même pot de quota. Le badge de chaque modèle officiel affiche son multiplicateur dans le sélecteur — un coup d'œil avant de changer suffit à faire le calcul.</Accordion>

  <Accordion title="Le quota du service de modèles affecte-t-il la recherche dans les bibliothèques cloud ?">Non, ce sont **deux lignes totalement indépendantes**. Le quota de conversation ne comptabilise que l'inférence des modèles ; la recherche dans les [bibliothèques cloud](/docs/fr/use-cloud-library) et l'[accès distant](/docs/fr/use-in-remote) obéissent à leurs propres règles et ne se disputent rien.</Accordion>

  <Accordion title="Pourquoi Gemini ne figure-t-il pas dans les préréglages ?">
    Le point de terminaison compatible OpenAI de Gemini exige que la clé soit placée dans le paramètre d'URL `?key=`, et non dans l'en-tête standard `Authorization: Bearer` ; la chaîne de conversation actuelle ne gère pas encore ce mode d'authentification.

    Par ailleurs, la prise en charge des appels d'outils par Gemini reste insuffisante. Nous suivons la question de près et l'ajouterons dès que ce sera au point.
  </Accordion>

  <Accordion title="Faut-il tout reconfigurer en changeant d'ordinateur ? Et si le panneau de quota me demande de me connecter ?">
    Pour le service de modèles officiel, il suffit de se connecter au même compte sur la nouvelle machine : le quota **suit le compte** (les trois fenêtres sont comptabilisées par compte, jamais par appareil). Le message **Connectez-vous à votre compte Linkly pour voir votre quota** signale simplement que cet appareil n'est pas encore relié au compte : rendez-vous dans **Paramètres → Compte** et cliquez sur **Se connecter**. Si le message persiste alors que vous êtes connecté, c'est le plus souvent que la clé n'est plus valide — déconnectez-vous et reconnectez-vous. L'adresse et la clé des fournisseurs personnalisés, elles, sont enregistrées localement : il faut les ajouter à nouveau sur la nouvelle machine.
  </Accordion>
</AccordionGroup>

***

## Pour aller plus loin

* [Utiliser le Chat IA](/docs/fr/use-chatbot) — l'usage complet de la fenêtre de conversation, les mentions `@` et le compactage du contexte
* [Utiliser les bibliothèques cloud](/docs/fr/use-cloud-library) — rendre une bibliothèque disponible 24h/24 indépendamment de votre machine
* [Accès distant](/docs/fr/use-in-remote) — laisser une IA en ligne accéder aux documents de votre machine
* [Questions fréquentes](/docs/fr/faq) — les autres interrogations courantes
* [Compte Linkly AI](/docs/fr/linkly-account) — modes de connexion, clés API et avantages Pro
