Skip to main content

Qué es el servicio de modelos

El Chatbot de la aplicación de escritorio necesita un modelo de lenguaje que lo mueva. Hasta ahora eso significaba registrarse en algún proveedor, activar un método de pago, crear una clave API y volver para rellenar un montón de ajustes. El servicio de modelos es el acceso a modelos en la nube que opera Linkly AI: inicias sesión y ya puedes ponerte a hablar, sin traer ninguna clave API ni asociar ninguna tarjeta. Incluye una selección de modelos que en nuestras pruebas se comportaron mejor.

Cero configuración para empezar

Se usa con solo iniciar sesión, las cuentas gratuitas también tienen cuota y no hace falta tarjeta de crédito

Un saldo unificado

Ni por tokens ni por número de peticiones: todos los modelos comparten un mismo saldo
El servicio de modelos se ocupa únicamente de la inferencia conversacional. La indexación de los documentos, el reconocimiento de texto (OCR) y la transcripción de voz (ASR) se ejecutan enteramente en tu equipo y no tienen nada que ver con este servicio: aunque no uses en absoluto los modelos oficiales, la búsqueda sigue funcionando igual.

Cómo empezar a usarlo

1

Inicia sesión

Abre Ajustes → Cuenta y pulsa Iniciar sesión. El navegador abrirá la página de autorización y, al terminar, volverás automáticamente a la aplicación: la clave API la obtiene y la guarda ella sola, sin que tengas que copiar ni pegar nada.Si el navegador no llega a abrirse, despliega el bloque Opcional: conecta tu cuenta configurando una clave API manualmente que hay al final de la página de cuenta y pega ahí la clave que empieza por lkai_ de la consola; el efecto es el mismo.
2

Comprueba que el proveedor está listo

Abre Ajustes → IA → Proveedores: la tarjeta Linkly Official debería aparecer como Listo. Si pone Requiere configuración, es que aún no has iniciado sesión; vuelve al paso anterior.Abre el diálogo de ajustes de esa tarjeta: Actualizar (si ya hay modelos listados) o Añadir modelos (si no hay ninguno) descarga del servidor la lista de modelos disponibles en ese momento: cuando el servidor actualice el catálogo, basta con pulsarlo una vez para sincronizarlo.
3

Elige un modelo y ponte a hablar

Abre el Chatbot: el selector de modelo está en la barra de herramientas a la derecha del cuadro de texto, agrupado por proveedor. Los modelos oficiales llevan una insignia con su multiplicador y, al pasar el ratón por encima, se ve cuánta cuota consume aproximadamente cada petición.En Ajustes → IA también puedes fijar el modelo predeterminado de las conversaciones nuevas y el idioma fijo de las respuestas.

Qué modelos hay

El catálogo oficial tiene dos niveles:
  • Modelos básicos — disponibles para todo el mundo, con cuota gratuita incluida, ideales para preguntas del día a día y para probar.
  • Modelos de vanguardia — requieren suscripción Pro y son bastante más capaces.
Qué modelos hay exactamente, con qué multiplicador y con qué ventana de contexto, es lo que muestre el selector de modelo dentro de la aplicación. El catálogo lo envía el servidor y se ajusta según los precios de los proveedores y los modelos que van saliendo.
Las cuentas gratuitas no ven los modelos de vanguardia en la lista (el servidor los filtra de entrada), así que no se da el caso de «elegir un modelo y descubrir luego que no puedes usarlo».

La cuota

Vale la pena dedicarle dos minutos a esta sección: es la que determina cuánto puedes usar de verdad.

Un saldo compartido, ni por tokens ni por número de peticiones

Los modelos oficiales no se cobran por token, ni reparten un número de usos a cada modelo por separado. Todos comparten un mismo saldo y cada modelo tiene su propio multiplicador, de modo que una petición descuenta del saldo la cantidad correspondiente:
1 unidad de cuota = una petición a un modelo con multiplicador ×1.
Cuanto más bajo es el multiplicador, menos cuota gasta el modelo: uno con ×0,5 descuenta media unidad por petición y uno con ×4 descuenta cuatro. El multiplicador de cada modelo está en la insignia del selector de modelo y, al pasar el ratón por encima, se ve aproximadamente cuánta cuota consume.
Usar los modelos básicos para el día a día y cambiar a los de vanguardia solo cuando de verdad hace falta razonar en profundidad es la forma más rentable de aprovechar el saldo: con el mismo saldo, unos pocos puntos de diferencia en el multiplicador cambian por completo cuántos turnos de conversación te salen.

Tres tramos temporales en paralelo

El saldo se mide en tres tramos temporales: 5 horas, 7 días y 30 días, que se calculan de forma independiente. Basta con llenar uno cualquiera de ellos para quedar limitado, aunque en los otros dos quede saldo de sobra. El tramo de 5 horas evita un consumo concentrado en poco tiempo, y los de 7 y 30 días controlan el uso general. Las cuentas Pro tienen bastante más cuota que las gratuitas en los tres tramos.
Las cifras concretas de cada plan son las que digan el panel de cuota de la aplicación y el sitio web. Pulsando el botón de cuota al final de la barra lateral del Chatbot verás el saldo en tiempo real de los tres tramos y a qué hora se restablece cada uno.
Los tramos son de ventana fija, parecidos a los de ChatGPT o Claude: empiezan a contar con tu primera petición facturable del periodo y, al vencer, el saldo se restablece de golpe.

Qué descuenta cuota y qué no

Que las llamadas a herramientas no se facturen aparte es una decisión de diseño importante: en un solo turno la IA puede buscar siete u ocho veces y leer una docena de archivos, y todo eso comparte el único descuento que se hizo al enviar tu mensaje. Así, «cuántas preguntas he hecho hoy» equivale más o menos a «cuánta cuota he gastado», y no se te penaliza porque la IA trabaje a fondo.

Dónde se ve la cuota y qué pasa al agotarla

Dónde se ve

Hay dos sitios:
  1. El botón de cuota (icono de cuadro de mandos) al final de la barra lateral de la ventana del Chatbot. Se abre el panel Cuota del modelo, con una fila por tramo — Cuota 5 h, Cuota 7 d y Cuota 30 d —, y en cada una el restante / total y cuándo se restablece.
  2. La página de inicio de la consola web.
Sin la sesión iniciada, ahí pone «Inicia sesión en tu cuenta de Linkly para ver tu cuota»; y sin conexión, «No se pudo cargar la cuota — comprueba tu conexión»: los modelos oficiales necesitan internet, y esa es la diferencia más práctica frente a un modelo local.

Qué pasa al agotarla

Cuando se llena uno de los tramos puedes seguir enviando mensajes con normalidad, pero ese turno falla de inmediato y en la conversación aparece un aviso que dice directamente qué tramo se ha llenado y cuándo se recupera: Lo que va en negrita lo rellena la aplicación según tu plan: N es el total de la cuota de ese tramo, y detrás viene el momento exacto en que se recupera. Así que no tienes que calcular nada: el aviso ya te lo dice. Conviene saber varias cosas:
  • No se pierde ninguna conversación. El límite solo afecta a esa petición; el historial, la lista de conversaciones y los índices de búsqueda no se ven afectados.
  • Lo que queda limitado es el saldo entero, no un modelo concreto. Los tres tramos comparten el mismo saldo, así que una vez lleno no sirve de nada cambiar a un modelo oficial con multiplicador más bajo: un multiplicador bajo ahorra en «cuánto descuenta cada vez», no decide «si puedes enviar».
  • Los modelos de terceros y los locales no se ven afectados en absoluto: van por otro camino y no pasan por la cuota oficial (ver la sección siguiente).
  • No hay que solicitar nada: al vencer el tramo, el saldo se restablece solo y por completo.
Así que ante un límite solo quedan de verdad dos salidas: esperar a que se restablezca el tramo o pasarte a un modelo de terceros o local. Lo que sí ahorra cuota es el hábito de antes de llegar al límite: modelos básicos para el día a día, y los de vanguardia solo cuando hace falta razonar en profundidad.

También puedes no usar el servicio oficial (BYOK)

El servicio de modelos oficial no es obligatorio. El Chatbot admite cualquier endpoint compatible con OpenAI, y se añade en Ajustes → IA → Proveedores → Proveedor personalizado. Al añadirlo hay 12 preajustes que rellenan la dirección al instante:
Los preajustes solo rellenan la Base URL, sin traer lista de modelos. Una vez puesta la dirección, puedes descubrir los modelos automáticamente desde el endpoint /v1/models de ese proveedor, o escribir los identificadores a mano. Los servicios locales (Ollama / LM Studio) normalmente no necesitan clave API: basta con dejarla vacía.

¿Cómo elegir el servicio de modelos?

Si un proveedor personalizado no devuelve el campo context_length (muy habitual en Ollama / LM Studio locales), la aplicación no sabe cuál es la ventana de contexto del modelo: no se muestra el porcentaje de uso y la compactación automática nunca llega a dispararse. Con esos modelos, vigila tú la longitud de la conversación y lanza /compact a mano o abre una conversación nueva cuando toque. Más detalles en Chat con IA.

Recorrido de los datos y privacidad

Vamos a decir con honestidad adónde van los datos en cada camino:
Usar el servicio de modelos oficial significa que el contenido de los mensajes que envías, incluidos los fragmentos de documento que la IA haya recuperado para responder, pasa por los servidores de Linkly AI antes de llegar al proveedor de modelos. Es el coste inherente a un servicio de intermediación y no lo escondemos.
La página Ajustes → Privacidad de la aplicación enumera en todo momento qué capacidades están enviando datos hacia fuera, para que puedas comprobarlo cuando quieras.
Cada petición de conversación lleva el nombre y la versión de la aplicación en cabeceras HTTP, para la atribución ante los proveedores externos; no incluye ningún dato de identidad.

Preguntas frecuentes

Sí, pero tendrás que aportar tú un origen de modelos: en Ajustes → IA, añade un endpoint de terceros o un Ollama / LM Studio local. El servicio de modelos oficial es la única parte que exige iniciar sesión; la búsqueda, la indexación, el MCP y demás capacidades locales no necesitan cuenta.
No. Los tres tramos (5 horas / 7 días / 30 días) están vigentes a la vez y son independientes entre sí, y basta con llenar uno para quedar limitado. Por eso un uso intenso en poco tiempo suele chocar primero con el tramo de 5 horas, mientras que un uso lento pero constante acaba topando con el de 30 días.
Míralo directamente en el multiplicador: la relación es exactamente proporcional. Si un multiplicador es cinco veces menor que otro, con el mismo saldo hablas cinco veces más. Cada modelo oficial lleva su multiplicador en la insignia del selector de modelo, así que basta con echar un vistazo antes de cambiar.
No, son dos líneas completamente independientes. La cuota de conversación solo contabiliza la inferencia del modelo; la búsqueda en bibliotecas en la nube y el acceso remoto tienen sus propias reglas y no se comen la una a la otra.
El endpoint compatible con OpenAI de Gemini exige poner la clave en el parámetro ?key= de la URL en lugar de en la cabecera estándar Authorization: Bearer, y la cadena de conversación actual todavía no admite ese tipo de autenticación.Además, el soporte de Gemini para las llamadas a herramientas aún no es suficiente. Lo seguimos de cerca y lo añadiremos cuando esté a punto.
Para el servicio de modelos oficial basta con iniciar sesión con la misma cuenta en el nuevo equipo: la cuota va con la cuenta (los tres tramos se contabilizan por cuenta, no por dispositivo). Si el panel de cuota dice que inicies sesión en tu cuenta de Linkly para verla, es que este equipo todavía no está conectado a la cuenta: ve a Ajustes → Cuenta y pulsa iniciar sesión. Si ya has iniciado sesión y aun así te lo pide, lo más probable es que la clave haya dejado de valer; cierra sesión y vuelve a entrar. La dirección y la clave de los proveedores personalizados se guardan en el equipo, así que al cambiar de ordenador hay que volver a añadirlos.

Lecturas adicionales