LM Studio

Ejecuta modelos abiertos en tu propia máquina: chat, un agente, transcripción de voz sin conexión y un servidor local. Gratis, con créditos de nube opcionales de pago por uso.

Ir a la IA
LM Studio cover

¿Qué es LM Studio?

LM Studio es una aplicación de escritorio para ejecutar modelos de lenguaje abiertos en tu propio ordenador. Lo instalas, exploras un catálogo, descargas un modelo y empiezas a escribir: sin terminal, sin entorno de Python, sin archivos de configuración. Para la mayoría es el camino más corto entre la curiosidad por la IA local y hablar de verdad con un modelo.

Por debajo están llama.cpp y MLX, los dos motores de inferencia sobre los que corre la mayor parte de la IA local. La aportación de LM Studio es la capa que va encima: un navegador de modelos que te dice qué cabe en tu memoria, una interfaz de chat, un servidor local detrás de un interruptor y ahora un agente llamado Bionic capaz de trabajar con documentos y código en lugar de solo responder preguntas.

Ha crecido más allá de un lanzador de modelos. La aplicación hace transcripción de voz sin conexión en varios idiomas, se sincroniza entre hasta cinco dispositivos y puede alcanzar modelos en la nube cuando uno local no basta. El plan gratuito cubre toda la capacidad local, y no es una versión recortada del producto: es el producto.

Cómo funciona

Descargar un modelo sin adivinar

El navegador de modelos es la función que en silencio más importa. Cada modelo abierto existe en varios tamaños y varias cuantizaciones, y la diferencia entre una versión que funciona de maravilla y otra que deja tu máquina inservible no se deduce del nombre. LM Studio inspecciona tu hardware y te dice qué compilaciones caben.

Esa única indicación elimina el fallo inicial más habitual con la IA local: descargar algo enorme, verlo arrastrarse y concluir que los modelos locales no sirven. No es que no sirvan: elegiste el equivocado, y nada en el nombre del archivo iba a avisarte.

Bionic y el paso de la charla al trabajo

Bionic es el agente de LM Studio para modelos abiertos. En lugar de limitarse a responder en una ventana de chat, crea y edita documentos guardándolos por su cuenta, trabaja con código y puede manejar el ordenador. Apunta al mismo cambio que está ocurriendo en todo este campo: de un modelo que responde a un modelo que hace.

Lo interesante es que está pensado para modelos abiertos y no para los de frontera. Un agente necesita ejecutar muchos pasos, y muchos pasos contra una API medida son la vía más rápida a una factura desagradable. Ejecutar el bucle en local cambia esa aritmética por completo: el coste marginal del décimo intento es cero.

Un servidor local y SDK de verdad

Detrás de la aplicación hay un servidor que arrancas con lms server start y que expone endpoints compatibles con OpenAI para chat completions y embeddings. Hay SDK oficiales para TypeScript y Python, una CLI para gestionar modelos y el demonio, y autenticación por token bearer en la API REST: un detalle poco común y de agradecer, porque la mayoría de servidores locales están abiertos a cualquier cosa que corra en la máquina.

Esto es lo que convierte a LM Studio en algo más que una aplicación de consumo. La misma instalación sirve a quien quiere una ventana de chat y a quien quiere un endpoint programable, y ninguno de los dos tiene que enterarse de que el otro existe.

Cuánto cuesta

La aplicación local es gratuita, y el plan gratuito es inusualmente completo. El dinero solo entra en juego cuando recurres a modelos en la nube.

QuéPrecioNotas
La aplicación y los modelos locales0 $llama.cpp y MLX, nada sale del dispositivo
Agente Bionic0 $Incluido en el plan gratuito
Transcripción de voz sin conexión0 $Procesada en local, varios idiomas
Herramienta de búsqueda web0 $Retención cero de datos al iniciar sesión
LM Link0 $Sincronización de hasta 5 dispositivos
Nube: DeepSeek V4 Flash0,13 $ entrada / 0,26 $ salidaPor millón de tokens
Nube: GLM-5.3-Flash0,15 $ entrada / 0,50 $ salidaPor millón de tokens
Nube: DeepSeek V4 Pro1,74 $ entrada / 3,48 $ salidaPor millón de tokens
Nube: Kimi K33,00 $ entrada / 15,00 $ salidaPor millón de tokens
Bionic PassAún sin anunciarLa compañía dice que dará detalles

No hay suscripción para ejecutar modelos en local ni licencias por puesto que leer. El uso de nube se compra como créditos y se cobra por millón de tokens, con retención cero de datos declarada en los servicios en la nube. La diferencia entre el modelo más barato y el más caro de la lista supera el factor veinte en tokens de salida, así que elegir modelo es toda la conversación sobre el coste.

Como en cualquier herramienta local, el gasto real es el hardware. Dieciséis gigas de memoria mueven con gusto modelos pequeños; treinta y dos o más abren los tamaños a los que se refiere la gente cuando dice que un modelo local le resultó realmente útil.

Quién le saca más partido

Quien prueba la IA local por primera vez

Esta es la recomendación que darle a alguien que ha oído que los modelos pueden correr en un portátil y quiere verlo. Instalar, descargar un modelo sugerido, escribir. Quince minutos, sin terminal, y la orientación sobre hardware evita que elija algo que le decepcione.

Quien trabaja con texto confidencial

Contratos, notas de pacientes, cuentas no publicadas, informes internos de incidentes. El procesamiento local no es una política de privacidad en la que haya que confiar: es un hecho arquitectónico, y la transcripción sin conexión lo extiende a las grabaciones de reuniones.

Desarrolladores que quieren las dos mitades

Una interfaz para explorar cómo se comporta un modelo y un endpoint compatible con OpenAI para construir contra él, en una sola instalación. Poder ver una conversación y reproducirla acto seguido desde el SDK acorta el ciclo de forma apreciable.

Trabajo de agentes que saldría caro con contador

Las cadenas largas de llamadas a herramientas, los reintentos y la autocorrección queman tokens. Ejecutar ese bucle contra pesos locales quita el contador, y eso cambia lo que estás dispuesto a dejar que un agente intente.

A qué prestar atención

  • La aplicación es gratuita, pero no es de código abierto como sí lo son llama.cpp y MLX por debajo. Si tu requisito es código auditable, esta no es la capa que debes mirar.
  • Los modelos locales van por detrás de los de frontera en razonamiento difícil y contexto largo. La comodidad no cierra esa diferencia.
  • Bionic Pass no tiene precio anunciado. Presupuestar en torno a un plan cuyo coste no está publicado no es algo que se haga por fe.
  • La memoria es el techo. Un modelo que no cabe no va lento: a menudo directamente no arranca.
  • Los precios de los modelos en la nube varían más de veinte veces. Recurrir por defecto a la opción más potente es la forma en que una herramienta gratuita empieza a generar facturas.
  • Un agente en tu máquina tiene alcance sobre tu máquina. La ejecución local es a la vez una ganancia de privacidad y una cuestión de permisos.

Preguntas frecuentes

¿LM Studio es gratis?

Sí para todo lo local: la aplicación, los modelos, el agente Bionic, la transcripción sin conexión y la sincronización de cinco dispositivos. Solo pagas por el uso de modelos en la nube, comprado como créditos y cobrado por millón de tokens.

¿En qué sistemas funciona?

Windows, macOS y Linux, con scripts de instalación para cada uno. Apple Silicon está especialmente bien atendido porque MLX lo tiene como objetivo directo y la memoria es compartida con la GPU.

¿Funciona sin conexión a internet?

Una vez descargados los modelos, sí. El chat, la transcripción y el servidor local funcionan sin conexión. Necesitas red para descargar modelos, usar la búsqueda web o alcanzar modelos en la nube.

¿En qué se diferencia de Ollama?

Ollama es una herramienta de línea de comandos y un servidor; LM Studio es una aplicación que miras. Si tu objetivo es usar tú un modelo, LM Studio es el mejor punto de partida. Si tu objetivo es que tu software llame al modelo, Ollama es la opción más ligera. Conviven sin problema en una misma máquina.

¿Puedo usarlo como sustituto de la API de OpenAI?

En buena medida sí. Arranca el servidor, apunta tu URL base a él y usa los endpoints de chat y embeddings compatibles con OpenAI. Ten en cuenta que la API REST espera un token bearer, así que no está tan abierta como algunos servidores locales.

¿Cuánta memoria necesito?

Los modelos pequeños van cómodos en 8–16 GB. Treinta y dos gigas o una GPU dedicada es donde los modelos locales dejan de parecer una demostración. El navegador de modelos te dirá qué puede con tu máquina concreta, que es más útil que cualquier regla general.

En resumen

LM Studio es la entrada más amable a ejecutar IA en tu propio hardware, y ha crecido hasta ser algo más sustancial de lo que esa descripción sugiere. El navegador de modelos elimina el error que aparta a la mayoría de la IA local, el agente hace que los modelos abiertos sirvan para trabajar y no solo para conversar, y el servidor implica que la misma instalación también atiende a desarrolladores.

Júzgalo por el plan gratuito, porque ese es el producto honesto: capacidad local completa, sin suscripción y sin que nada salga de la máquina. Los créditos de nube están ahí para cuando un modelo local no basta, y la única disciplina necesaria es recordar que al usarlos has cruzado una línea.

Herramientas Alternativas