FLUX
la familia de modelos de imagen y vídeo de Black Forest Labs
Empresa francesa cuyos modelos insignia se publican con pesos abiertos y cuya API sale más barata que la de los laboratorios estadounidenses. El asistente ahora se llama Vibe, no Le Chat. El plan gratuito incluye 10 $ al mes en créditos de API.

Mistral es una empresa francesa que construye modelos de vanguardia y, algo insólito a ese nivel, publica los pesos de la mayoría. Vende un asistente, un agente de programación, una API y una plataforma para entrenar tus propios modelos, y es la única opción europea que compite de forma creíble con los laboratorios estadounidenses en capacidad y no solo en precio.
Conviene aclarar algo primero, porque vuelve confusos los artículos antiguos: el asistente ahora se llama Vibe. El nombre Le Chat, que es el que casi todo el mundo sigue buscando, ha desaparecido. El agente de programación es Vibe for code, y junto a ellos están Studio para construir agentes y aplicaciones, Forge para entrenar y ajustar modelos propios, y una AI Cloud para la infraestructura.
Lo que hace interesante a Mistral, y no solo competente, es su posición estratégica. Los pesos abiertos y la jurisdicción europea no son funciones: son la respuesta a dos preguntas que los modelos estadounidenses cerrados no pueden responder en absoluto.
La mayor parte de la gama de Mistral está marcada como abierta, y el modelo multimodal pequeño se publica bajo Apache 2.0, una licencia genuinamente permisiva y no un uso comercial de la palabra «abierto». El modelo insignia es un modelo multimodal de propósito general con pesos abiertos, y esa frase no puede escribirse sobre ningún modelo comparable de los mayores laboratorios estadounidenses.
Eso importa en tres situaciones concretas. Puedes ejecutar el modelo en tu propio hardware, así que nada sale del edificio. Puedes ajustarlo con tu propio material y quedarte el resultado. Y no quedas expuesto a que un proveedor retire el modelo sobre el que construiste, un riesgo que este año dejó de ser teórico.
Aun así, las licencias difieren dentro de la gama y las etiquetas de la página de precios no son todas iguales. Comprueba las condiciones del modelo concreto antes de dar por hecho que puedes desplegarlo comercialmente: la palabra «abierto» hace un trabajo distinto en cada fila.
El asistente: chat, búsqueda web, bibliotecas de documentos, generación de imágenes, modo de voz, lienzo, carpetas de proyecto, conectores y tareas programadas. Hace lo que se espera de un asistente moderno y lo hace notablemente rápido: la velocidad es un rasgo constante de Mistral y no una casualidad.
Agentes de programación que se ejecutan en una terminal, en un IDE o en remoto y en segundo plano. Hay observabilidad de agentes remotos y un sistema de hooks, lo que indica que el usuario previsto es un equipo metiendo agentes en un flujo de trabajo real y no alguien pidiendo fragmentos sueltos.
Studio es donde construyes, pruebas y ejecutas agentes y aplicaciones contra la API, con paneles de consumo. Forge sirve para entrenar, ajustar y evaluar modelos propios. Forge es la parte que se sigue lógicamente de los pesos abiertos: si puedes tener el modelo, deberías poder moldearlo.
Mistral es barato, y su estructura tiene una rareza que conviene detectar.
| Modelo o servicio | Entrada | Salida | Notas |
|---|---|---|---|
| Modelo insignia de propósito general | 0,50 $ / 1M de tokens | 1,50 $ / 1M de tokens | Pesos abiertos, multimodal, multilingüe |
| Modelo agéntico y de programación | 1,50 $ / 1M de tokens | 7,50 $ / 1M de tokens | Tareas de largo recorrido, llamada a herramientas |
| Modelo multimodal pequeño | 0,15 $ / 1M de tokens | 0,60 $ / 1M de tokens | Apache 2.0, para trabajo sensible al coste |
| OCR de documentos | 4 $ por 1000 páginas | — | 5 $ por 1000 con comprensión completa del documento |
| Transcripción de voz | 0,003 $ por minuto | — | Audio por lotes |
La rareza es esta: el modelo insignia de propósito general es más barato que el modelo agéntico de programación, cinco veces más barato en salida. Los nombres por tamaño no se corresponden aquí con el precio. Elige por tarea — razonamiento general y trabajo multimodal en el insignia, tareas agénticas y de programación largas en el más caro, rutina de gran volumen en el pequeño — y olvida la intuición de que lo más grande cuesta más.
Dos descuentos cambian bastante la aritmética. El procesamiento por lotes reduce el precio a la mitad para el trabajo que no necesita respuesta inmediata, y los tokens de entrada en caché cuestan hasta un noventa por ciento menos en instrucciones repetidas. Cualquier aplicación de gran volumen debería diseñarse para usar ambos.
Mistral además revende por la misma API algunos modelos de terceros, así que una empresa que se estandarice en él no queda atada a su propia gama. Y existe un nivel de API empresarial con controles regionales de procesamiento de datos, SLA a nivel de sistema y límites de tasa más altos, con un precio un 75 por ciento por encima de la tarifa: la soberanía está disponible y no es gratis.
| Plan | Precio | Qué incluye |
|---|---|---|
| Gratuito | 0 $ | Mensajes, búsquedas y sesiones de programación limitados, generación de imágenes, acceso a Studio, 10 $ al mes en créditos de API, más de 100 conectores |
| Pro | 14,99 $/mes | Alrededor de seis veces la asignación gratuita de mensajes, programación todo el día en CLI, IDE o web, 30 $ al mes en créditos de API, soporte por chat y correo |
| Team | 24,99 $ por usuario y mes | Todo lo de Pro más hasta 30 GB de almacenamiento por usuario, verificación de dominio y exportación de datos |
| Enterprise | Bajo consulta | Despliegues privados, modelos, agentes y flujos a medida, registros de auditoría, SAML SSO, marca blanca |
Pro es el más barato de los asistentes serios — un tercio menos que los veinte dólares habituales de la competencia estadounidense — e incluye treinta dólares en créditos de API, que para mucha gente cubren la suscripción por sí solos. También hay plan de estudiante.
Fíjate en que el plan gratuito no es una demostración capada: incluye diez dólares mensuales en créditos de API y acceso a Studio. Si quieres evaluar los modelos en serio antes de escribir una línea de código, es un punto de partida más generoso que la mayoría.
La exclusión del entrenamiento está disponible en todos los niveles, y conviene decirlo porque en este mercado no es universal.
El caso más claro con diferencia. Cuando la pregunta no es «qué modelo es mejor» sino «qué modelo podemos usar legalmente», una empresa europea que ofrece a la vez procesamiento regional de datos y pesos descargables la responde de una forma que nadie en California puede.
Defensa, sanidad, finanzas, sector público, o simplemente un negocio que ha decidido que sus datos no salen de sus máquinas. Los pesos abiertos convierten un requisito imposible en una decisión de infraestructura.
El modelo insignia a cincuenta céntimos por millón de tokens de entrada es una fracción de lo que cobran los modelos de vanguardia estadounidenses, y los descuentos por lotes y por caché se acumulan encima. Para trabajo de gran volumen donde no hace falta el mejor razonamiento posible, con la economía es difícil discutir.
El OCR por página y la transcripción por minuto están pensados para el volumen, y ambos son buenos. Si tu problema es un almacén de PDF o una década de grabaciones, esta es una respuesta concreta y bien tarifada, no un modelo general forzado a la tarea.
Ahora se llama Vibe. La misma idea con el nombre actual: el asistente en web y móvil, con un Vibe for code aparte para desarrollo agéntico en la terminal y el IDE.
Hay un plan gratuito con mensajes, búsquedas y sesiones de programación limitados, además de generación de imágenes, acceso a Studio y diez dólares al mes en créditos de API. Pro cuesta 14,99 $ al mes e incluye treinta dólares en créditos.
La mayor parte de la gama se publica con pesos abiertos, y el modelo multimodal pequeño va bajo Apache 2.0. Las licencias varían, así que lee las condiciones del modelo concreto que pienses desplegar en vez de suponer que toda la familia es permisiva.
Queda bastante por debajo de los laboratorios de vanguardia estadounidenses: el insignia cuesta cincuenta céntimos por millón de tokens de entrada y un dólar cincuenta de salida. El procesamiento por lotes reduce eso a la mitad, y la entrada en caché puede recortar el coste de entrada hasta un noventa por ciento.
La exclusión del entrenamiento se ofrece en todos los planes. Para procesamiento regional garantizado y SLA contractuales hace falta el nivel de API empresarial, con un precio un 75 por ciento por encima de la tarifa estándar.
En capacidad pura en lo más alto, los modelos estadounidenses siguen generalmente por delante. Mistral gana en precio, en velocidad, en poder llevarte los pesos y en estar sujeto al derecho europeo. Cuál de esas cosas importa es una pregunta sobre tu organización, no sobre los índices de referencia.
Mistral es la respuesta seria para quien no puede o no quiere depender de un modelo estadounidense cerrado. Es rápido, es barato, el asistente cuesta un tercio menos que sus competidores y los pesos se pueden descargar, lo que significa que lo peor que un proveedor puede hacerte — retirar el producto — se convierte en un problema que puedes rodear con ingeniería.
Empieza por el plan gratuito, que trae créditos de API de verdad, y elige los modelos por tarea y no por tamaño, porque los precios no premian la intuición. Si la residencia de datos es un requisito, presupuesta pronto el nivel empresarial: es ahí donde se vende de verdad la soberanía.