MiniMax M3: código, imágenes, audio y video con una sola suscripción
Actualmente hablar de modelos de IA es básicamente mencionar a los modelos más caros y más populares, pero también existen alternativas bastante accesibles que incluso nos permiten hacer más cosas de las que ofrece un modelo cerrado. Hoy vamos a probar MiniMax en su versión M3, un modelo abierto que no solamente genera código, sino también imágenes, audio, voz e incluso video.
Y si a eso le sumamos que podemos usar la misma suscripción desde cualquier herramienta de código o agente —Cursor, VS Code, OpenCode, Trae y muchos más—, se convierte en una suscripción muy aprovechable tanto si eres desarrollador como si generas contenido, o si quieres integrarla en tus propias aplicaciones para que tengan una IA que procese cosas de forma inteligente.
En este artículo te doy una introducción a qué es MiniMax M3, cómo instalarlo y algunos ejemplos de cómo crear aplicaciones con él usando OpenCode.
¿Qué es MiniMax M3?
MiniMax es un modelo abierto: puedes encontrar sus pesos en Hugging Face, ver cómo está desarrollado y, si tienes el hardware adecuado, incluso ejecutarlo tú mismo. Las mejoras que van publicando también quedan visibles ahí.
El modelo ha tenido varias versiones, pero la última es M3, y una de las cosas que trae es el soporte de un millón de tokens de contexto. Para lograrlo utiliza una arquitectura de sparse attention —que otros modelos abiertos también usan—, y con ella MiniMax garantiza 512,000 tokens de contexto disponibles sí o sí, pudiendo llegar hasta el millón.
¿Y qué tal rinde?
En varias mediciones, si comparamos MiniMax M3 con modelos cerrados como los de Anthropic, OpenAI o Google, por lo general está casi a la par de un GPT 5.5. No es exactamente igual, pero es básicamente la opción abierta para tener modelos de calidad similar a la de estos proveedores. Incluso supera a Gemini 3.1 Pro en mediciones como SWE-Bench Pro, y en benchmarks de manipulación del navegador también muestra un nivel bastante decente, superando en algunos casos a otros modelos populares.
En resumen: es un modelo muy competente para generar código y, aunque está cerca de los modelos más populares, tiene la ventaja de un precio mucho más bajo.
Además funciona bien para tareas largas. Hay un caso de estudio llamado paper reproduction donde el modelo se ejecuta durante 12 horas generando documentos con sus capacidades multimodales —gráficos, imágenes, texto— manejando un contexto de alrededor de un millón de tokens. Sumado a sus características agénticas, el modelo puede trabajar de forma continua sin mayor dificultad.
Precios: API vs Token Plan
Antes de empezar, algo importante sobre los precios. Hay dos formas de usar MiniMax:
- Pago por API: pagas por uso. Al final del mes recibes una factura según todo lo que consumiste. Esta opción tiene sentido si vas a crear una aplicación externa en producción.
- Token Plan: una suscripción mensual mucho más accesible, que es la que vamos a usar hoy. En mi caso estoy usando el plan Plus.
Para crear tu cuenta solo tienes que entrar a la página de MiniMax y darle a Login —puedes autenticarte con correo, GitHub o Google—. Una vez dentro, verás dos secciones clave:
- Plan details: aquí está tu token (API key), la fecha de vencimiento de tu suscripción y el plan que estás usando. Si en algún momento tu key se filtra —por ejemplo, la dejaste por ahí en un repo de GitHub—, puedes darle a Reset key y te genera una nueva.
- Plan usage: para ir viendo cuánta cuota vas gastando y cada cuánto se resetea.
Instalando MiniMax en OpenCode
MiniMax se puede conectar a una enorme variedad de herramientas: Claude Code (para que use tu suscripción en lugar de la API de Anthropic), Cursor, Trae, Codex y en general cualquier herramienta que soporte integraciones con APIs compatibles con las de Anthropic. En su documentación hay una lista bastante grande donde aparecen Xcode, Kilo Code, Zed, OpenCode y muchas más.
Hoy voy a usar OpenCode, un proyecto bastante popular y muy fácil de conectar con este modelo. Para quien no lo conoce, OpenCode es un agente de código que puedes instalar desde la consola (o como aplicación de escritorio) y al que puedes conectarle cualquier proveedor de IA, ya sea abierto o cerrado.
La instalación funciona igual en Windows, Linux y Mac. Yo voy a usar la opción con npm por ser la más genérica:
npm install -g opencode-ai
Una vez instalado, ejecutas el comando opencode y se lanza el agente. Para conectar tu suscripción usa el comando /connect, busca "MiniMax" y verás varias opciones (dominios de MiniMax, la versión china, etc.). La que necesitamos es MiniMax Token Plan. Te va a pedir la API key: la copias desde Plan details en tu cuenta y la pegas.
Con eso ya verás la lista de versiones de MiniMax disponibles. Seleccionamos M3 y en la parte inferior quedará marcado que estamos usando M3 con nuestro Token Plan.
Modos de esfuerzo con /variants
Los modelos por lo general tienen grados de esfuerzo: puedes hacer que respondan más rápido (respuesta menos trabajada) o más lento (el modelo "piensa" más). En OpenCode esto se controla con el comando /variants, que en M3 te da dos modos:
- Default: genera la respuesta directamente, sin más.
- Thinking: un modo de esfuerzo más amplio. Gasta un poco más de tokens, pero hace un preprocesado de la tarea antes de responder, lo que da mejores resultados.
Voy a usar thinking porque primero vamos a elaborar un plan.
Construyendo una app con MiniMax M3
Lo que vamos a crear es un generador de ideas para contenido de redes sociales con IA: el usuario escribe un término o selecciona una categoría, y la app genera ideas de artículos, publicaciones, guiones de video, prompts de imágenes, etc. Y lo interesante: vamos a usar la misma API de MiniMax del Token Plan, no solo para generar la aplicación, sino integrada dentro del propio proyecto.
En OpenCode cambiamos del modo build al modo plan con Shift+Tab. En este modo el agente hace varias preguntas: si es una app web, una API o full stack (elegimos full stack para tener frontend y backend), en qué ruta crearla, si necesita autenticación con la API (sí, para pasarle el token), qué capacidades queremos (texto, imágenes, audio...).
Un detalle importante aquí: aunque puedes marcar todo, recuerda que la suscripción básica por lo general da acceso a generación de texto, imágenes y audio. La generación de video viene en un plan superior. Para este ejemplo, con el plan básico es más que suficiente.
Después de cargar un momento, el agente devuelve la planificación completa del proyecto —que bautizó como AI Playground—: estructura de carpetas, tecnologías (Next.js 14, Tailwind, etc.) y paquetes a instalar. Y lo bueno es que no tienes que aceptar lo primero que te da. Yo le pedí: "usa Next.js 16 y shadcn para las UI", y actualizó el plan cambiando solo esa parte.
Una vez aprobado el plan, salimos con Shift+Tab al modo build y le decimos simplemente "implementa". Con el modo thinking notarás que a veces carga un poco antes de actuar: eso es bueno, significa que está tratando de entender la tarea antes de ejecutar. A la derecha, OpenCode muestra el todo, la lista de tareas que va implementando. Esto puede tardar unos 10 o 15 minutos.
Al terminar, el proyecto pide la API key de MiniMax. Se la pasamos igual que antes (copiamos el token, le decimos "esta es la llave de MiniMax") y le pedimos que ejecute el proyecto. Configura la variable de entorno y levanta la app en localhost.
El resultado: AI Playground, una app con chat donde puedes pedir cosas como "dame ideas de publicaciones para Twitter acerca de código" y te devuelve la respuesta en markdown, o generar imágenes como "una persona escribiendo en un laptop". Todo con la misma suscripción, sin usar una API externa.
Subagentes y sesiones paralelas
Dentro de OpenCode también podemos lanzar múltiples subagentes. Por ejemplo: "lanza múltiples subagentes, uno para crear un landing page y otro para documentar el proyecto". Verás dos tareas cargando en paralelo, cada una con sus propios procesos, y puedes navegar entre ellas con las flechas del teclado. Mientras uno documenta, el otro va creando el diseño del landing.
¿Cuántos puedes lanzar? Con el plan Plus, entre tres y cuatro agentes en paralelo. Los planes superiores incrementan esa cantidad.
Y los subagentes no son la única forma de paralelizar: también puedes abrir sesiones adicionales. Mientras una sesión implementa la autenticación completa (sign up, sign in, forgot password), presionas Ctrl+P (o Cmd+P), creas una nueva sesión y le das otra tarea —por ejemplo, crear las interfaces de configuración, administración de usuarios, pagos e historial de generaciones—. Con switch session saltas entre ellas para ir respondiendo las dudas de cada agente: que si usar SQLite con Prisma para la base de datos, que si enviar correos con Resend, etc. Así puedes ir trabajando varias tareas a la par.
MiniMax CLI: generar archivos desde la terminal
Además de usar la API en aplicaciones, MiniMax tiene un CLI propio. Y aunque uno pensaría que es para generar código, en realidad sirve como intermediario con la API para generar archivos directamente desde comandos: texto, imágenes, audio, música, voz.
La instalación es un comando que copias y pegas en la terminal, y luego te autenticas con:
mmx auth login
Eligiendo la opción de MiniMax API, se abre el login en el navegador con tu misma cuenta. Una vez autorizado, te muestra un resumen de lo que puedes generar según tu plan (en la suscripción de $20 entra todo menos video).
Algunos ejemplos:
# Generar texto
mmx chat -m "escribe un poema de cuatro líneas acerca de la IA"
# Generar música instrumental
mmx music generate --instrumental
# Generar una imagen
mmx image generate "escena cyberpunk" --aspect-ratio 16:9
También puedes sintetizar voz, y todo se genera con tu misma suscripción, sin interfaz de por medio y sin proveedores externos. Para ser un modelo multimodal, los resultados están bastante bien.
Usar el CLI a través de un agente
Si los comandos te parecen complicados, hay una forma aún más simple: usar el CLI a través de cualquier agente (OpenCode, Cursor, Trae, Codex o el que tengas configurado).
En la página de instalación de MiniMax hay una opción de instalar vía agente: copias un prompt, lo pegas en tu agente, y él mismo instala el CLI, se autentica (le pasas el token y listo) e instala el skill, que es la guía que le dice al agente qué comandos puede usar.
A partir de ahí puedes pedirle cosas en lenguaje natural: "usando mmx genera una imagen de un perro en un auto en la luna", y el agente ejecuta el comando por ti, mejora el prompt y te devuelve la ruta del archivo generado, que puedes abrir directo en el navegador porque está en tu propio sistema.
Incluso puedes encadenar generaciones: le pides que genere la letra de una canción de jazz y que luego se la pase al comando de música. El agente genera la letra (verso, coro y demás), la envía a mmx music generate con --lyrics, y en un minuto aproximadamente tienes la canción completa. Y si crees que los archivos se guardan en algún lugar inaccesible, tranquilo: son archivos en tu propia computadora, y hasta puedes decirle al agente "mueve los archivos al escritorio".
Conclusión
MiniMax M3 es un modelo abierto que compite de cerca con los modelos cerrados más populares, con un millón de tokens de contexto, capacidades multimodales (texto, imágenes, audio, voz y video) y un precio mucho más accesible. Con una sola suscripción puedes programar desde tu agente favorito, integrarlo en tus propias aplicaciones y generar archivos multimedia desde el CLI.
Todo lo que viste aquí lo hice con la suscripción más básica de $20. Si necesitas más uso, los planes superiores dan más del doble de tokens y más agentes en paralelo. Y si vas a adquirir cualquiera de estos planes, en la descripción del video te dejo un enlace con hasta un 12% de descuento.
¿Qué ideas tienes para generar proyectos con MiniMax M3? Déjalas en los comentarios, y si tienes problemas generando alguno, también puedo considerar armar un proyecto completo usando este modelo.