Xiaomi MiMo API: cómo usar MiMo V2.6 paso a paso

Aprende a configurar Xiaomi MiMo API en Studio y Python, elegir la clave y el modelo correctos, y validar tu primer flujo empresarial con controles claros.

Tuesday, September 22, 2026Omid Saffari
Xiaomi MiMo API: cómo usar MiMo V2.6 paso a paso

Xiaomi MiMo API permite convertir un prompt ya validado en un flujo de trabajo empresarial repetible con MiMo-V2.6. Conviene empezar en Studio para comprobar la tarea, usar Flash en la primera solicitud de producción y cambiar de modelo solo cuando los datos de calidad o latencia justifiquen el costo adicional.

El camino más corto es sencillo: probar una tarea sintética en AI Studio, crear el tipo de clave adecuado, conectar un cliente compatible con OpenAI a la URL base de Xiaomi y revisar el JSON devuelto antes de incorporar datos reales de clientes.

El orden importa porque permite distinguir un problema del prompt de uno relacionado con la cuenta. Si la tarea no funciona en Studio, modificar el código Python no la resolverá. Si funciona en Studio pero la API indica que la clave no es válida, lo más probable es que el problema esté en la vía de credenciales, no en el modelo.

Qué es realmente MiMo-V2.6

MiMo-V2.6 es una familia de modelos con dos puntos de partida prácticos. mimo-v2.6-flash es la opción económica predeterminada para llamadas frecuentes. mimo-v2.6-pro cuesta más y está pensado para trabajos complejos y de largo alcance. Ambos aceptan texto, imágenes, video y audio, y devuelven texto. También ofrecen una ventana de contexto de 1 millón de tokens, una salida máxima de 128,000 tokens, llamadas a herramientas, streaming, salida estructurada, búsqueda web y almacenamiento en caché del contexto.

Piense en el modelo como el motor y en la vía de acceso como la tarjeta de combustible. El motor puede ser el mismo, aunque cambien la tarjeta, el medidor y la estación de servicio. Una clave de pago por uso no consume la cuota de Token Plan, y una clave de Token Plan no se autentica en la URL base del servicio de pago por uso.

Xiaomi ofrece Pro y Flash en AI Studio, MiMo Code, MiMo Desktop, su plataforma de API y OpenRouter. Studio es el mejor punto de partida porque permite evaluar la tarea antes de que un equipo de ingeniería la integre.

Infografía de arcilla que muestra MiMo Studio dividido entre las rutas de pago por uso y Token Plan antes de llegar a Flash y a un resultado
Las dos vías de la API usan claves y URL base distintas. Valide el prompt en Studio y mantenga cada credencial vinculada a su ruta correspondiente.

Cómo configurar Xiaomi MiMo API para la primera tarea

Empiece con una tarea inocua pero representativa. Para clasificar solicitudes de soporte, no pegue el nombre, correo electrónico, historial de pedidos ni datos de pago de un cliente real. Use un ticket sintético que reproduzca la estructura del trabajo:

Clasifica este ticket de soporte sintético como facturación, acceso, error u otro, y después indica una acción siguiente: Se hizo un cargo a mi tarjeta, pero el saldo de mi espacio de trabajo no se actualizó.

1. Compruebe la tarea en Studio

Inicie sesión con una cuenta de Xiaomi, abra AI Studio, seleccione MiMo-V2.6-Flash y envíe el prompt sintético. Debe comprobar tres aspectos: que la categoría sea válida, que la acción propuesta resulte útil en la operación y que la respuesta sea lo bastante consistente como para convertirla más adelante en un esquema.

Todavía no busque elegancia. Un primer resultado útil podría responder billing y recomendar comprobar la liquidación del pago o escalar la discrepancia del saldo. Si la respuesta se desvía, delimite mejor las categorías y exija una sola acción siguiente. Studio es la sala de ensayo, no el sistema de producción.

2. Elija la vía de credenciales antes de crear una clave

Para un flujo empresarial general mediante API, el pago por uso es el punto de partida más claro. Añada saldo en la consola de MiMo, cree una clave convencional con formato sk- desde API Keys y utilice:

  • URL base: https://api.xiaomimimo.com/v1
  • Modelo: mimo-v2.6-flash

Token Plan es una suscripción orientada a cargas de programación con IA. Emite una clave tp- independiente para personas o una clave ttp- para equipos, y utiliza:

  • URL base: https://token-plan-cn.xiaomimimo.com/v1
  • Modelo: mimo-v2.6-flash o mimo-v2.6-pro

La estructura de la API es la misma, pero la clave y la URL base deben cambiar juntas. Xiaomi señala expresamente que el saldo de pago por uso y la cuota de Token Plan no son intercambiables. Para consultar todas las condiciones de acceso, lea ¿MiMo V2.6 es gratis?.

3. Envíe la solicitud mínima útil con Python

La siguiente solicitud sigue el ejemplo de Xiaomi compatible con OpenAI, pero elimina la fecha de sistema obsoleta de diciembre de 2025 incluida en la muestra oficial. Plantea una tarea neutra, lee la clave desde el entorno e imprime la respuesta completa para conservar el ID del modelo, el uso y el contenido devueltos.

Python
import os
import time
from openai import OpenAI

client = OpenAI(
    api_key=os.environ["MIMO_API_KEY"],
    base_url="https://api.xiaomimimo.com/v1",
)

started = time.perf_counter()
response = client.chat.completions.create(
    model="mimo-v2.6-flash",
    messages=[{
        "role": "user",
        "content": (
            "Classify this synthetic support ticket as billing, access, "
            "bug, or other, then give one next action: My card was charged "
            "but my workspace balance did not update."
        ),
    }],
    max_completion_tokens=120,
    stream=False,
    extra_body={"thinking": {"type": "disabled"}},
)

print(f"latency_seconds={time.perf_counter() - started:.3f}")
print(response.model_dump_json(indent=2))

Instale la versión actual del paquete de Python de OpenAI, exporte MIMO_API_KEY y ejecute el archivo. Si adquirió Token Plan, cambie tanto la clave como el valor de base_url. No modifique solo uno de los dos.

Qué se verificó y qué no

La muestra no se ejecutó porque el entorno de publicación no disponía de una cuenta ni una clave autorizadas de MiMo. Una prueba sin credenciales sí llegó a https://api.xiaomimimo.com/v1/chat/completions. Devolvió HTTP 401, el código invalid_key y el mensaje Invalid API Key en 0.067 segundos. Es un error de configuración subsanable: basta con proporcionar una clave válida de la vía de cuenta correspondiente.

La autenticación falló antes de la inferencia, por lo que no existe un ID de modelo, un registro de uso ni una respuesta que se puedan comunicar con rigor. En una ejecución correcta deben conservarse el JSON completo de la respuesta, la latencia medida por el cliente y una copia anonimizada de la solicitud. Esa evidencia basta para comparar modelos e investigar la facturación sin registrar la clave ni los datos del cliente.

Flujo de resolución de problemas en arcilla que comprueba la clave, la URL base, el ID del modelo y el uso, con una ruta de retorno por clave no válida 401
Siga el orden al diagnosticar. Un 401 en el primer punto de control significa que todavía no hay una salida del modelo ni un registro de uso que evaluar.

Qué modelo elegir según la tarea: Flash, Pro o UltraSpeed

Empiece con Flash. Ofrece las mismas modalidades de entrada, ventana de contexto, salida máxima y límites de uso de la plataforma que Pro, pero sus precios por token son menores. Pase una tarea a Pro cuando un pequeño conjunto de evaluación demuestre que las mejores decisiones compensan la diferencia.

OpciónMejor uso inicialEntrada sin cachéSalidaDecisión práctica
FlashClasificación inicial, extracción, categorización y llamadas frecuentes a herramientas$0.14 por 1M de tokens$0.28 por 1M de tokensPredeterminado
ProProgramación compleja, investigación y decisiones de largo alcance$0.435 por 1M de tokens$0.87 por 1M de tokensAscender después de evaluar
Pro-UltraSpeedTrabajo con Pro sensible a la latencia$4.35 por 1M de tokens$8.70 por 1M de tokensComprar velocidad de forma deliberada

Xiaomi afirma que UltraSpeed puede generar la salida hasta 20 veces más rápido que Pro con la misma calidad. Sus precios de entrada sin caché y de salida también son 10 veces los de Pro. El intercambio solo tiene sentido cuando el tiempo de respuesta aporta un valor empresarial medible.

El costo del modelo puede ser mínimo en tareas breves de clasificación. Suponga que cada ticket consume 1,000 tokens de entrada sin caché y 200 tokens de salida. Con las tarifas publicadas, procesar 10,000 tickets costaría alrededor de $1.96 con Flash, $6.09 con Pro o $60.90 con Pro-UltraSpeed. El procesamiento por lotes con Flash reduciría ese costo estimado a unos $0.98.

Estas cifras son escenarios aritméticos, no resultados de uso. No incluyen reintentos, búsqueda web, almacenamiento, monitoreo, ingeniería ni revisión humana. Xiaomi factura por separado la búsqueda web en el extranjero a $5 por 1,000 llamadas. Lo que rompe el presupuesto no es por sí solo la nómina de soporte, sino asumir que cada clasificación inicial necesita una licencia en otra aplicación o intervención humana antes de asignarse.

Comparación en arcilla de MiMo-V2.6 Flash y Pro con su contexto y sus precios por millón de tokens
Flash y Pro comparten la ventana de contexto anunciada de 1M. La primera decisión sobre el modelo es económica: el volumen rutinario va a la izquierda y la complejidad demostrada, a la derecha.

Siete flujos empresariales que vale la pena probar

Están ordenados según la claridad de la entrada, el valor de una respuesta estructurada y la seguridad con que un equipo puede medir el resultado antes de ceder más control al modelo.

1. Clasificación inicial de una cola de soporte con gran volumen

Un responsable de operaciones de soporte podría enviar cada ticket nuevo a Flash, junto con una captura depurada cuando hiciera falta. El modelo clasifica el problema, propone una acción siguiente y devuelve texto que el sistema de asignación convierte en campos. La ventaja es una clasificación inicial más rápida con un costo de modelo que puede mantenerse por debajo de un dólar por cada varios miles de tickets breves. Los agentes humanos siguen controlando los reembolsos, los cambios de cuenta y los casos ambiguos.

2. Mantenimiento de repositorios para un equipo de software

Un responsable de ingeniería podría proporcionar a un sistema de programación un informe de error, el contexto pertinente del repositorio, comandos de prueba y acceso a herramientas. Flash se encarga de la exploración frecuente; Pro recibe los casos que no alcanzan un umbral de evaluación. El beneficio no es generar código de forma genérica, sino reducir las licencias pagadas de asistentes para un flujo específico y conservar un registro de cada solicitud y acción de herramienta. La contrapartida es que la infraestructura que lo rodea, el entorno aislado, las pruebas y la revisión de código concentran más riesgo que la llamada al modelo.

3. Análisis de grandes paquetes documentales

Un analista de operaciones podría combinar texto extraído de contratos, páginas de políticas e imágenes de páginas escaneadas, y pedir después las excepciones con un esquema fijo. La ventana de contexto de 1 millón de tokens admite grandes conjuntos de evidencia, mientras que la salida estructurada ofrece una forma predecible al software posterior. La ventaja es acortar la primera revisión. No sustituye el criterio jurídico, y cada excepción citada debe mantener un enlace a su página de origen.

4. Controles visuales de calidad para comercio electrónico

Un equipo de comercio electrónico podría enviar la imagen de un producto junto con el texto de su publicación y preguntar si coinciden el color visible, la cantidad del paquete y las afirmaciones. Flash devuelve texto para que un motor de reglas lo acepte o lo envíe a una cola. La ventaja es detectar discrepancias evidentes antes de publicar. El modelo no devuelve una imagen editada, así que sigue siendo necesario un flujo independiente para imágenes.

5. Revisión de llamadas grabadas y evidencia en pantalla

Un equipo de éxito del cliente podría aportar audio, una grabación de pantalla y una rúbrica, y solicitar un resumen textual de compromisos, obstáculos pendientes y seguimientos. Las entradas nativas de audio y video reducen el número de modelos independientes necesarios en el primer prototipo. La ventaja es trabajar con una sola cola de revisión, en lugar de separar las colas de transcripción y comprobación visual. Antes deben definirse las reglas de consentimiento, conservación y datos sensibles.

6. Prueba piloto de investigación y trabajo de oficina con MiMo Desktop

Quien todavía no esté listo para desarrollar puede empezar en MiMo Desktop, que ahora incluye Pro, Flash y UltraSpeed. Así podrá comprobar si el modelo resuelve una tarea real de investigación o documentación antes de solicitar una integración al equipo de ingeniería. La ventaja es una fase de descubrimiento más económica. Tener éxito en Desktop no demuestra que un flujo automatizado mediante API vaya a ser fiable a gran escala.

7. Procesamiento nocturno de tareas pendientes

Un equipo de marketplace o cumplimiento normativo podría enviar tareas de clasificación no urgentes mediante la API por lotes. Xiaomi fija para la entrada y salida por lotes de Flash y Pro la mitad de sus tarifas en tiempo real; UltraSpeed no está disponible en esa modalidad. La ventaja es directa y medible cuando el plazo de finalización es flexible. Todo lo que afecte a un cliente mientras espera debe seguir la ruta en tiempo real.

Tres productos que se pueden crear

La mejor oportunidad: un asistente de programación agéntico especializado

Desarrolle un agente de programación para una tecnología costosa y desatendida, como comprobaciones internas de migración en Java o reparación de pruebas en un repositorio regulado. Los compradores son equipos de ingeniería que consideran amplios los asistentes generalistas, pero difíciles de gobernar.

La demanda es visible: agentic ai coding assistant recibe alrededor de 2,900 búsquedas mensuales en EE. UU., muestra intención transaccional, tiene un CPC de $19.04 y creció 200% interanual en el conjunto de datos de palabras clave. GitHub ofrece actualmente Copilot Business por $19 al mes por licencia y Enterprise por $39. Esto crea una referencia clara para los compradores.

La versión mínima vendible conecta un repositorio, una cola de incidencias, un entorno aislado y un ejecutor de pruebas. Use Flash para explorar, derive a Pro los casos fallidos o de alto riesgo y muestre al cliente el costo, la latencia, los parches y la evidencia de pruebas de cada tarea. La barrera competitiva está en el conjunto de evaluación y los controles específicos de la tecnología, no en una caja de chat.

La dificultad es un mercado concurrido y un trabajo de seguridad muy real. Un producto que solo envuelva el modelo, sin pruebas propias, conocimiento del flujo ni límites de aprobación, se copiará con rapidez. Aun así, es la oportunidad más sólida porque la consulta concentra la mayor demanda cualificada, intención transaccional y una referencia de precio que los compradores ya conocen.

Una pasarela de programación con modelos abiertos

Cree una capa de enrutamiento para equipos que buscan una opción basada en un modelo de código abierto sin obligar a cada desarrollador a conocer los ID de modelos, tipos de clave, límites de contexto y alternativas. El comprador obtiene un único endpoint interno, controles de políticas y comparaciones por tarea entre Flash y Pro.

open source ai coding assistant recibe alrededor de 1,600 búsquedas mensuales en EE. UU., con intención comercial, un CPC de $2.94 y un crecimiento anual de 1,977% en los datos de sugerencias. El producto mínimo viable requiere autenticación, un adaptador de proveedor, registros de costo y latencia, una pequeña evaluación de programación y una vista administrativa básica.

La dificultad es que un modelo de código abierto y una API alojada representan decisiones de compra distintas. La pasarela necesita condiciones claras sobre el tratamiento de datos, además de una opción de autohospedaje u otra función defendible de gobernanza. De lo contrario, los clientes pueden llamar a Xiaomi directamente.

Un centro multimodal para clasificar documentos y archivos adjuntos

Cree un producto de recepción para equipos de soporte, reclamaciones u operaciones que manejan textos largos, capturas de pantalla, notas de audio y videos breves. Convierte los archivos en entradas compatibles, pide a Flash una decisión textual estructurada y remite a personas los casos de baja confianza.

ai document analysis recibe alrededor de 1,000 búsquedas mensuales en EE. UU. La consulta tiene un CPC de $10.44 y un intervalo de puja para la parte superior de la página de $3.23 a $19.87, una señal de que los proveedores valoran ese contacto comercial aunque la tendencia de la palabra clave esté bajando. El producto mínimo viable consta de una vía de carga, un esquema, una cola de revisión y evidencia enlazada a la fuente.

La dificultad es la confianza. La salida de MiMo es texto, no una decisión verificada, y una ventana de 1 millón de tokens no garantiza la misma atención para cada detalle. Es preferible centrarse en un tipo de documento concreto y exigir revisión humana antes que crear un analizador universal.

Lo que MiMo-V2.6 no resuelve

La API proporciona un motor capaz, no un sistema operativo para la empresa. No define la taxonomía, limpia datos sensibles, crea reglas de aprobación, ejecuta evaluaciones ni decide qué hacer cuando una respuesta es incierta. Esas tareas corresponden al producto y las operaciones.

No empiece con UltraSpeed solo porque parezca mejor. Comience con Flash y registre la evidencia. No envíe todos los archivos únicamente porque la ventana de contexto sea grande. Limite el contexto a lo mínimo pertinente y conserve las referencias a las fuentes. Tampoco confunda una salida estructurada con la verdad: un objeto JSON válido puede contener una mala decisión.

Si usa el modo de razonamiento en varias llamadas a herramientas, Xiaomi recomienda trasladar el reasoning_content anterior al historial de mensajes. Si lo omite, cambia el contexto que ve el modelo. Si utiliza la búsqueda web, presupuéstela por separado de los tokens.

Para una comparación directa, consulte MiMo V2.6 Pro vs Flash. La regla práctica no cambia: Flash primero, Pro después de evaluar y UltraSpeed solo cuando la latencia tenga un precio.

Cómo resolver problemas de Xiaomi MiMo API en el orden correcto

  1. Clave no válida: compruebe si empieza por sk-, tp- o ttp-. Vincúlela con la URL base correcta. Nunca la imprima en los registros.
  2. Studio no devuelve una respuesta útil: ajuste la tarea, las categorías y el requisito de salida antes de modificar la integración.
  3. Modelo equivocado: use el ID exacto en minúsculas, mimo-v2.6-flash o mimo-v2.6-pro.
  4. El tráfico se atasca al escalar: compare la carga observada con los límites publicados de 100 solicitudes por minuto y 10 millones de tokens por minuto para Pro y Flash.
  5. Comportamiento inesperado de la fecha: elimine la fecha de sistema obsoleta de diciembre de 2025 incluida en la muestra actual de Xiaomi. Añada una fecha vigente solo si la tarea la necesita.
  6. Se pierde la continuidad entre llamadas a herramientas: conserve reasoning_content entre turnos cuando el modo de razonamiento esté activo, como recomienda Xiaomi.
  7. Los costos no cuadran: separe el saldo de pago por uso, los créditos de Token Plan, los cargos por tokens y el servicio de búsqueda web facturado de forma independiente.

El primer paso para el lunes

El lunes, el responsable de operaciones de soporte debería tomar 20 tickets ficticios, definir cuatro categorías y una acción siguiente segura para cada uno, y probarlos en Studio con Flash. El martes, alguien del equipo de ingeniería puede ejecutar el mismo conjunto mediante la API de pago, guardar solicitudes anonimizadas y respuestas completas, y comparar la coincidencia, la latencia y el uso de tokens. Solo entonces conviene conectar una cola real, manteniendo una rama de revisión humana.

¿Cómo se usa Xiaomi MiMo?

Empiece en AI Studio con una versión sintética de la tarea. Para un flujo mediante API, cree una cuenta de Xiaomi, elija entre pago por uso y Token Plan, genere la clave de esa vía, use la URL base correspondiente y llame a mimo-v2.6-flash mediante la API compatible con OpenAI o con Anthropic.

¿Xiaomi MiMo es gratis?

Algunos servicios de Xiaomi pueden ofrecer pruebas o acceso gratuito, pero la API de producción tiene precios de pago por uso publicados y Token Plans de pago. Consulte ¿MiMo V2.6 es gratis? para conocer las opciones de acceso.

¿Cuánto cuesta MiMo al mes?

Los Token Plans individuales ofrecen niveles mensuales de $6, $16, $50 y $100. Los planes para equipos cuestan $16, $50 o $100 por licencia al mes. En las tarifas publicadas, el pago por uso no tiene una cuota mensual fija: consume un saldo prepagado según los tokens utilizados.

¿Xiaomi MiMo es bueno para programar?

Está diseñado para la programación y los flujos con agentes, y Xiaomi publica ejemplos de producto y benchmarks sólidos. La respuesta empresarial depende del repositorio. Ejecute un conjunto fijo de incidencias y pruebas con Flash y Pro, y compare los parches aceptados, la latencia y el costo.

¿Vale la pena usar MiMo?

Sí, merece una evaluación controlada cuando importan los precios bajos por token, la entrada multimodal, el contexto largo o la opción de un modelo de código abierto. No merece un despliegue apresurado sin pruebas específicas de la tarea, reglas para los datos y una alternativa humana.

Si quiere implementar uno de estos flujos mediante API con evaluación, monitoreo y una derivación segura a un equipo humano, consulte sistemas de IA para producción.

Última actualización
22 sept 2026
Categoría
AI

Prefiera este sitio en Google

Añadir omidsaffari.com como fuente preferida en la Búsqueda de Google

Marque omidsaffari.com como fuente preferida y Google lo destacará para usted en Top Stories, AI Overviews y AI Mode.

Artículos relacionados
Claude Opus 5 vs Opus 5.5: qué cambia y cuándo migrar

Claude Opus 5 vs Opus 5.5: qué cambia y cuándo migrar

Claude Opus 5 frente a Opus 5.5: comparamos precio, programación y cambios de API para saber cuándo migrar y cuándo mantener el modelo anterior.23 sept 2026AI
Comparativa GPT-6 Sol vs Luna: cuál elegir

Comparativa GPT-6 Sol vs Luna: cuál elegir

Compara GPT-6 Sol y Luna en precio, capacidad y programación. Descubre cuándo conviene empezar con Luna y qué tareas justifican pagar más por Sol.23 sept 2026AI
GPT-6 Luna gratis: acceso, límites y precio real

GPT-6 Luna gratis: acceso, límites y precio real

GPT-6 Luna se puede probar gratis en la app de escritorio. Conoce qué planes permiten usarlo, cuáles son sus límites y cuánto cuesta la API.22 sept 2026AI
Xiaomi MiMo V2.6: Pro o Flash, ¿cuál conviene?

Xiaomi MiMo V2.6: Pro o Flash, ¿cuál conviene?

Compara Xiaomi MiMo V2.6 Pro y Flash en calidad, precio, caché y programación para elegir el modelo que reduce el costo por resultado aceptado.22 sept 2026AI
MiMo V2.6 gratis: dónde usarlo y cuánto cuesta después

MiMo V2.6 gratis: dónde usarlo y cuánto cuesta después

Descubre dónde usar MiMo V2.6 gratis, qué datos puede recopilar la promoción, cuánto cuesta la API de Xiaomi y cuándo conviene alojarlo por cuenta propia.22 sept 2026AI
Grok 4.7 vs Grok 4.6: cuál conviene y cuándo migrar

Grok 4.7 vs Grok 4.6: cuál conviene y cuándo migrar

Grok 4.7 vs Grok 4.6: compare rendimiento, contexto, precios y costo por tarea para decidir qué modelo probar y qué flujos conviene mantener.21 sept 2026AI
Agentes de IA en producción: cómo las reglas premiaron el objetivo equivocado

Agentes de IA en producción: cómo las reglas premiaron el objetivo equivocado

Un editor de IA desvió 50 de 96 artículos hacia software de manualidades. Los datos revelan qué reglas premiaron el desvío y qué controles las sustituyeron.21 sept 2026AI
Precio de Step 5 Preview: API, Step Plan y costo real

Precio de Step 5 Preview: API, Step Plan y costo real

Compara el precio de Step 5 Preview en la API con los Créditos de Step Plan, el descuento por caché y el costo del razonamiento antes de elegir.21 sept 2026AI
Newsletter

Una carta, cada domingo.Sistemas que funcionan, no opiniones calientes.

Semanal. Sin spam. Cancele cuando quiera.