IA

El modelo de IA de Alibaba cuesta 2 dólares por millón de tokens — los pesos abiertos llegan el 10 de agosto

Adrian Kessler

Un modelo de IA de 2,4 billones de parámetros acaba de llegar al mercado por 2 dólares por millón de tokens de entrada y 6 por salida. Funciona con una arquitectura de mezcla dispersa de expertos que reduce el coste por token al activar solo 95 mil millones de parámetros a la vez, mientras el resto permanece inactivo. El modelo es Qwen 3.8 Max y viene de Alibaba.

La brecha de precios con los principales modelos estadounidenses es abismal. Qwen 3.8 Max obtiene resultados competitivos en varios benchmarks estándar: 93,0 en PaperBench y 86,1 en OSWorld-Verified, situándose por encima de Fable 5 y GPT-5.6 Sol en esas medidas concretas. Su ventana de contexto alcanza el millón de tokens —aproximadamente un millón de palabras de entrada en una sola consulta—, lo que cubre análisis de documentos largos, grandes bases de código y cadenas de razonamiento extendidas. El modelo es también multimodal, aceptando imágenes y vídeo junto al texto, en un nivel de precios que hace un año era solo para uso propietario.

El desarrollo más trascendente puede ser lo que Alibaba ha prometido para la próxima semana. La compañía dice que publicará los pesos del modelo, lo que significa que cualquier equipo con la infraestructura informática suficiente podrá ejecutar Qwen 3.8 Max localmente, sin tarifas de API, sin enviar datos a un servidor de Alibaba y sin acuerdo de uso. Ese compromiso, si se cumple según lo previsto, pondría un modelo de 2,4 billones de parámetros en manos de quienes lo alojen por primera vez. Alibaba también lanzará un checkpoint más pequeño de 27 mil millones de parámetros para organizaciones con recursos informáticos más limitados.

Las advertencias son reales. En el leaderboard Chatbot Arena, centrado en texto, Qwen 3.8 Max ocupa el quinto puesto —por detrás de cuatro modelos de la línea actual de Anthropic—. En SWE-bench Pro, la evaluación de agentes de codificación que más importa a los equipos de IA empresarial, obtiene 67,7 frente al 80,0 de Fable 5. La liberación de los pesos está prometida para la semana del 10 de agosto, pero a fecha de publicación no han aparecido pesos en Hugging Face ni en ModelScope. Para organizaciones que manejan requisitos de residencia de datos en la UE o normas de control de exportaciones de EE. UU., Qwen 3.8 Max plantea las mismas cuestiones de jurisdicción que han acompañado a otros modelos de laboratorios chinos.

La ventana del 10 de agosto para la liberación pública de los pesos es el primer hito firme. Si Alibaba cumple, la estructura de costes de la inferencia de IA de frontera cae sustancialmente para cualquier equipo dispuesto a gestionar su propia infraestructura. Si el lanzamiento se retrasa o llega con restricciones, el precio de la API de 2 dólares lo convierte igualmente en uno de los modelos de frontera más agresivamente preciados disponibles actualmente.

Etiquetas: , , , , ,

Debate

Hay 0 comentarios.