IA

El modelo de IA de Alibaba vale 2 dólares por millón de tokens — los pesos abiertos llegan el 10 de agosto

Adrian Kessler

Un modelo de inteligencia artificial con 2,4 billones de parámetros acaba de aparecer en el mercado a $2 por millón de tokens de entrada y $6 por salida. Funciona con una arquitectura dispersa de mezcla de expertos que mantiene bajos los costos por token al activar solo 95 mil millones de parámetros a la vez, mientras el resto permanece inactivo. El modelo es Qwen 3.8 Max y viene de Alibaba.

La brecha de precios con los principales modelos estadounidenses es abismal. Qwen 3.8 Max obtiene resultados competitivos en varios benchmarks estándar: 93,0 en PaperBench y 86,1 en OSWorld-Verified, colocándose por encima de Fable 5 y GPT-5.6 Sol en esas medidas específicas. Su ventana de contexto alcanza el millón de tokens —aproximadamente un millón de palabras de entrada en un solo prompt— lo que cubre análisis de documentos extensos, bases de código grandes y cadenas de razonamiento prolongadas. El modelo también es multimodal: acepta imágenes y video junto con texto, a un precio que hace un año era exclusivo de uso propietario.

El desarrollo más trascendental puede ser lo que Alibaba ha prometido para la próxima semana. La empresa dice que publicará los pesos del modelo abiertamente, lo que significa que cualquier equipo con suficiente infraestructura de cómputo podrá ejecutar Qwen 3.8 Max de forma local, sin tarifas de API, sin enviar datos a un servidor de Alibaba y sin un acuerdo de uso. Ese compromiso, si se cumple según lo programado, pondría un modelo de 2,4 billones de parámetros en manos de usuarios que alojen su propia infraestructura por primera vez. Alibaba también está lanzando un checkpoint más pequeño de 27 mil millones de parámetros para organizaciones con cómputo más limitado.

Las advertencias son reales. En el ranking Chatbot Arena, centrado en texto, Qwen 3.8 Max ocupa el quinto lugar —por detrás de cuatro modelos de la línea actual de Anthropic. En SWE-bench Pro, la evaluación de agentes de codificación que más importa a los equipos empresariales de IA, obtiene 67,7 frente al 80,0 de Fable 5. La liberación de los pesos abiertos está prometida para la semana del 10 de agosto, pero al momento de esta publicación no han aparecido pesos en Hugging Face ni ModelScope. Para las organizaciones que manejan requisitos de residencia de datos en la UE o reglas de control de exportaciones de EE.UU., Qwen 3.8 Max conlleva las mismas preguntas jurisdiccionales que han acompañado a otros modelos de laboratorios chinos.

La ventana del 10 de agosto para la publicación de los pesos públicos es el primer hito concreto. Si Alibaba cumple, la estructura de costos de inferencia de IA de frontera baja sustancialmente para cualquier equipo dispuesto a ejecutar su propia infraestructura. Si la publicación se retrasa o llega con restricciones, el precio de $2 por API sigue convirtiéndolo en uno de los modelos de frontera más agresivamente tarifados disponibles actualmente.

Etiquetas: , , , , ,

Discussion

There are 0 comments.