Muse Spark 1.3: Meta presume de frontera, pero su mejor versión aún no se puede usar

Meta lanza Muse Spark 1.3 con mejoras notables en coding y agentes, pero los mejores resultados vienen de una configuración que todavía está en pruebas de seguridad y solo disponible para un grupo reducido.
Meta acaba de presentar Muse Spark 1.3, la nueva versión de su modelo de IA que promete dar un salto de gigante en tareas de programación y trabajo con agentes. Su cofundador y CEO, Mark Zuckerberg, lo vendió en X como el mayor avance de la compañía en ese terreno y presumió de un 'rendimiento frontera casi demasiado barato para medir'. La frase tiene parte de verdad, pero también un matiz importante: los resultados más potentes del modelo proceden de una configuración que los desarrolladores aún no pueden usar de forma general.
El truco está en las configuraciones de razonamiento. El modelo 'max' es el que logra las mejores puntuaciones en los benchmarks: por ejemplo, en GDPval-AA v2 alcanza 1.754 Elo frente a 1.709 de la versión 'xhigh', y en OSWorld 2.0 obtiene 66,9 frente a 57,2. Pero Meta dice que esa configuración aún está pasando pruebas de seguridad adicionales y que llegará 'en breve'; de hecho, la firma de análisis Artificial Analysis solo pudo evaluarla en una vista previa limitada y hoy no lista ningún proveedor de API para ella. En cambio, lo que se está desplegando esta semana a través de Muse Code y de la Meta Model API es la configuración 'xhigh', que es la que ya estaba disponible en la versión anterior. Y aunque es muy buena, no es la líder del ranking: la firma la puntúa con un 61 en su índice de inteligencia, empatada con GPT-5.6 Sol max, Grok 4.6 high y Claude Opus 5 high, pero por detrás de Claude Fable 5.1, que llega a 66.
Comparado con el lanzamiento anterior, el salto es evidente. La versión 1.2 anotaba 82,9% en Terminal-Bench 2.1 frente al 86,7% de Opus 5, quedando claramente por detrás de Anthropic. Con 1.3, Meta ya no se limita a aparecer en la carrera: en varias evaluaciones de coding y agentes se intercambia victorias con OpenAI y Anthropic. Además, el modelo ha mejorado en comportamiento: está entrenado para mantener varios flujos de trabajo en una conversación larga, recopilar contexto con herramientas, detectar huecos en sus propios planes, pedir aclaraciones al usuario cuando hace falta y confirmar antes de acciones de consecuencias. En las comparaciones internas de los ingenieros de Meta, la 1.3 usa un 20% menos de llamadas a herramientas y un 25% menos de tokens que la 1.2 durante tareas de programación. Para empresas que pagan por miles o millones de bucles de agentes, estas mejoras de eficiencia importan más que un punto en un leaderboard.
En cuanto al precio, no hay rebaja: el modelo 1.3 mantiene el mismo precio estándar que la 1.2, 1,25 dólares por millón de tokens de entrada, 4,25 por millón de salida y 0,15 por millón de tokens en caché. Dicho esto, comparado con los modelos de frontera de Anthropic (Claude Fable 5.1 cuesta 10 dólares por millón de entrada y 50 por salida) o de OpenAI (GPT-5.6 Sol está en 5 y 30), el nuevo modelo de Meta resulta mucho más barato. Así que cuando Zuckerberg habla de 'casi demasiado barato para medir' no se refiere a una bajada de tarifas, sino a la relación calidad-precio. La pregunta para las empresas no es si Muse Spark 1.3 puede alcanzar territorio frontera, sino cuánto se acerca el modelo que pueden desplegar hoy y a qué coste real.
El análisis de Salseo
- El titular no cuenta que la versión que bate récords (max) no está disponible para todos. Lo que Meta puede desplegar hoy es la configuración xhigh, que está en la frontera pero no lidera el ranking; para las empresas que usan agentes, lo que importa no es el número uno del leaderboard, sino el coste real por tarea.
- El salto frente a la 1.2 es real: Meta ha pasado de quedar claramente por detrás de Anthropic a intercambiar victorias con OpenAI y Anthropic. La mejora del 20% en menos llamadas a herramientas y del 25% en menos tokens es lo que de verdad reduce la factura de quien ejecuta miles de bucles de agentes al día.
- La estrategia de precios es la clave: no ha bajado el precio, pero ha colocado un modelo de casi frontera a 5,50 dólares por millón de tokens, cuando los líderes cobran entre 35 y 60 dólares. Eso apunta a una guerra de precios por el mercado de agentes; habrá que ver si los rivales responden o si Meta puede aguantar el margen.
- La señal a vigilar es cuándo estará disponible la configuración max. Si llega pronto y mantiene la ventaja, Meta tendría un modelo top para competir de verdad; pero hay un matiz: en algunos tests, como DeepSearchQA o Terminal-Bench, el max y el xhigh empatan o incluso el xhigh supera al max, así que la brecha no es tan grande en todos los casos.