Saltar al contenido

root / tags / minimax-m3

#MiniMax-M3

2 fiches

Agentes de codificación IA y Skills Traducción verificada automáticamente

The Token Manifesto

Nicolas Martignole (Le Touilleur Express), coescrito con **GLM-5.2** y **MiniMax-M3**, publica **« The Token Manifesto »**: un pastiche del **Manifeste Agile** (2001) trasladado a la era de los LLM, donde la unidad de valor ya no es la hora-ingeniero sino el **token**. Cuatro valores: *system prompts breves frente a system prompts ingeniosos*, *un ejemplo claro frente a tres párrafos de explicación*, *iterar en pequeños pasos frente a volcar toda la especificación de una vez*, *producir en un formato definido frente a dejar que el modelo improvise libremente*. Doce principios subvierten uno a uno los del Agile — «la simplicidad, el arte de maximizar la cantidad de trabajo **que el modelo no hace**», «equipos autoorganizados que detectan la repetición y la documentan una sola vez», «una reflexión periódica **antes de que llegue la factura mensual**». Bajo el humor («mirando nerviosamente una barra de uso») subyace una tesis seria: la restricción económica real del desarrollo asistido por IA ya no es la velocidad sino el **presupuesto de tokens** y la **economía de la ventana de contexto**. Dos frases finales cierran el texto: **« No tienes un problema de prompt. Tienes un problema de ventana de contexto. »** y **« Todo el mundo es prompt engineer hasta que se le acaba la cuota mensual. »** Cabe señalar el guiño meta: un manifiesto sobre la frugalidad de tokens coescrito *con* modelos.

#The Token Manifesto#Nicolas Martignole#Le Touilleur Express

Nicolas Martignole (Le Touilleur Express) · avec GLM-5.2 et MiniMax-M3

Economía y Mercado Traducción verificada automáticamente

GLM-5.2 leads open weights models and sits at #3 overall on GDPval-AA, a real-world agentic work benchmark

Anuncio de benchmark de **Artificial Analysis** (plataforma independiente de evaluación de modelos de IA, vía X/Twitter + página del modelo): **GLM-5.2** de **Z.ai** (Zhipu AI, @Zai_org) se convierte en **el modelo de pesos abiertos líder** y asciende al **puesto n.º 3 de la clasificación general** de **GDPval-AA**, un benchmark del mundo real para *trabajo intelectual económicamente valioso* (tareas de largo horizonte, multiturno, agénticas). GLM-5.2 obtiene **1524 Elo**, solo por detrás de **Claude Fable 5 (1783)** y **Claude Opus 4.8 (1615)**, y a la par de **GPT-5.5 (xhigh, 1509)**. Supera con amplio margen al siguiente mejor modelo de pesos abiertos (**MiniMax-M3, 1408**), así como a numerosos modelos propietarios: **Gemini 3.5 Flash (1357)**, **Qwen 3.7 Max (1289)**, **Muse Spark (1158)**. Las tareas son genuinamente agénticas: **~31 turnos por tarea** de media en **1,999 enfrentamientos**. La misma clasificación se mantiene en el **Artificial Analysis Intelligence Index** (1.º entre los modelos de pesos abiertos), el **Agentic Index** (n.º 3) y **AA-Briefcase** (n.º 3, por delante de GPT-5.5 xhigh, solo por detrás de Fable 5). Dato destacado: un modelo de **pesos abiertos** bajo **licencia MIT**, **MoE con 753 mil millones de parámetros / 40 mil millones activos**, **contexto de 1M de tokens**, con un precio de **$1.40/$4.40 por 1M de tokens** de entrada/salida, rivaliza con la frontera propietaria en trabajo agéntico — un avance real para los modelos abiertos.

#GLM-5.2#Z.ai#Zhipu AI

Artificial Analysis (@ArtificialAnlys)