Vai al contenuto

root / tags / minimax-m3

#MiniMax-M3

2 fiches

Agenti di codifica IA e Skills Traduzione verificata automaticamente

The Token Manifesto

Nicolas Martignole (Le Touilleur Express), co-scritto con **GLM-5.2** e **MiniMax-M3**, pubblica **« The Token Manifesto »**: un pastiche del **Manifeste Agile** (2001) trasposto all'era degli LLM, dove l'unità di valore non è più l'ora-ingegnere ma il **token**. Quattro valori: *short system prompts over clever system prompts*, *one clear example over three paragraphs of explanation*, *iterating in small steps over dumping the whole spec at once*, *outputting in a defined format over letting the model freestyle*. Dodici principi sovvertono uno per uno quelli dell'Agile — "simplicity, the art of maximizing the amount of work **not done by the model**," "self-organizing teams that spot repetition and document it once," "regular reflection **before the monthly bill arrives**." Sotto l'umorismo ("staring at a usage bar nervously") si cela una tesi seria: il vero vincolo economico dello sviluppo assistito dall'IA non è più la velocità ma il **token budget** e l'economia della **finestra di contesto**. Due battute finali chiudono il testo: **« You don't have a prompt problem. You have a context-window problem. »** e **« Everyone's a prompt engineer until they run out of monthly quota. »** Da notare, la strizzata d'occhio meta: un manifesto sulla frugalità dei token co-scritto *con* i modelli.

#The Token Manifesto#Nicolas Martignole#Le Touilleur Express

Nicolas Martignole (Le Touilleur Express) · avec GLM-5.2 et MiniMax-M3

Economia e Mercato Traduzione verificata automaticamente

GLM-5.2 leads open weights models and sits at #3 overall on GDPval-AA, a real-world agentic work benchmark

Annuncio di benchmark da **Artificial Analysis** (piattaforma indipendente di valutazione di modelli AI, via X/Twitter + pagina del modello): **GLM-5.2** di **Z.ai** (Zhipu AI, @Zai_org) diventa **il modello open weights leader** e sale al **#3 posto nella classifica generale** di **GDPval-AA**, un benchmark basato su casi reali per il *lavoro intellettuale economicamente rilevante* (compiti agentic, multi-turno, a lungo orizzonte). GLM-5.2 ottiene **1524 Elo**, dietro solo a **Claude Fable 5 (1783)** e **Claude Opus 4.8 (1615)**, e alla pari con **GPT-5.5 (xhigh, 1509)**. Precede con largo margine il miglior modello open successivo (**MiniMax-M3, 1408**), insieme a numerosi modelli proprietari: **Gemini 3.5 Flash (1357)**, **Qwen 3.7 Max (1289)**, **Muse Spark (1158)**. I compiti sono autenticamente agentic: **~31 turni per compito** in media su **1.999 confronti**. La stessa classifica si conferma sull'**Artificial Analysis Intelligence Index** (1° tra i modelli open weights), sull'**Agentic Index** (#3) e su **AA-Briefcase** (#3, davanti a GPT-5.5 xhigh, dietro solo a Fable 5). Da segnalare: un modello **open weights** con licenza **MIT**, **MoE con 753 miliardi di parametri / 40 miliardi attivi**, **contesto di 1M token**, con un prezzo di **1,40$/4,40$ per 1M di token** in input/output, che rivaleggia con la frontiera proprietaria sul lavoro agentic — un vero passo avanti per i modelli open.

#GLM-5.2#Z.ai#Zhipu AI

Artificial Analysis (@ArtificialAnlys)