Qwen 3.8 Max e 27B: modelli AI open-weight a confronto
Alibaba ha lanciato Qwen 3.8-Max, un modello MoE da 2,4T di parametri, e ha annunciato Qwen 3.8-27B per uso locale. Entrambi avranno pesi aperti.
Rispetto a Kimi K3 (2,8T di parametri), Qwen 3.8-Max offre un contesto di 1M e costi API significativamente inferiori. Qwen 3.8 Max addebita $2,00 per milione di token di input ($0,20 per hit in cache) e $6,00 per milione di token di output. Kimi K3 addebita $2,90–$3,00 per milione di token di input ($0,30 per hit in cache) e $14,00–$15,00 per milione di token di output. Questo dà a Qwen un vantaggio di prezzo di 2,4x–2,5x sui token di output, rendendolo più conveniente per la generazione ad alto throughput e i loop agentici iterativi. La velocità è comparabile, ma l'efficienza di Qwen gli dà un vantaggio per la distribuzione aziendale. Per l'hosting autonomo, Kimi K3 fornisce pesi del modello aperti (594 GB MXFP4 quant), consentendo alle organizzazioni di eliminare completamente i costi dei token API eseguendo il modello su infrastruttura privata multi-nodo o workstation ad alta memoria.
In termini di prestazioni, Kimi K3 eccelle nel ragionamento agentico complesso e nell'ingegneria del software, guidando su benchmark come FrontierSWE (81,2% vs. 73,5%), DeepSWE 1.1 (69,0% vs. 56,6%) e Terminal-Bench 2.1 (88,3 vs. 86,6). Detiene anche il vantaggio complessivo nel ragionamento accademico, superando Qwen su GPQA Diamond (93,5% vs. 92,6%), Humanity's Last Exam (56,0% vs. 43,6%) e MLS-Bench Lite (48,3% vs. 41,0%). Tuttavia, Qwen 3.8 Max guida nella visione multimodale e nella percezione, ottenendo punteggi più alti su PerceptionBench (63,5 vs. 58,5) e MMMU-Pro (82,3% vs. 81,6%), e supera Kimi K3 nell'automazione di computer e OS con un punteggio SOTA verificato dell'86,1% su OSWorld.
Il modello 27B, successore del 3.6-27B, gira quantizzato su una singola GPU (17GB di VRAM), sostituendo il vecchio modello per implementazioni private. Questo lo rende ideale per lavoro agentico on-premises, offrendo un equilibrio tra prestazioni e privacy.
| Caratteristica | Qwen 3.8-Max | Kimi K3 | Qwen 3.8-27B |
|---|---|---|---|
| Parametri totali | 2,4T | 2,8T | 27B |
| Contesto | 1M | 1M | Da definire |
| Costo API (in/out) | $2,00/$6,00 | $2,90–$3,00/$14,00–$15,00 | N/D |
| Distribuzione | API/Open | API/Open | Locale |
I pesi aperti promettono di democratizzare l'IA di frontiera. Il rilascio dei pesi aperti è previsto entro una settimana.
Lavoriamo insieme
Hai bisogno di maggiori informazioni, aiuto con il tuo progetto o di sviluppare un'idea?
Che si tratti di una domanda semplice, un dubbio rapido o una chat di 5 minuti, mandami un messaggio—non costa nulla e sono sempre pronto ad aiutare. Mi piace ascoltare per capire il problema, essere creativo nelle soluzioni e puntare a idee semplici, affidabili e non complicate da realizzare rapidamente.
Contattami →