2026-08-05 · 2 Min. Lesezeit

Qwen 3.8 Max und 27B: Open-Weight-KI-Modelle im Vergleich

Alibaba hat Qwen 3.8-Max, ein MoE-Modell mit 2,4T Parametern, veröffentlicht und Qwen 3.8-27B für lokale Nutzung angekündigt. Beide werden offene Gewichte haben.

Im Vergleich zu Kimi K3 (2,8T Parametern) bietet Qwen 3.8-Max einen 1M-Kontext und deutlich niedrigere API-Kosten. Qwen 3.8 Max verlangt 2,00 $ pro Million Eingabe-Token (0,20 $ für Cache-Treffer) und 6,00 $ pro Million Ausgabe-Token. Kimi K3 verlangt 2,90 $–3,00 $ pro Million Eingabe-Token (0,30 $ für Cache-Treffer) und 14,00 $–15,00 $ pro Million Ausgabe-Token. Dies verschafft Qwen einen Preisvorteil von 2,4x–2,5x bei Ausgabe-Token und macht es kostengünstiger für Hochdurchsatz-Generierung und iterative Agentenschleifen. Die Geschwindigkeit ist vergleichbar, aber die Effizienz von Qwen verschafft ihm einen Vorteil für Unternehmensbereitstellungen. Für Self-Hosting bietet Kimi K3 offene Modellgewichte (594 GB MXFP4 quant), sodass Organisationen API-Token-Kosten vollständig eliminieren können, indem sie das Modell auf privater Multi-Node-Infrastruktur oder Workstations mit hohem Arbeitsspeicher ausführen.

In Bezug auf die Leistung zeichnet sich Kimi K3 durch komplexes agentisches Denken und Softwareentwicklung aus und führt bei Benchmarks wie FrontierSWE (81,2 % vs. 73,5 %), DeepSWE 1.1 (69,0 % vs. 56,6 %) und Terminal-Bench 2.1 (88,3 vs. 86,6). Es hält auch die Gesamtführung im akademischen Denken und übertrifft Qwen bei GPQA Diamond (93,5 % vs. 92,6 %), Humanity's Last Exam (56,0 % vs. 43,6 %) und MLS-Bench Lite (48,3 % vs. 41,0 %). Allerdings führt Qwen 3.8 Max bei multimodaler Vision und Wahrnehmung, erzielt höhere Punktzahlen bei PerceptionBench (63,5 vs. 58,5) und MMMU-Pro (82,3 % vs. 81,6 %) und übertrifft Kimi K3 bei Computer- und OS-Automatisierung mit einem verifizierten SOTA-Score von 86,1 % auf OSWorld.

Das 27B-Modell, Nachfolger des 3.6-27B, läuft quantisiert auf einer einzelnen GPU (17GB VRAM) und ersetzt das ältere Modell für private Bereitstellungen. Dies macht es ideal für On-Premises-Agentenarbeit und bietet eine Balance zwischen Leistung und Datenschutz.

MerkmalQwen 3.8-MaxKimi K3Qwen 3.8-27B
Gesamtparameter2,4T2,8T27B
Kontext1M1MUnbekannt
API-Kosten (Eingabe/Ausgabe)2,00 $/6,00 $2,90 $–3,00 $/14,00 $–15,00 $N/A
BereitstellungAPI/OpenAPI/OpenLokal
← Nach rechts scrollen für mehr →

Offene Gewichte versprechen, die KI an der Spitze zu demokratisieren. Die Veröffentlichung der offenen Gewichte wird innerhalb einer Woche erwartet.

Lassen Sie uns zusammenarbeiten

Benötigen Sie weitere Informationen, Hilfe bei Ihrem Projekt oder zur Entwicklung einer Idee?

Ob einfache Frage, kurzer Zweifel oder ein 5-Minuten-Chat, schreib mir einfach—es kostet nichts und ich helfe immer gerne. Ich liebe es, Probleme zu verstehen, kreative Lösungen zu finden und mich auf einfache, zuverlässige und unkomplizierte Ideen zu konzentrieren, die sich schnell umsetzen lassen.

Kontaktiere mich

Thema wechseln

Wählen Sie ein spezielles Thema zum Erkunden: