Alibaba veröffentlicht Qwen3.8-Max als Open Weights und fordert Claude und ChatGPT bei Kosten und Verbreitung heraus
Wichtige Erkenntnisse
- •Alibaba hat Qwen3.8-Max als Open Weights veröffentlicht und macht damit erstmals ein Max-Modell von Qwen kostenlos zum Herunterladen und Selbsthosten verfügbar.
- •Das Modell mit 2,4 Billionen Parametern nutzt ein Mixture-of-Experts-Design, das pro Berechnung nur 95 Milliarden Parameter aktiviert, um die Inferenzkosten zu senken und zugleich die Gesamtkapazität zu erhalten.
- •Qwen3.8-Max führt bei den meisten Benchmark-Kategorien für multimodale Aufgaben mit Dokumenten, Video und räumlichem Schlussfolgern, gewann jedoch nur sieben von 31 Texttests und einen von 12 coding-spezifischen Tests.
- •Alibaba gibt an, dass Qwen3.8-Max rund 30 % der Kosten von Anthropic's Claude Fable 5 verursacht und damit auch bei zusätzlichen Denk-Schritten deutlich günstiger ist.
- •Die Open-Weight-Veröffentlichung markiert eine Kehrtwende gegenüber April, als Alibaba die kostenlose Stufe von Qwen Code im Zuge einer breiteren Hinwendung zu geschlossenen, kostenpflichtigen Modellen abschaffte.

Alibaba hat Qwen3.8-Max veröffentlicht, das bislang leistungsfähigste künstliche Intelligenzmodell des Unternehmens, und macht damit zum ersten Mal ein Qwen-Modell der Max-Klasse als Open Weights verfügbar.
Die Modellgewichte werden in der Woche nach dem Start am Montag auf Hugging Face und ModelScope veröffentlicht. Mit insgesamt 2,4 Billionen Parametern — von denen zu jedem Zeitpunkt 95 Milliarden aktiviert sind — nutzt das Modell eine Mixture-of-Experts-Architektur, bei der jede Berechnung über eine Teilmenge spezialisierter Subnetzwerke geleitet wird, statt das gesamte Modell auf einmal einzusetzen. Dieses Design erhält die Gesamtkapazität und senkt zugleich die Inferenzkosten. Es soll kleineren Unternehmen und Forschungslabors mit ausreichender Hardware ermöglichen, ein System auf dem neuesten Stand der Technik zu betreiben, ohne die pro Token anfallenden Kosten eines großen Rechenzentrums-API-Zugriffs zu tragen.
Leistungsangaben mit Fokus auf Ausdauer
Statt mit klassischen Benchmark-Vergleichen zu beginnen, stellte Alibaba die anhaltenden autonomen Fähigkeiten des Modells in den Vordergrund. Nach Angaben des Unternehmens verbrachte Qwen3.8-Max 16 Tage damit, eigenständig ein Coding-Tool zu entwickeln, und erzeugte dabei 265 Commits, 127 Pull Requests und 151 Issues — ohne menschliches Eingreifen. Außerdem soll das Modell fünf Tage lang eine Forschungsarbeit reproduziert haben, zu der ihm kein Quellcode vorlag, und anschließend das ursprüngliche Ergebnis der Arbeit um 2,7 Punkte übertroffen haben. In einem 24-stündigen Wettbewerb im Bereich Machine Learning lag es vor 458 von 526 teilnehmenden menschlichen Teams.
Kompatibel mit Konkurrenz-Tools für Programmierung
Qwen3.8-Max wird mit Einrichtungsanweisungen für Anthropic's Claude Code und OpenAI's Codex ausgeliefert — beides konkurrierende Plattformen. Alibabas API ist mit den Protokollen beider Unternehmen kompatibel, und die meisten Coding-Benchmarks des Modells wurden innerhalb von Claude Code durchgeführt.
Die Benchmark-Ergebnisse fallen jedoch gemischt aus. Über 31 textbasierte Tests in Alibabas eigener Bewertungstabelle sicherte sich Anthropic's Fable 5 in 15 Kategorien den ersten Platz, OpenAI's GPT-5.6 Sol in neun und Qwen3.8-Max in sieben. In 12 auf Programmierung ausgerichteten Tests gewann Qwen genau einmal.
Hervorzuheben ist das Modell bei der Kosteneffizienz. Alibaba gibt an, dass Qwen3.8-Max nur rund 30 % dessen kostet, was Anthropic für Claude Fable 5 verlangt. Selbst wenn zusätzliche Iterationen oder Denk-Schritte nötig sind, bleiben die Gesamtkosten für die Erledigung einer Aufgabe damit deutlich niedriger.
Bei multimodalen Aufgaben mit Dokumenten, Video und räumlichem Schlussfolgern drehen sich die Ranglisten deutlich um: Qwen führt dort in den meisten Benchmark-Kategorien.
Strategische Kehrtwende bei offenem Zugang
Die Veröffentlichung markiert eine bemerkenswerte Richtungsänderung. Im April schaffte Alibaba die kostenlose Stufe von Qwen Code ab, während sich das Team nach Abgängen in der Führung zunehmend geschlossenen, kostenpflichtigen Modellen zuwandte. Eine Decrypt-Besprechung von Qwen 3.7 Max hatte bereits angemerkt, dass die Plus-Version offen sein werde, die Max-Variante jedoch voraussichtlich nur über die API zugänglich bleiben würde.
Das Timing der Open-Weight-Veröffentlichung passt zu breiteren Verschiebungen in der KI-Landschaft. Chinesische Open-Weight-Modelle stiegen von unter 2 % der auf OpenRouter verarbeiteten Tokens Ende 2024 auf ungefähr 61 % bis Mitte 2026. Qwen hat Meta's Llama als weltweit am häufigsten selbst gehostetes Modell überholt.
Die Verfügbarkeit als Open Weights bedeutet, dass Organisationen das Modell herunterladen, prüfen und auf eigener Infrastruktur betreiben können — ein attraktives Angebot für Unternehmen mit Anforderungen an Datenhoheit oder für jene, die Vendor Lock-in vermeiden wollen, insbesondere da geopolitische Spannungen grenzüberschreitende API-Abhängigkeiten erschweren.
Unterdessen hat Washington Fable 5 und Mythos 5 im Juni unter Exportkontrollen eingeschränkt, und Peking erwägt Berichten zufolge eigene Beschränkungen für chinesische Modelle, die im Ausland eingesetzt werden.
Auch wenn Qwen3.8-Max auf mehreren Benchmark-Tabellen hinter der Konkurrenz zurückliegt, scheint Alibaba Verbreitung und Zugänglichkeit zu priorisieren — und positioniert das Modell als kostenlose, herunterladbare Alternative, die sich der Leistung führender proprietärer Systeme zu einem Bruchteil der Kosten annähert.