Alibaba veröffentlicht Open-Weights-KI-Modell Qwen3.8-Max mit Spitzenwerten in Programmier-Benchmarks
Hangzhou, 3. August 2026
N509FZ / Wikimedia Commons / CC BY-SA 4.0
Kurzfassung
Alibaba hat das KI-Modell Qwen3.8-Max als Open-Weights-Version veröffentlicht und beansprucht damit eine Spitzenposition unter den KI-Systemen für Programmieraufgaben. In mehreren Benchmarks erreicht das Modell Werte, die teilweise über denen etablierter Konkurrenten wie Anthropics Claude Fable 5 und OpenAIs GPT-5.6 Sol liegen.
Der chinesische Technologiekonzern Alibaba hat am 3. August 2026 sein neues KI-Modell Qwen3.8-Max als Open-Weights-Veröffentlichung vorgestellt und positioniert es in Programmier-Benchmarks auf Augenhöhe mit den führenden Systemen von Anthropic und OpenAI.
Der chinesische Technologiekonzern Alibaba hat sein neues KI-Sprachmodell Qwen3.8-Max als Open-Weights-Version veröffentlicht. Open-Weights-Modelle veröffentlichen die gelernten Parameter des neuronalen Netzes, sodass Entwicklerinnen und Entwickler das Modell eigenständig betreiben, anpassen und weiterverwenden können. Mit dem Schritt tritt Alibaba in einen Wettbewerb um die Spitze unter den KI-Systemen für Programmieraufgaben ein, der bislang vor allem von US-Anbietern dominiert wurde.
In internen Benchmark-Vergleichen schneidet Qwen3.8-Max in mehreren Tests deutlich besser ab als sein Vorgängermodell Qwen3.7-Max. Auf der Plattform Terminal Bench 2.1 erreicht das neue Modell einen Wert von 86,6 und liegt damit vor dem Vorgänger mit 74,5. Bei SWE-bench Pro kommt Qwen3.8-Max auf 67,7 Punkte, verglichen mit 60,6 für Qwen3.7-Max. Auch bei DeepSWE 1.1 (56,6 zu 21,6), FrontierSWE (73,5 zu 40,7) und PaperBench (93,0 zu 64,8) zeigt sich ein deutlicher Sprung gegenüber der Vorgängerversion.
Benchmark-Ergebnisse im Überblick
Im direkten Vergleich mit den derzeit führenden kommerziellen Modellen liefert Qwen3.8-Max gemischte Ergebnisse. Bei Terminal Bench 2.1 liegt es mit 86,6 Punkten vor Anthropics Claude Fable 5 (84,6) und OpenAIs GPT-5.6 Sol (88,8). Bei SWE-bench Pro führen GPT-5.6 Sol (80,0) und Claude Fable 5 (69,2) vor dem neuen Alibaba-Modell (67,7). Beim FrontierSWE-Test belegt Qwen3.8-Max mit 73,5 Punkten den zweiten Platz hinter GPT-5.6 Sol (88,8). Auf GPQA Diamond, einem Test für logisches Schlussfolgern, erreicht Qwen3.8-Max 92,6 Punkte und liegt damit gleichauf mit Claude Fable 5 (92,6) und hinter GPT-5.6 Sol (94,1).
Benchmarks sind standardisierte Tests, mit denen die Leistungsfähigkeit von KI-Modellen in klar definierten Aufgaben wie Codegenerierung oder logischem Schlussfolgern gemessen wird. Sie ermöglichen Vergleiche zwischen Systemen unterschiedlicher Anbieter, können aber die Praxisrelevanz nur eingeschränkt abbilden, da reale Aufgabenstellungen von der Testumgebung abweichen. Branchenbeobachter werten die Veröffentlichung dennoch als Signal, dass der Abstand zwischen chinesischen und US-amerikanischen KI-Entwicklungen kleiner geworden ist.
Open Weights als strategischer Ansatz
Mit der Open-Weights-Strategie verfolgt Alibaba einen anderen Ansatz als die direkten US-Wettbewerber. Während OpenAI mit GPT-5.6 Sol auf geschlossene Systeme setzt, deren interne Gewichte nicht veröffentlicht werden, ermöglicht Alibaba externen Entwicklern den Zugang zu den Modellparametern. Dies erleichtert eigenständige Anpassungen, lokale Bereitstellung und unabhängige Sicherheitsprüfungen. Branchenkenner sehen darin einen Wettbewerbsvorteil in Märkten mit Anforderungen an Datensouveränität und Datenhoheit, etwa in Europa.
Die Veröffentlichung reiht sich in eine Serie chinesischer Modellveröffentlichungen ein. Neben Qwen3.8-Max positioniert sich auch das Modell Kimi K3 als relevanter Wettbewerber im Open-Weights-Segment. Beide Systeme werden von chinesischen Anbietern entwickelt, die verstärkt auf offene Veröffentlichung setzen, um internationale Entwicklergemeinschaften anzusprechen und technologische Standards mitzuprägen.
Verfügbarkeit und unabhängige Validierung
Alibaba hat angekündigt, das Modell über seine Cloud-Plattform sowie über die Plattform Hugging Face bereitzustellen, auf der Entwicklerinnen und Entwickler KI-Modelle herunterladen und gemeinsam weiterentwickeln können. Damit steht Qwen3.8-Max unmittelbar nach der Veröffentlichung für Tests und Anwendungen außerhalb der Alibaba-Infrastruktur zur Verfügung. Zu konkreten Lizenzbedingungen und zulässigen kommerziellen Nutzungsformen hat das Unternehmen in der bisherigen Mitteilung keine detaillierten Angaben gemacht.
Die Benchmark-Werte stammen aus vier unabhängigen Berichten, die das Modell Qwen3.8-Max übereinstimmend mit den angegebenen Punktzahlisten einordnen. Eine Validierung durch unabhängige Drittstellen außerhalb der Alibaba-Tests steht für die in der Mitteilung genannten Ergebnisse noch aus. Branchenbeobachter betonen, dass unabhängige Replikationen der Benchmark-Ergebnisse abgewartet werden müssen, bevor die Leistungsfähigkeit von Qwen3.8-Max abschließend bewertet werden kann.
Mit Qwen3.8-Max verschärft Alibaba den Wettbewerb im Segment der KI-Modelle für Software-Entwicklung. Sollten sich die Benchmark-Ergebnisse in unabhängigen Tests bestätigen, würde das Modell eine technologische Konkurrenz zu den etablierten Systemen aus den USA darstellen und die globale KI-Landschaft stärker diversifizieren.
In der europäischen Entwicklergemeinschaft wird die Veröffentlichung mit Interesse aufgenommen, da Open-Weights-Modelle besonders unter Anforderungen der Datenschutz-Grundverordnung (DSGVO) und bei Bedenken hinsichtlich der Datenübermittlung in Drittländer relevant sind. Mit Qwen3.8-Max steht Entwicklerinnen und Entwicklern in Europa nun ein weiteres leistungsfähiges Open-Weights-Modell zur Verfügung, das sich für lokale Bereitstellung in europäischen Rechenzentren eignet.
Fragen & Antworten
Was ist Qwen3.8-Max?
Qwen3.8-Max ist ein KI-Sprachmodell des chinesischen Technologiekonzerns Alibaba, das am 3. August 2026 als Open-Weights-Version veröffentlicht wurde und auf Programmieraufgaben spezialisiert ist.
Wie schneidet Qwen3.8-Max in Benchmarks im Vergleich zu GPT-5.6 Sol und Claude Fable 5 ab?
In Programmier-Benchmarks wie Terminal Bench 2.1 (86,6) und FrontierSWE (73,5) liegt Qwen3.8-Max vor Claude Fable 5, während GPT-5.6 Sol bei SWE-bench Pro (80,0) und GPQA Diamond (94,1) die Führung behält.
Was bedeutet Open-Weights-Veröffentlichung in diesem Kontext?
Open-Weights bedeutet, dass die gelernten Parameter des KI-Modells öffentlich zugänglich gemacht werden, sodass Entwicklerinnen und Entwickler das Modell eigenständig betreiben und anpassen können, anders als bei den geschlossenen Systemen von OpenAI.