Zurück zum Glossar

Begriff

Qwen3-Max

Qwen3-Max ist Alibabas Billion-Parameter-Flaggschiff vom September 2025 — ein Mixture-of-Experts-Modell mit 262K Kontext, das anders als frühere Qwen-Modelle nur über API zugänglich ist.

Qwen3-Max — ausführlicher erklärt

Alibaba stellte Qwen3-Max im September 2025 als bislang größtes Modell der Qwen-Familie vor (Preview ab 5. September 2025). Es ist ein Mixture-of-Experts-Modell mit rund einer Billion Parametern, das durch selektive Aktivierung nur eines Teils der Experten je Anfrage effizient bleibt. Das Kontextfenster reicht bis 262.144 Tokens; trainiert wurde das Modell laut Alibaba auf 36 Billionen Tokens. Alibaba-Cloud-CTO Zhou Jingren hob fortgeschrittene Code-Generierung und agentische Fähigkeiten hervor.

Innerhalb der Qwen-Reihe ist die Max-Variante die Spitzenklasse — größer und leistungsfähiger als die frei verfügbaren, kleineren Qwen-Modelle.

Beispiel / Praxisbezug

Qwen3-Max zielt auf anspruchsvolle Coding- und Agenten-Aufgaben, bei denen ein großes Kontextfenster und starke Reasoning-Leistung gefragt sind. Der Zugang ist proprietär: verfügbar über die Alibaba-Cloud-API, Qwen Chat und Plattformen wie OpenRouter. Wer das Modell nutzen will, bindet also eine API an, statt Gewichte selbst zu hosten. Damit steht Qwen3-Max in direkter Konkurrenz zu den geschlossenen Flaggschiffen von OpenAI, Anthropic und Google — auch beim Preismodell pro Token.

Abgrenzung

Wichtig für die Einordnung: Anders als viele kleinere Qwen-Modelle, die als offene Gewichte veröffentlicht werden, ist Qwen3-Max ein Closed-Weight-Modell — es gibt keine frei herunterladbaren Gewichte, nur API-Zugang. Alibaba brach damit bei der Max-Klasse mit der eigenen Open-Source-Tradition. Wer selbst hosten will, greift daher zu den offenen Qwen-Varianten; Qwen3-Max ist der proprietäre Leistungs-Gipfel der Familie.

Alle Beiträge im Überblick:Qwen