• Tech Support ⤴
  • Projects
  • Services
    • AI Development
    • UI/UX Design
    • Web Development
    • Technology Support
    • Mobile App Development
    • Banking ATM Interfaces
    • Process Automation
    • Security Auditing
    • Local AI Servers
  • odoo ERP
get in touchStart with Eva
logo
Tech Support ⤴
Projects
Services
AI DevelopmentUI/UX DesignWeb DevelopmentTechnology SupportMobile App DevelopmentBanking ATM InterfacesProcess AutomationSecurity AuditingLocal AI Servers
odoo ERP
get in touchStart with Eva
Loading…
logo

Transforming businesses through AI-powered digital innovation and creative excellence.

Quick Links

BlogAinexProjectsContact us

Contact Us

pinDubai Digital Park, A5, DTEC - Silicon Oasisemail[email protected]phone+971 55 7538087
© 2026 aratech. All rights reserved.
Privacy PolicyTerms of ServiceCookie Policy
Startseite / Blog / Alibabas Qwen3.8-Max ist da mit 2,4 Billionen Parametern. Aber können Sie es tatsächlich verwenden?

Alibabas Qwen3.8-Max ist da mit 2,4 Billionen Parametern. Aber können Sie es tatsächlich verwenden?

Alibaba stellt Qwen3.8-Max (2,4 Billionen Parameter) vor und behauptet, es sei nur von Fable 5 übertroffen. Aber ohne offene Gewichte, ohne Benchmarks und mit dem Muster, zuerst Max zu gehen – ist das ein echtes Release oder nur Positionierung?

20. Juli 2026 - 8 Min. Lesezeit
Alibabas Qwen3.8-Max ist da mit 2,4 Billionen Parametern. Aber können Sie es tatsächlich verwenden?

Alibabas Qwen3.8-Max ist mit 2,4 Billionen Parametern da. Aber können Sie es tatsächlich verwenden?

19. Juli 2026 – WAIC Shanghai. Zwei Tage nachdem Moonshot AI Kimi K3 fallen ließ (2,8 Billionen Parameter, offene Gewichte für 27. Juli versprochen), schlug Alibaba zurück. Das Qwen-Team zeigte eine Vorschau von Qwen3.8-Max-Preview, einem multimodalen Modell mit 2,4 Billionen Parametern, das nach Angaben des Unternehmens „nach Claude Fable 5 das zweitgrößte“ unter den getesteten Systemen ist.

Das KI-Wettrüsten ist jetzt viel lauter geworden.

Aber hier ist die Sache – und es ist eine große Sache: Das Modell, das Sie heute tatsächlich verwenden können, ist nicht das Modell, über das Sie gelesen haben. Lassen Sie uns unterscheiden, was versendet wurde, und was behauptet wurde.

Was derzeit tatsächlich verfügbar ist

Das Live-Produkt ist Qwen3.8-Max-Preview, auf das über Alibabas Token-Plan-Abonnement sowie die Qoder- und QoderWork-Plattformen zugegriffen werden kann. Shuai Bai, ein Qwen-Entwickler, bestätigte, dass es sich um das erste multimodale Modell des Teams mit mehr als einer Billion Parametern handelt – es verarbeitet Text, Bilder, Videos und Dokumente in einer spärlichen Mixture-of-Experts-Architektur.

Wichtige Fakten über das, was live ist:

  • 2,4 Billionen Parameter (Alibabas Behauptung – es wurde keine Modellkarte oder Spezifikation veröffentlicht, um dies zu bestätigen)
  • Sparse MoE-Architektur – Die Anzahl der aktiven Parameter pro Token wird nicht bekannt gegeben. Dies ist die Zahl, die tatsächlich die Bereitstellungskosten bestimmt
  • Multimodal – verarbeitet Text, Bilder, Videos und Dokumente
  • Kompatibel mit OpenAI und Anthropic API – vorhandene Codierungsagenten können auf Qwen3.8 verweisen, ohne ihre Kabelbäume neu erstellen zu müssen
  • Vorschaupreise – angeboten zu 10 % des Standardpreises über den Token-Plan

Das Open-Weight-Problem

Qwen3.8 wird als offenes Modell vermarktet. Aber heute gibt es keine offenen Gewichte mehr. Nicht auf Hugging Face, nirgendwo.

Im offiziellen @Alibaba_Qwen-Konto heißt es, dass offene Gewichte „bald“ verfügbar sein werden – aber ohne Datum, ohne Lizenz, ohne Hugging-Face-Repository und vor allem: keine kleine Variante angekündigt. Ein Modell mit 2,4 Billionen Parametern ist ein Rechenzentrumsobjekt, egal wie stark Sie es quantisieren. Selbst bei 1-Bit-Quantisierung sind es etwa 270 GB+. Zum Vergleich: Das sind etwa 35 NVIDIA H200-GPUs, allein für die Gewichte.

Alibabas eigene Geschichte erzählt hier eine gemischte Geschichte:

GenerationErscheinungsdatumOffene Gewichte eingetroffenVerbrauchergroße Variante
Qwen 3.516. Februar 202624. Februar (8 Tage)9B (passt für 8-GB-Karte)
Qwen 3.6April 2026Am selben Tag27B dicht, 35B-A3B MoE
Qwen 3.7Mai 2026NiemalsNur geschlossene API
Qwen 3.819. Juli 2026„Bald“ (TBD)Nicht angekündigt

Das Muster änderte sich mit Qwen 3.7, das als proprietäres reines API-Modell ohne offene Gewichte ausgeliefert wurde – kein 27B, kein 9B, nichts. Wenn Qwen 3.8 dem 3,5/3,6-Takt folgt, können Sie innerhalb von ein bis zwei Wochen mit einer lauffähigen 27B- oder 35B-A3B-Variante rechnen. Wenn es dem Präzedenzfall 3.7 folgt, erhalten Sie einen Datencenter-Drop mit der Bezeichnung „offen“ und nichts für Ihre GPU.

„An zweiter Stelle nach Fable 5“ – Reden wir darüber

Die Behauptung von Alibaba, dass es „nach Fable 5 an zweiter Stelle steht“, ist eine selbst angegebene Rangliste. Es wurde keine Benchmark-Tabelle veröffentlicht. Keine Aufforderungen, Gurte oder Methoden. In der Rangliste der künstlichen Analyse – dem am häufigsten zitierten unabhängigen Index – wird Qwen 3.8 überhaupt nicht aufgeführt. Sein aktuelles Oberteil sieht so aus:

  1. Claude Fable 5 – 60
  2. GPT-5.6 – 59
  3. Kimi K3 – 57
  4. Claude Opus 4.8 – 56
  5. Qwen 3.7 Max – 46

Hier gibt es einen historischen Präzedenzfall: Qwen 3.7 Max wurde als „Chinas Nummer eins“ angepriesen und landete bei unabhängiger Bewertung bei 46 – immer noch stark, nur nicht das, was die Ankündigung implizierte.

So schlägt es sich: Der TrilogyAI-Test

Es ist ein unabhängiger Benchmark entstanden. TrilogyAI führte Qwen3.8-Max-Preview und Kimi K3 durch einen passenden StackPerf-Test – 269 Dateien in zwei unbekannten Projekten, die Planung, Storyboarding und Empfehlungen zur Systemarchitektur erforderten.

Ergebnisse nach Blindprüfung:

MetrischKimi K3Qwen3.8-Max-Vorschau
Punktzahl (von 100)8380
AufgabenerledigungFrüher, weniger TokenLängerer Bericht, bessere Metadaten
WerkzeugaufrufeWeitere AnfragenWeniger, 100 % Erfolgsquote
Cache-Trefferquote>90 %>90 %

Kimi lag drei Punkte vor Qwen, aber Qwen lieferte stärkere Wiedergabemetadaten und klarere Definitionen der Systemgrenzen. Die Forscher stellten fest, dass „ihre gemeinsame Empfehlung stärker war als jeder vorgeschlagene Vertrag für sich.“

Der geopolitische Kontext

Diese Veröffentlichung existiert nicht im luftleeren Raum. Am 7. Juli berichtete Reuters, dass das chinesische Handelsministerium Gespräche mit Alibaba, ByteDance und Z.ai über eine mögliche Einschränkung des ausländischen Zugangs zu Chinas fortschrittlichsten KI-Modellen geführt habe – Gespräche, die sich ausdrücklich auf Open-Weight-Releases und sogar unveröffentlichte zukünftige Modelle bezogen.

Alibaba war ein namentlich genannter Teilnehmer.

Das Unternehmen hat diese Gespräche nicht mit den Veröffentlichungsplänen von Qwen in Verbindung gebracht und es gibt noch keine Regeln. Es lohnt sich jedoch, den Zeitpunkt der „bald offenen Gewichtung“ und der Regierungskonsultationen über deren Einschränkung genau im Auge zu behalten.

Das Fazit

Qwen3.8-Max-Preview ist ein echtes, leistungsfähiges Modell. Wenn Alibabas 2,4T-Angabe bei unabhängigen Tests Bestand hat, ist das Unternehmen mit Spitzensystemen wirklich konkurrenzfähig. Die multimodalen Funktionen, die API-Kompatibilität und die Vorschaupreise sind allesamt positiv.

Aber bis offene Gewichte auf den Markt kommen – mit einer Lizenz, die etwas bedeutet, in einer Größe, die zu echter Hardware passt – ist es verfrüht, Qwen 3.8 als „offen“ zu bezeichnen. Sehen Sie sich die Qwen Hugging Face-Organisation an, nicht die Tweets. Gewichte oder eine benannte kleine Variante sind das einzige Signal, das zählt.

Im Moment ist das KI-Wettrüsten real. Die Revolution des offenen Modells? Ich warte immer noch.


Dieser Artikel wurde am 20. Juli 2026 recherchiert und veröffentlicht. Qwen3.8-Max-Preview wurde am 19. Juli 2026 auf der WAIC Shanghai angekündigt. Benchmarks und Verfügbarkeit ändern sich schnell – schauen Sie sich die neuesten Updates von @Alibaba_Qwen an.

Inhaltsverzeichnis

  • ↗Was derzeit tatsächlich verfügbar ist
  • ↗Das Open-Weight-Problem
  • ↗„An zweiter Stelle nach Fable 5“ – Reden wir darüber
  • ↗So schlägt es sich: Der TrilogyAI-Test
  • ↗Der geopolitische Kontext
  • ↗Das Fazit

Ähnliche Beiträge

# GLM-5.2: Das offene Modell, das niemand verbieten kann

# GLM-5.2: Das offene Modell, das niemand verbieten kann

Als die USA Claude Fable 5 einschränkten, veröffentlichte Zhipu AI GLM-5.2 unter MIT-Lizenz. Die Ära der offenen Gewichte ist nicht mehr theoretisch.

Necolas HamwiNecolas Hamwi
19. Juli 2026 - 12 Min. Lesezeit
Titelbild mit 35 selbst gehosteten GitHub-Projekten, die im Artikel vorgestellt werden

35 selbst gehostete Projekte auf Github: TaskView, ConvertX, Work-Review, relaticle, postlab, rejourney

Wir haben 35 herausragende selbst gehostete Projekte auf GitHub zusammengestellt. Hier sind die sechs, die Ihre Aufmerksamkeit verdienen.

Necolas HamwiNecolas Hamwi
12. Juli 2026 - 8 Min. Lesezeit
35 Self-Hosted Projects on GitHub — Episode 5

35 Self-Hosted Projects on GitHub — Episode 5

From task management and file conversion to AI-powered job hunting and wildlife sound analysis — here are 10 standout self-hosted projects from GitHub that you can run on your own infrastructure.

Necolas HamwiNecolas Hamwi
12. Juli 2026 - 0 Min. Lesezeit