Alibaba Qwen 3 8 (Bild © Alibaba )
Derzeit ist Qwen-3.8 ausschließlich als Vorschauversion über die Cloud-Infrastruktur von Alibaba verfügbar. Der Zugriff erfolgt über ein Token-Modell, was bedeutet, dass Nutzer auf ein bestimmtes Token-Budget beschränkt sind und keinen unbegrenzten API-Zugriff haben. Die „Max“-Variante des Modells ist die Hauptversion, die während dieser Vorschau-Phase angeboten wird.
Veröffentlichung des Sail-AI-Software-Stacks
Im Rahmen der World AI Conference hat T-Head, Alibabas Chipentwicklungsabteilung, mit der Veröffentlichung des Sail-AI-Software-Stacks begonnen. Diese Veröffentlichung umfasst derzeit sechs Repositories auf GitHub, darunter das Inferenz-Framework „Triton“ sowie von Nvidia und Deepseek adaptierte Software
Aus der Entwicklerdokumentation geht hervor, dass diese öffentlichen Repositories nur einen Teil der vollständigen Sail-Software-Suite darstellen. Das strategische Ziel hinter der Veröffentlichung dieses Codes ist es, die Hürden für Entwickler zu senken, die auf Alibabas proprietäre Zhenwu-Beschleuniger umsteigen möchten. Diese Hardware-Beschleuniger werden von Alibaba intern zur Ausführung seiner Modelle, darunter Qwen-3.8, eingesetzt und wurden bereits an eine beträchtliche Anzahl externer Kunden ausgeliefert.
