Qwen 3.5 397B
Qwen 3.5 397B ist ein Sprachmodell des chinesischen Konzerns Alibaba, gebaut von dessen KI-Team Qwen. Es erschien im Februar 2026 unter der Apache-2.0-Lizenz, die Gewichte stehen offen auf Hugging Face zum Download. Die Zahl im Namen nennt die Größe: 397 Milliarden Parameter sind gespeichert, aktiv rechnen davon pro Token nur rund 17 Milliarden. Ein Token ist die kleinste Texteinheit, die ein Modell verarbeitet, meist ein kurzes Wort oder ein Wortteil.
Bei lowcloud ist Qwen 3.5 397B eines von 14 Modellen, die auf Servern in der EU laufen. Der Betrieb läuft über die Melious AI GmbH in Saarbrücken, die Anfrage geht nicht an Alibaba. Das Modell lässt sich im Chat pro Nachricht wählen, fest für einen Agenten hinterlegen oder einem einzelnen Schritt eines Ablaufs zuweisen. Ein Punkt gehört vor den Einsatz: Qwen beschreibt das Modell als bildfähig, und auch die Modellseite von Melious führt es so. lowcloud hat das gegen die Schnittstelle geprobt. Das Modell lehnt ein Bild nicht ab, es liefert eine leere Antwort. lowcloud führt es deshalb als nicht bildfähig.
- Hersteller
- Qwen, China
- Kontextfenster
- 262k Token
- Bilder lesen
- nein
- Lizenz
- Apache 2.0
- Verarbeitung
- EU-Server über Melious
Woher das Modell kommt
Entwickelt hat es Qwen, das KI-Team des chinesischen Konzerns Alibaba mit Sitz in Hangzhou. Das Repository auf Hugging Face wurde am 16. Februar 2026 angelegt. Der vollständige Name der Veröffentlichung lautet Qwen3.5-397B-A17B. Das A17B steht für die aktiven Parameter: 397 Milliarden sind insgesamt gespeichert, pro Token rechnen davon rund 17 Milliarden mit. Die Lizenz ist Apache 2.0. Das ist eine freie Lizenz ohne Zusatzauflagen. Herunterladen, betreiben, verändern und kommerziell einsetzen ist erlaubt, ohne Obergrenze für Nutzerzahlen und ohne Genehmigungspflicht. Das ist nicht selbstverständlich: Mehrere große Modelle, die auf Übersichtsseiten als Open Source geführt werden, haben eigene Lizenzen mit Auflagen. Hier ist das nicht der Fall. Die Trainingsdaten veröffentlicht Qwen allerdings nicht, deshalb ist offene Gewichte der genauere Begriff als Open Source. Zur Bauweise: Das Modell hat 60 Schichten und ist als Mixture of Experts gebaut, kurz MoE. Es besteht aus 512 Teilnetzen, von denen pro Token nur elf mitrechnen: zehn wechselnde und ein fest beteiligtes. Die Dateien der Gewichte umfassen rund 800 Gigabyte.
Was "auf EU-Servern" hier konkret heißt
Die Kette lässt sich vollständig benennen. Der Kunde spricht mit dem Agenten. Der Agent läuft bei der lowcloud UG in Bielefeld. lowcloud gibt die Anfrage an die Melious AI GmbH in Saarbrücken. Melious führt das Modell in Rechenzentren in der EU aus. Alibaba ist an dieser Kette nicht beteiligt. Das Modell ist frei lizenziert, deshalb kann ein europäischer Anbieter die Gewichte selbst betreiben. Es geht kein Text an einen Server des Herstellers. Was lowcloud nicht weiß: Melious betreibt keine eigenen Rechenzentren, sondern verteilt auf europäische Betreiber. Welcher Betreiber ein bestimmtes Modell bedient, veröffentlicht Melious nicht. Fragt ein Kunde nach dem konkreten Standort, lautet die belastbare Antwort: innerhalb der EU, Vertragspartner für den Betrieb ist Melious in Saarbrücken, der einzelne Betreiber ist nicht ausgewiesen.
Wofür das Modell taugt
Lange Texte. Das Kontextfenster ist die Textmenge, die ein Modell auf einmal berücksichtigen kann. Im lowcloud-Katalog liegt sie bei 262.000 Token. Das reicht für lange Verträge, Protokollsammlungen oder ganze Mailverläufe in einem Schritt, ohne sie vorher zu zerlegen. Schritte mit festem Datenformat. Das Modell nimmt feste JSON-Schemas an. JSON ist ein maschinenlesbares Datenformat. Ein festes Schema heißt: Die Felder werden vorher festgelegt, und das Modell muss genau diese Felder füllen. Das ist der Unterschied zwischen einem Schritt, der zuverlässig in eine Tabelle oder ein CRM schreibt, und einem, den man hinterher aufräumt. lowcloud hat das gegen die Schnittstelle geprobt, nicht von der Herstellerseite übernommen. Mehrsprachige Abläufe. Die Modellkarte von Qwen nennt Unterstützung für 201 Sprachen und Dialekte. Das ist eine Herstellerangabe, keine Messung von lowcloud. Werkzeugaufrufe. Qwen beschreibt das Modell als stark darin, Werkzeuge aufzurufen, also Schritte wie Suchen, Rechnen oder Datenabfragen auszulösen. Auch das ist eine Herstellerangabe. Ein praktischer Hinweis zum Ablauf: Das Modell erzeugt standardmäßig zuerst einen Zwischentext mit seinen Überlegungen und danach die eigentliche Antwort. Das kostet zusätzliche Token und Zeit.
Wofür es nicht taugt
Bilder. Das ist der wichtigste Punkt. Die Modellkarte bei Hugging Face führt einen Bild-Encoder auf, und die Modellseite von Melious führt das Modell als bildfähig. Auf der EU-Schnittstelle passiert etwas anderes: Wird ein Bild mitgeschickt, kommt keine Fehlermeldung, sondern eine leere Antwort. Das ist unangenehmer als ein Fehler, weil der Ablaufschritt formal durchläuft und trotzdem nichts liefert. lowcloud hat das geprobt und führt das Modell deshalb als nicht bildfähig. Diese Beobachtung stammt von lowcloud selbst und widerspricht beiden Herstellerangaben. Muss ein Ablauf Bilder lesen, gibt es im EU-Katalog sechs Alternativen: Kimi K3, Kimi K2.7 Code, Kimi K2.6, GLM 5.3 Flash, Qwen 3.8 27B und Mistral Small 4. Wer Bilder und feste JSON-Schemas zusammen braucht, kommt auf genau eines davon: Kimi K2.6. Wer beim selben Hersteller bleiben will, nimmt Qwen 3.8 27B. Eingaben über 262.000 Token hinaus. Dafür stehen im Katalog Modelle mit einer Million Token bereit: Kimi K3, GLM 5.3, GLM 5.2 und DeepSeek V4 Pro. Kurze Schritte, die sehr oft laufen. Der Zwischentext mit den Überlegungen und die Größe des Modells machen es hier zur teureren Wahl als ein kleines Modell.
Das Modell ist abgelöst
Qwen hat seit dem Erscheinen zwei neuere Generationen veröffentlicht. Qwen3.6 kam im April 2026, Qwen3.8 im August 2026. Im lowcloud-Katalog stehen aus der neueren Generation Qwen 3.8 Max und Qwen 3.8 27B. Qwen 3.8 27B liest Bilder und hat mit 262.000 Token dasselbe Kontextfenster. Qwen 3.8 Max hat 256.000 Token und liest nach der Prüfung von lowcloud keine Bilder. Abgelöst heißt nicht abgeschaltet. Qwen 3.5 397B bleibt im Katalog und läuft weiter. Ein Agent, der damit zuverlässig arbeitet, muss nicht umgestellt werden. Für neue Agenten lohnt der Blick auf die 3.8er zuerst, weil Qwen dort weiterentwickelt. Ein Ersatz in derselben Größenklasse ist keines der beiden Modelle: Qwen 3.8 27B ist deutlich kleiner.
Was es kostet
Konkrete Preise stehen hier nicht. Der Grund: Auf den Einkaufspreis kommt ein Aufschlag, eine hier veröffentlichte Zahl wäre also falsch. Was sich sagen lässt: Im EU-Katalog von lowcloud liegt Qwen 3.5 397B in der unteren Mitte. Es ist weder das günstigste noch das teuerste Modell. Dass ein Modell dieser Größe nicht oben liegt, hängt an der MoE-Bauweise: Es rechnen pro Token nur rund 17 der 397 Milliarden Parameter mit. Die tatsächlichen Kosten stehen an jedem Lauf. Jeder Durchlauf eines Agenten zeigt in der App seinen Betrag in Euro. Damit lässt sich vor dem Ausrollen an einen Kunden durchrechnen, was ein Vorgang kostet, statt ihn zu schätzen. Ein Kostenfaktor ist der Zwischentext mit den Überlegungen des Modells. Er besteht ebenfalls aus Token und taucht deshalb im Betrag des Laufs auf.
Qwen 3.5 397B ausprobieren
Für die Modellwahl brauchst du ein kostenloses Konto. Danach wählst du Qwen 3.5 397B im Chat, pro Agent oder pro Schritt.
Häufige Fragen
Gehen meine Daten nach China, wenn ich Qwen 3.5 397B nutze?
Nein. Das Modell kommt aus China, die Verarbeitung nicht. Die Gewichte sind frei lizenziert und werden von der Melious AI GmbH in Saarbrücken in Rechenzentren in der EU betrieben. Die Kette lautet: Kunde, lowcloud UG in Bielefeld, Melious AI GmbH in Saarbrücken, Rechenzentren in der EU. Alibaba erhält keine Anfrage. Nicht bekannt ist, welcher europäische Betreiber dieses Modell konkret bedient, das veröffentlicht Melious nicht. Wer Qwen direkt über Alibaba Cloud oder qwen.ai nutzt, für den gilt diese Kette nicht.
Ist Qwen 3.5 397B Open Source?
Die Lizenz ist Apache 2.0, also eine freie Lizenz ohne Zusatzauflagen. Herunterladen, betreiben, verändern und kommerziell nutzen ist erlaubt, ohne Nutzerobergrenze und ohne Genehmigung. Die Trainingsdaten veröffentlicht Qwen nicht. Genauer als Open Source ist deshalb der Begriff offene Gewichte.
Kann Qwen 3.5 397B Bilder lesen?
Bei lowcloud nicht. Die Modellkarte von Qwen führt einen Bild-Encoder auf, und die Modellseite von Melious führt das Modell als bildfähig. Beim Proben gegen die EU-Schnittstelle liefert das Modell auf ein Bild aber eine leere Antwort statt einer Ablehnung. lowcloud führt es deshalb als nicht bildfähig. Für Bilder eignen sich aus dem Katalog Kimi K3, Kimi K2.7 Code, Kimi K2.6, GLM 5.3 Flash, Qwen 3.8 27B oder Mistral Small 4.
Wie groß ist das Kontextfenster von Qwen 3.5 397B?
262.000 Token laut lowcloud-Katalog. Das deckt sich mit der Angabe von Qwen zum nativen Kontext von 262.144 Token. Die Modellkarte nennt zusätzlich eine Erweiterung auf rund eine Million Token über Skalierungsverfahren. Diese Erweiterung ist nicht das, was bei lowcloud läuft, hier gilt der Katalogwert.
Wofür steht 397B im Namen?
Für 397 Milliarden Parameter. Der vollständige Name der Veröffentlichung lautet Qwen3.5-397B-A17B, das A17B steht für 17 Milliarden aktive Parameter pro Token. Das Modell ist als Mixture of Experts gebaut, kurz MoE: Es ist in 512 Teilnetze aufgeteilt, von denen pro Token nur elf mitrechnen.
Gibt es einen Nachfolger von Qwen 3.5 397B?
Ja. Qwen hat im April 2026 Qwen3.6 und im August 2026 Qwen3.8 veröffentlicht. Im lowcloud-Katalog stehen davon Qwen 3.8 Max und Qwen 3.8 27B. Qwen 3.5 397B bleibt nutzbar und läuft weiter. Wer einen neuen Agenten baut, sollte die 3.8er zuerst prüfen.
Qwen 3.5 397B ist ein Produktname von Qwen. Zwischen lowcloud und Qwen besteht keine Geschäftsbeziehung; wir betreiben das offen verfügbare Modell über einen europäischen Anbieter. Stand: 7. September 2026.