Kimi K2.7 Code auf EU-Servern: was das Modell kann und wie lowcloud es betreibt
Kimi K2.7 Code ist ein großes Sprachmodell des chinesischen Anbieters Moonshot AI, veröffentlicht im Juni 2026. Der Hersteller hat es auf zwei Aufgaben ausgerichtet: Programmcode schreiben und ändern, und Werkzeuge aufrufen, also andere Programme und Schnittstellen ansteuern und mit deren Antwort weiterarbeiten. Die Gewichte, also die trainierten Zahlenwerte des Modells, liegen öffentlich auf Hugging Face. Das Kontextfenster fasst 256.000 Token. Das Kontextfenster ist die Textmenge, die das Modell in einem Lauf gleichzeitig berücksichtigen kann; ein Token ist die kleinste Einheit, mit der es rechnet, etwa ein kurzes Wort oder ein Wortteil.
Bei lowcloud wählst du Kimi K2.7 Code als Modell hinter einem Agenten, für eine einzelne Nachricht im Chat oder für einen einzelnen Schritt eines Ablaufs. Die Anfragen gehen dann nicht an Moonshot AI, sondern an den europäischen Anbieter Melious und werden auf Servern in der EU verarbeitet.
- Hersteller
- Moonshot AI, China
- Kontextfenster
- 256k Token
- Bilder lesen
- ja
- Lizenz
- Modified MIT
- Verarbeitung
- EU-Server über Melious
Woher das Modell kommt
Moonshot AI hat die Gewichte im Juni 2026 auf Hugging Face veröffentlicht. Das Repository dort wurde am 11. Juni 2026 angelegt und am 15. Juni 2026 zuletzt geändert. Einen eigenen Blogbeitrag zum Modell gibt es nicht, ein genaues Ankündigungsdatum ist deshalb nicht belegt. Zur Bauart: Kimi K2.7 Code ist ein Mixture-of-Experts-Modell, kurz MoE. Das heißt, das Modell besteht aus vielen Teilnetzen, und für jedes Token rechnet nur ein kleiner Teil davon mit. Moonshot nennt 384 solcher Teilnetze, von denen 8 pro Token benutzt werden, rund eine Billion Parameter insgesamt und davon 32 Milliarden je Token aktiv. Für dich heißt das nur: Das Modell ist sehr groß, antwortet aber schneller, als seine Gesamtgröße vermuten lässt. Die Lizenz ist nicht MIT, auch wenn viele Übersichtsseiten das schreiben. Moonshot nennt sie „Modified MIT“. Der Text entspricht MIT bis auf einen Zusatz: Wer das Modell in einem kommerziellen Produkt mit mehr als 100 Millionen monatlich aktiven Nutzern oder mehr als 20 Millionen US-Dollar Monatsumsatz einsetzt, muss „Kimi K2.7 Code“ sichtbar in der Oberfläche nennen. Für deinen Einsatz und für lowcloud hat diese Schwelle keine praktische Folge. „Open Source“ ohne Zusatz ist trotzdem die falsche Beschreibung. Es gibt ein neueres Modell desselben Herstellers: Kimi K3, angekündigt am 16. Juli 2026, mit rund 1 Million Token Kontext. Kimi K2.7 Code ist damit nicht abgelöst. Moonshot führt es in der eigenen Dokumentation weiter als das Modell für Code- und Werkzeugaufgaben, und beide stehen im EU-Katalog von lowcloud.
Was „auf EU-Servern“ hier genau heißt
Die Anfrage geht nicht zu Moonshot AI. Die Kette ist: dein Kunde, dann die lowcloud UG in Bielefeld, dann die Melious AI GmbH in Saarbrücken, dann ein Rechenzentrum in der EU. Melious ist unser Anbieter für alle EU-gehosteten Modelle. Melious betreibt keine eigenen Rechenzentren, sondern verteilt auf europäische Betreiber und sichert zu, dass die Verarbeitung in der EU bleibt. Was wir nicht wissen: welcher dieser Betreiber Kimi K2.7 Code bedient. Melious veröffentlicht das nicht. Wir wissen auch nicht, welche genaue Fassung der Gewichte dort läuft. Wir geben die Zusage weiter, die wir haben, und nicht mehr. Bevor du Kimi K2.7 Code mit Daten eines Kunden einsetzt, klären wir die vertragliche Seite mit dir: Auftragsverarbeitung nach Art. 28 DSGVO und die Nennung der Unterauftragsverarbeiter. Das gehört ins Gespräch, nicht auf eine Webseite.
Wofür Kimi K2.7 Code taugt
Der Hersteller nennt es ein Coding-Modell. Du musst dafür nicht programmieren. Die zwei Fähigkeiten, auf die es trainiert ist, kommen in Abläufen ständig vor. Erstens: Daten von einer Form in eine andere bringen. Eine Rechnung in einzelne Felder zerlegen. Eine Tabelle umsortieren. Ein Datum von „14. März“ nach „2026-03-14“ ändern. Aus einer langen Mail eine Liste mit Punkten machen. Das folgt denselben strengen Regeln wie Programmcode, und genau darauf ist das Modell ausgerichtet. Es hält sich enger an Formatvorgaben aus deinem Prompt als ein allgemeines Modell. Zweitens: Werkzeuge aufrufen. Ein Agent, der zuerst das CRM abfragt, das Ergebnis prüft, danach eine Suche startet und erst dann eine Mail schreibt, ruft nacheinander mehrere Schnittstellen auf. Moonshot hat das Modell auf solche Ketten ausgelegt: mehrere Aufrufe hintereinander, mit einem Denkschritt dazwischen. Bilder liest es ebenfalls. Screenshots, Scans und Fotos kann es auswerten. Geprüft haben wir das mit Bildern, nicht mit Video. Moonshot veröffentlicht auf der Modellseite eigene Messwerte zu Code- und Agentenaufgaben. Das sind Zahlen des Herstellers, ohne Datum und ohne unabhängige Prüfung. Wir geben sie hier nicht wieder.
Der Denkschritt lässt sich nicht abschalten
Kimi K2.7 Code denkt immer. Moonshot hat den Denkmodus fest eingeschaltet, er lässt sich über die Schnittstelle nicht ausschalten. Vor jeder Antwort erzeugt das Modell also erst einen Gedankengang und danach das Ergebnis. Das hat zwei Folgen für deinen Agenten. Er braucht pro Schritt länger als mit einem Modell ohne Denkmodus. Und er verbraucht mehr Token, weil der Gedankengang mitzählt. Bei kurzen, immer gleichen Schritten, etwa „schreib diese drei Felder um“, zahlst du dafür ohne Gegenwert. Ein zweiter Punkt aus der Dokumentation von Moonshot: Man kann dem Modell nicht vorschreiben, dass es ein Werkzeug benutzen muss. Es entscheidet selbst, ob es eines aufruft. Wenn ein Schritt zwingend eine Abfrage auslösen soll, plan das im Ablauf ein, statt dich auf das Modell zu verlassen.
Wofür nicht
Feste JSON-Schemas. Ein JSON-Schema ist eine Vorlage, die dem Modell vorschreibt, welche Felder seine Antwort haben muss. Eine Anfrage mit so einer Vorlage lehnt der Anbieter mit einem Fehler ab. Das hat lowcloud selbst gegen die Schnittstelle geprüft, es steht so nicht auf der Herstellerseite. Moonshot dokumentiert nur den einfacheren JSON-Modus: Die Antwort muss gültiges JSON sein, eine feste Feldliste lässt sich nicht erzwingen. lowcloud fordert die Struktur in dem Fall im Prompt an. Für Schritte, deren Ausgabe exakt einer Vorgabe folgen muss, nimm ein Modell mit Schema-Unterstützung: Kimi K2.6, GLM 5.1, GLM 5, Qwen 3.5 397B oder DeepSeek V4 Flash, alle ebenfalls in der EU. Sehr große Eingaben. 256.000 Token sind viel, aber nicht genug, um eine ganze Aktensammlung in einem Lauf zu übergeben. Wenn du mehr brauchst, nimm Kimi K3, GLM 5.3, GLM 5.2 oder DeepSeek V4 Pro. Diese vier fassen rund 1 Million Token. Viele kurze Standardschritte. Wegen des festen Denkmodus ist das Modell dafür langsamer und teurer als nötig. Ob Kimi K2.7 Code freie Texte für Kunden schlechter schreibt als ein allgemeines Modell, haben wir nicht gemessen. Der Hersteller richtet es ausdrücklich auf Code und Werkzeugnutzung aus. Wenn ein Schritt vor allem formulieren soll, vergleich es im Chat mit einem allgemeinen Modell aus dem Katalog.
Was es kostet
Auf dieser Seite steht kein Preis. Was ein einzelner Lauf gekostet hat, siehst du in Euro an jedem Lauf in der App. Das ist die Zahl, mit der du beim Kunden rechnest. Im Katalog der EU-Modelle liegt Kimi K2.7 Code in der unteren Mitte. Günstiger ist unter anderem DeepSeek V4 Flash, das lowcloud in Arbeitsbereichen ohne eigene Modellwahl einsetzt. Teurer ist Kimi K3. Rechne den festen Denkmodus mit ein. Weil jeder Aufruf zusätzliche Token für den Gedankengang erzeugt, kann ein Lauf mehr kosten, als die Position im Katalog vermuten lässt. Der Vergleich, der zählt, ist der zwischen zwei echten Läufen in der App, nicht der zwischen zwei Plätzen in einer Liste.
Kimi K2.7 Code ausprobieren
Für die Modellwahl brauchst du ein kostenloses Konto. Danach wählst du Kimi K2.7 Code im Chat, pro Agent oder pro Schritt.
Häufige Fragen
Was ist Kimi K2.7 Code?
Ein großes Sprachmodell von Moonshot AI aus China, veröffentlicht im Juni 2026. Es ist auf Programmcode und auf das Aufrufen von Werkzeugen ausgerichtet, fasst 256.000 Token Kontext und kann Bilder lesen. Bei lowcloud wird es auf Servern in der EU verarbeitet.
Gehen meine Daten nach China, wenn ich Kimi K2.7 Code nutze?
Nein. Die Anfrage geht über lowcloud an die Melious AI GmbH in Saarbrücken und wird auf Servern in der EU verarbeitet. Moonshot AI stellt nur die öffentlich verfügbaren Modellgewichte bereit und sieht deine Anfragen nicht. Welcher europäische Betreiber das Modell konkret bedient, veröffentlicht Melious nicht, und wir wissen es auch nicht.
Ist Kimi K2.7 Code Open Source?
Die Gewichte sind öffentlich, die Lizenz ist aber nicht das reine MIT. Moonshot nennt sie „Modified MIT“. Sie entspricht MIT bis auf eine Auflage: Ab mehr als 100 Millionen monatlich aktiven Nutzern oder mehr als 20 Millionen US-Dollar Monatsumsatz muss „Kimi K2.7 Code“ sichtbar in der Oberfläche stehen. Für den Einsatz in lowcloud hat das keine Folge.
Kann Kimi K2.7 Code Bilder lesen?
Ja. Screenshots, Scans und Fotos wertet es aus. Geprüft haben wir das mit Bildern. Moonshot nennt zusätzlich Video als experimentell und nur über die eigene Schnittstelle; darauf solltest du dich bei lowcloud nicht verlassen.
Warum lehnt Kimi K2.7 Code feste JSON-Schemas ab?
Der Anbieter nimmt Anfragen mit einem festen JSON-Schema nicht an und antwortet mit einem Fehler. Das haben wir selbst gegen die Schnittstelle geprüft. lowcloud fordert die Struktur dann im Prompt an. Wenn die Ausgabe eines Schritts exakt einer Vorgabe folgen muss, nimm Kimi K2.6, GLM 5.1, GLM 5, Qwen 3.5 397B oder DeepSeek V4 Flash.
Gibt es ein neueres Modell von Moonshot AI?
Ja, Kimi K3 vom 16. Juli 2026 mit rund 1 Million Token Kontext. Kimi K2.7 Code ist deshalb nicht abgekündigt; Moonshot führt es weiter als Modell für Code- und Werkzeugaufgaben. Beide stehen im EU-Katalog von lowcloud.
Kimi K2.7 Code ist ein Produktname von Moonshot AI. Zwischen lowcloud und Moonshot AI besteht keine Geschäftsbeziehung; wir betreiben das offen verfügbare Modell über einen europäischen Anbieter. Stand: 7. September 2026.