Monatliches Ranking · Stand: August 2026

Top 5: Offene LLM-Modelle (Open Weight LLMs)

Unsere Marktbeobachtungen im August 2026

Der Berichtsmonat war der bisher dichteste des Jahres: Alibaba stellte am 12. August die Gewichte des nachtrainierten Qwen3.8-Max-Modells bereit, DeepSeek löste V4-Pro am 13. August aus der Vorschau, und Z.ai gab am 28. August die Gewichte von GLM-5.3 frei. Für den Mittelstand wichtiger als diese Schwergewichte sind die kleinen Ausgaben desselben Monats: Qwen3.8-27B unter Apache 2.0, GLM-5.3-Flash unter MIT und Metas Muse Glimmer 30B unter Apache 2.0 laufen auf einer einzelnen Grafikkarte.

GLM-5.3 ist laut den Angaben des Berichtsmonats eine reine Post-Training-Weiterentwicklung von GLM-5.2 auf demselben Basismodell und legt vor allem bei Programmier- und langlaufenden Aufgaben zu. Die offenen Gewichte erschienen am 28. August 2026 auf Hugging Face, allerdings unter einer eigenen GLM-5.3-Lizenz; die zwei Tage zuvor veröffentlichte kleinere Variante GLM-5.3-Flash trägt dagegen eine unveränderte MIT-Lizenz.

Rangverlauf

März–August 2026

Rangverlauf der aktuellen Top-Tools über die letzten Monate GLM 5.3 aktuell Rang 1; Kimi K3 aktuell Rang 2; DeepSeek-V4 aktuell Rang 3; Qwen3.8 2.4T-A95B aktuell Rang 4; Gemma 4 aktuell Rang 5. GLM 5.3 · März 2026 · Rang 2 – Hält Rang 2 wie in der Vorausgabe; die im März verfügbaren GLM-Neuerungen (GLM-5-Turbo, GLM-5.1-Schnittstelle) lagen nicht als offene Gewichte vor, daher bleibt GLM-5 die aktuelle offene Version. GLM 5.3 · April 2026 · Rang 2 – Hält Rang 2 wie in der Vorausgabe: Z.ai löste am 7. April 2026 die bisher nur geschlossen verfügbare GLM-5.1 mit offenen Gewichten unter MIT-Lizenz ab, die Position an der zweiten Stelle der Kategorie bleibt jedoch unverändert. GLM 5.3 · Mai 2026 · Rang 2 – Hält Rang 2 wie in der Vorausgabe: Z.ai veröffentlichte im Berichtsmonat keine neue offene GLM-Version; GLM-5.1 bleibt die aktuelle offene Z.ai-Version und die Position an zweiter Stelle unverändert. GLM 5.3 · Juni 2026 · Rang 1 – Steigt von Rang 2 auf Rang 1: Mit der offenen Veröffentlichung von GLM-5.2 am 13. Juni 2026 übernahm Z.ai laut Artificial-Analysis-Intelligence-Index die Spitze der offenen Modelle vor dem bisherigen Führenden DeepSeek V4. GLM 5.3 · Juli 2026 · Rang 1 – Hält Rang 1 wie in der Vorausgabe: Trotz der offenen Veröffentlichung von Kimi K3 (Index 57) bleibt GLM-5.2 laut Vergleichsmessungen des Berichtsmonats das leistungsstärkste praktisch self-hostbare offene Modell, weil Kimi K3 eine restriktivere Lizenz und einen Multi-Node-Hardwarebedarf mitbringt. GLM 5.3 · August 2026 · Rang 1 – Hält Rang 1 wie in der Vorausgabe: Auch nach den offenen Veröffentlichungen von GLM-5.3 und Qwen3.8 bleibt die GLM-Linie auf Rang 1, weil sie hohe Modellqualität mit einer für den Mittelstand praktisch unbeschränkten Lizenz und einem im Feld vergleichsweise praktikablen Hardware-Bedarf verbindet. G 1GLM5.3 Kimi K3 · März 2026 · Rang 4 – Hält Rang 4 wie in der Vorausgabe; im Berichtsmonat gab es keine neue offene Kimi-Version, das im Januar veröffentlichte Modell bleibt unverändert verfügbar. Kimi K3 · April 2026 · Rang 3 – Steigt von Rang 4 auf Rang 3: Moonshot AI veröffentlichte am 20. April 2026 Kimi K2.6, das sich laut datierten Vergleichsmessungen des Berichtsmonats deutlich vor die bisherige Version K2.5 und das Mittelfeld offener Modelle setzt. Kimi K3 · Mai 2026 · Rang 3 – Hält Rang 3 wie in der Vorausgabe: Moonshot AI brachte im Berichtsmonat keine neue offene Kimi-Version; K2.6 bleibt die aktuelle offene Version und die Position unverändert. Kimi K3 · Juni 2026 · Rang 3 – Hält Rang 3 wie in der Vorausgabe: Die allgemeine Flaggschiff-Version bleibt Kimi K2.6; die im Juni veröffentlichte Variante K2.7-Code ist coding-spezialisiert, liegt nur mit herstellereigenen Zahlen vor und verändert die allgemeine Einordnung nicht. Kimi K3 · Juli 2026 · Rang 2 – Steigt von Rang 3 auf Rang 2: Moonshot veröffentlichte Kimi K3 im Berichtsmonat als offenes Nachfolge-Flaggschiff von K2.6 (offene Gewichte am 27. Juli 2026), das laut veröffentlichten Vergleichsmessungen die bisherige Version und DeepSeek V4 bei Schlussfolgern und Programmierung deutlich übertrifft. Kimi K3 · August 2026 · Rang 2 – Hält Rang 2 wie in der Vorausgabe: Kimi K3 bleibt die aktuelle offene Version und führt das Feld bei der gewerteten Modellqualität weit vorne mit; Hardware-Bedarf und Lizenz ordnen es weiter hinter GLM ein. K 2Kimi K3K3 DeepSeek-V4 · März 2026 · Rang 3 – Hält Rang 3 wie in der Vorausgabe; im Berichtsmonat erschien keine neue offene DeepSeek-Version, das Modell bleibt unverändert verfügbar. DeepSeek-V4 · April 2026 · Rang 1 – Steigt von Rang 3 auf Rang 1: DeepSeek veröffentlichte am 24. April 2026 mit V4 eine neue offene Version, die sich laut datierten Vergleichsmessungen des Berichtsmonats an die Spitze offener Modelle bei Schlussfolgern und Programmierung setzt. DeepSeek-V4 · Mai 2026 · Rang 1 – Hält Rang 1 wie in der Vorausgabe: Im Berichtsmonat erschien kein neues offenes Flaggschiff, das DeepSeek V4 an der Spitze offener Modelle ablöste; die Vorschau-Gewichte bleiben die aktuelle offene DeepSeek-Version. DeepSeek-V4 · Juni 2026 · Rang 2 – Fällt von Rang 1 auf Rang 2: DeepSeek V4 blieb im Berichtsmonat unverändert die aktuelle offene Version, wurde an der Spitze aber von GLM-5.2 überholt, das auf dem Intelligence Index v4.1 mit 51 vor DeepSeek V4 Pro (44) liegt. DeepSeek-V4 · Juli 2026 · Rang 3 – Fällt von Rang 2 auf Rang 3: DeepSeek V4 bleibt unverändert die aktuelle offene Version, wird an dem gewerteten Kriterium Modellqualität und Schlussfolgern aber vom neuen Kimi K3 (Index 57 gegenüber 44) überholt und rückt eine Position nach hinten. DeepSeek-V4 · August 2026 · Rang 3 – Hält Rang 3 wie in der Vorausgabe: DeepSeek löste V4-Pro am 13. August 2026 aus der Vorschau und stellte die Gewichte des Stands 0813 unter MIT-Lizenz bereit; an den gewerteten Kriterien Lizenz und Kontextfenster bleibt der Platz vor Qwen unverändert. D 3DeepSeek-V4V4-Pro-0813 / V4-Flash Qwen3.8 2.4T-A95B · März 2026 · Rang 1 – Hält Rang 1 wie in der Vorausgabe; im Berichtsmonat gab es keine offene Veröffentlichung, die das Spitzenfeld der Kategorie an den gewerteten Kriterien verschoben hätte. Qwen3.8 2.4T-A95B · April 2026 · Rang 4 – Fällt von Rang 1 auf Rang 4: Im Berichtsmonat erschien keine neue große offene Qwen-Version, während DeepSeek V4, GLM-5.1 und Kimi K2.6 laut datierten Vergleichsmessungen bei Schlussfolgern und Programmierung vorbeizogen. Qwen3.5-397B-A17B bleibt die aktuelle große offene Flaggschiff-Version. Qwen3.8 2.4T-A95B · Mai 2026 · Rang 4 – Hält Rang 4 wie in der Vorausgabe: Alibaba stellte im Berichtsmonat mit Qwen 3.7 Max ein neues Flaggschiff vor, jedoch ausschließlich mit geschlossenen Gewichten und damit außerhalb dieser Kategorie; die offene Flaggschiff-Version bleibt Qwen3.5-397B-A17B auf unveränderter Position. Qwen3.8 2.4T-A95B · Juni 2026 · Rang 4 – Hält Rang 4 wie in der Vorausgabe: Alibaba veröffentlichte im Berichtsmonat keine neue große offene Qwen-Version; die kompakte Qwen-3.6-Reihe bleibt auf der Watchlist, während Qwen3.5-397B-A17B die große offene Flaggschiff-Version auf unveränderter Position bleibt. Qwen3.8 2.4T-A95B · Juli 2026 · Rang 4 – Hält Rang 4 wie in der Vorausgabe: Alibaba stellte im Berichtsmonat mit Qwen 3.8 Max nur ein noch geschlossenes Preview vor; die offen verfügbare Flaggschiff-Version bleibt Qwen3.5-397B-A17B auf unveränderter Position. Qwen3.8 2.4T-A95B · August 2026 · Rang 4 – Hält Rang 4 wie in der Vorausgabe: Alibaba veröffentlichte im Berichtsmonat die nachtrainierten Gewichte des Qwen3.8-Max-Modells und löst damit Qwen3.5 als aktuelle offene Version ab; der Platz bleibt stabil, weil die eigene Lizenz der gereihten Max-Variante die höhere Modellqualität aufwiegt. Q 4Qwen3.82.4T-A95B Gemma 4 · April 2026 · Rang 5 – Neueinstieg auf Rang 5: Google veröffentlichte Gemma 4 am 2. April 2026 unter Apache 2.0; das Modell verdrängt MiniMax M2.7, weil es die gewerteten Kriterien Lizenz, Hardware-Effizienz und deutsche Mehrsprachfähigkeit deutlich besser erfüllt. Gemma 4 · Mai 2026 · Rang 5 – Hält Rang 5 wie in der Vorausgabe: Im Berichtsmonat erschien kein neues offenes Modell, das Gemma 4 an den gewerteten Kriterien überholt und verdrängt hätte; die Position bleibt unverändert. Gemma 4 · Juni 2026 · Rang 5 – Hält Rang 5 wie in der Vorausgabe: Im Berichtsmonat erschien kein neues offenes Modell, das Gemma 4 an den gewerteten Kriterien überholt und verdrängt hätte; MiniMax M3 bleibt wegen seiner restriktiven Lizenz auf der Watchlist. Die Position bleibt unverändert. Gemma 4 · Juli 2026 · Rang 5 – Hält Rang 5 wie in der Vorausgabe: Im Berichtsmonat erschien kein offenes Modell, das Gemma 4 an den gewerteten Kriterien überholt und verdrängt; die stark self-hostbare Apache-2.0-Familie bleibt der praktikable Einstieg am Ende der Rangliste. Gemma 4 · August 2026 · Rang 5 – Hält Rang 5 wie in der Vorausgabe: Gemma 4 bleibt mit Apache-2.0-Lizenz, geringem Hardware-Bedarf und breiter Mehrsprachfähigkeit der praktikable Einstieg am Ende der Rangliste. G 5Gemma 431B (Dense)
Watchlist
  • MetaMuse Glimmer 30B
  • MiniMaxMiniMax M3 ↓ zuletzt Rang 5 · Mär
  • NVIDIANemotron 3.5 Lightning
Rangverlauf je Tool über die letzten Monate
ToolMärz 2026April 2026Mai 2026Juni 2026Juli 2026August 2026
GLM 5.3222111
Kimi K3433322
DeepSeek-V4311233
Qwen3.8 2.4T-A95B144444
Gemma 455555

Aktuelles Ranking

  1. GLM 5.3 Neu

    Z.ai Tendenz: unverändert

    • Offene Gewichte auf Hugging Face unter der eigenen GLM-5.3-Lizenz: kommerzielle Nutzung und Self-Hosting sind frei, nur Anbieter von Model-as-a-Service ab zehn Milliarden US-Dollar Umsatz in zwölf zusammenhängenden Monaten müssen vorher eine Sicherheitsprüfung von Z.ai durchlaufen.
    • GLM-5.3 ist laut den Angaben des Berichtsmonats eine Post-Training-Weiterentwicklung von GLM-5.2 mit deutlichem Zugewinn bei Programmier- und langlaufenden Aufgaben.
    • Mixture-of-Experts mit rund 753 Milliarden Gesamtparametern, im Feld der offenen Spitzenmodelle vergleichsweise praktikabel zu betreiben.
    • Kontextfenster von rund einer Million Token, ausgelegt auf lange Dokumente und umfangreichen Informationsabruf.
    • Die kleinere Schwestervariante GLM-5.3-Flash (320 Milliarden Gesamt-, 18 Milliarden aktive Parameter) erschien am 26. August 2026 unter unveränderter MIT-Lizenz.
    Zum Anbieter
  2. Kimi K3

    Moonshot AI Tendenz: unverändert

    • Mixture-of-Experts mit rund 2,8 Billionen Gesamt- und etwa 104 Milliarden aktiven Parametern je Token.
    • Der hohe Speicherbedarf erzwingt einen Mehr-Knoten-GPU-Cluster statt einer Arbeitsplatzmaschine.
    • Kimi K3 License mit offen herunterladbaren Gewichten; die kommerzielle Selbstnutzung ist erlaubt, für große Model-as-a-Service-Anbieter gelten Sondervereinbarungen.
    • Ordnet sich laut den bisher veröffentlichten Angaben bei Programmieraufgaben nahe an den geschlossenen Spitzenmodellen ein.
    Zum Anbieter
  3. DeepSeek-V4

    DeepSeek Tendenz: unverändert

    • MIT-Lizenz mit frei verfügbaren Gewichten auf Hugging Face, uneingeschränkt für den kommerziellen Self-Hosted-Einsatz geeignet.
    • Ordnet sich laut den bisher veröffentlichten Angaben bei Schlussfolgern und Programmierung im vorderen Feld der offenen Modelle ein.
    • Mixture-of-Experts in zwei Größen: V4-Pro-0813 mit rund 1,7 Billionen Gesamt- und etwa 49 Milliarden aktiven Parametern, dazu die kleinere V4-Flash-Variante.
    • Million-Token-Kontextfenster als Standard, ausgelegt auf lange Dokumente und umfangreichen Informationsabruf.
    Zum Anbieter
  4. Qwen3.8 2.4T-A95B Neu

    Alibaba Tendenz: unverändert

    • Offen veröffentlichte, nachtrainierte Gewichte der Max-Klasse Qwen3.8-2.4T-A95B (rund 2,4 Billionen Gesamt- und etwa 95 Milliarden aktive Parameter) auf Hugging Face.
    • Erste offen herunterladbare Max-Klasse der Qwen-Familie; die Lizenz ist für die meiste kommerzielle Nutzung frei, trägt aber umsatzabhängige Auflagen.
    • Zwei Größenklassen im Berichtsmonat: Das offen veröffentlichte Max-Modell mit 2,4 Billionen Parametern verlangt Mehr-Knoten-Betrieb, das am 14. August 2026 zusätzlich freigegebene dichte Qwen3.8-27B läuft unter Apache 2.0 auf einer einzelnen Arbeitsplatz-Grafikkarte.
    • Breite Mehrsprachfähigkeit einschließlich Deutsch und ein großes, etabliertes Werkzeug- und Fine-Tuning-Ökosystem rund um die Qwen-Familie.
    Zum Anbieter
  5. Gemma 4

    Google Tendenz: unverändert

    • Apache-2.0-Lizenz mit offen veröffentlichten Gewichten, freizügig und rechtssicher für den kommerziellen Unternehmenseinsatz.
    • Das gereihte dichte 31B-Modell läuft mit geringem Hardware-Bedarf auf einer einzelnen Grafikkarte; die Familie deckt daneben kleinere Größen ab.
    • Breite Mehrsprachfähigkeit einschließlich Deutsch und ein großes Kontextfenster.
    • Verfügbar über Hugging Face, Ollama und weitere Kataloge in gängigen offenen Formaten, damit ohne Umwege lokal lauffähig.
    Zum Anbieter

Methodik & Transparenz

Diese Rankings dienen der Marktorientierung. Sie sind ein redaktioneller, kostenloser Überblick auf Basis öffentlich verfügbarer Quellen, keine abschließende oder absolute Bewertung. Jede Ausgabe ist eine Momentaufnahme; der Markt verändert sich schnell, und die Auswahl erhebt keinen Anspruch auf Vollständigkeit. Bewertet wird ausschließlich anhand der je Kategorie veröffentlichten Kriterien; ein eigener Labortest findet nicht statt. Die vergleichende Einordnung ist unsere redaktionelle Meinung, keine Tatsachenbehauptung über die Eignung einzelner Produkte, und sie wertet keinen Anbieter pauschal ab. Sie ersetzt keine eigene Prüfung. Stand: 01.09.2026.

Bei Recherche und Zusammenfassung kommen KI-Technologien zum Einsatz. Auswahl, Einordnung und Veröffentlichung werden von einer Person geprüft, freigegeben und redaktionell verantwortet. Genannte Produkt-, Marken- und Unternehmensnamen sind Eigentum der jeweiligen Inhaber; ihre Nennung dient allein der Information und Identifikation und bedeutet weder eine Empfehlung noch eine geschäftliche Verbindung zu diesen Anbietern. FORGEINITY hostet oder vervielfältigt keine fremden Inhalte, sondern verweist auf die Originalquellen.

Soweit wir auf externe Seiten verlinken, sind für deren Inhalte ausschließlich die jeweiligen Betreiber verantwortlich. Wir machen uns verlinkte Inhalte nicht zu eigen und übernehmen für sie keine Haftung; zum Zeitpunkt der Verlinkung waren keine Rechtsverstöße erkennbar, und bei Kenntnis einer Rechtsverletzung entfernen wir den betreffenden Link unverzüglich. Unabhängigkeit: Kein Anbieter hat für Platzierung oder Bewertung bezahlt; es bestehen keine Provisions-, Affiliate- oder Werbevereinbarungen. FORGEINITY arbeitet technologie-offen und bewertet ausschließlich anhand der veröffentlichten Kriterien. Alle Angaben erfolgen ohne Gewähr; eine Haftung für Richtigkeit, Vollständigkeit oder für Entscheidungen, die auf Grundlage dieser Rankings getroffen werden, ist ausgeschlossen.

Rechteinhaber, Betroffene und Dritte können eine Korrektur oder Entfernung einzelner Angaben unter legal@forgeinity.com anfragen oder einen rechtswidrigen verlinkten Inhalt melden. Wir prüfen berechtigte Hinweise und reagieren zeitnah.

Bewertet wird anhand dieser Kriterien:

  1. Modellqualität und Schlussfolgern (bewertet die Antwortgüte bei Wissens-, Logik-, Mathematik- und Programmieraufgaben im Vergleich offener Modelle, anhand veröffentlichter, datierter Vergleichsmessungen)
  2. Lizenz und kommerzielle Nutzbarkeit (bewertet, wie freizügig und rechtssicher die Lizenz für den Unternehmenseinsatz ist, von permissiven Lizenzen wie Apache 2.0 bis zu Nutzungsbeschränkungen mancher Community-Lizenzen)
  3. Hardware-Bedarf und Effizienz (bewertet Parametergröße, Architektur als dichtes oder Mixture-of-Experts-Modell sowie Arbeits- und Grafikspeicher-Bedarf, und damit, ob das Modell auf erschwinglicher oder Arbeitsplatz-Hardware lauffähig ist)
  4. Quantisierung und Formatverfügbarkeit (bewertet, ob etablierte quantisierte Varianten und gängige Formate wie GGUF oder Safetensors vorliegen und das Modell ohne Umwege über verbreitete lokale Kataloge wie Ollama oder Hugging Face bereitsteht)
  5. Kontextfenster und Informationsabruf (bewertet, wie viel Material das Modell in einem Durchgang verarbeitet und wie zuverlässig es Inhalte aus langen Dokumenten wiederfindet)
  6. Werkzeug-Nutzung und Agentenfähigkeit (bewertet, wie zuverlässig das Modell externe Funktionen aufruft, etwa über das Model Context Protocol (MCP), und sich in lokale Automatisierungs-Abläufe einbinden lässt)
  7. Deutsche Sprach- und Mehrsprachfähigkeit (bewertet die Ausdrucks- und Verständnisqualität in Deutsch und weiteren Sprachen, die bei offenen Modellen stark schwankt und für den Mittelstand entscheidend ist)
  8. Feinabstimmbarkeit und Ökosystem (bewertet die Eignung für firmeneigenes Anpassen und Fine-Tuning sowie die Reife von Werkzeugen, Dokumentation und verfügbaren Modellgrößen rund um das Modell)