Dies sind Open-Weight-Modelle, die Sie herunterladen, selbst hosten und kommerziell nutzen können (überprüfen Sie jede Lizenz). Sie reichen von den leistungsfähigsten bis zu den leichtgewichtigsten — wählen Sie basierend auf Ihrer Hardware und Ihren Bedürfnissen.
01
DeepSeek V4von DeepSeek Das nächstgelegene Open-Weight-Modell zur proprietären Grenze. Ein großes Mixture-of-Experts-Modell mit einem 1M-Token-Kontext, das in den Bereichen Denken, Programmierung und agentische Aufgaben hervorragend abschneidet — zu einem Bruchteil der Kosten geschlossener APIs.
🎯 Am besten geeignet für: Qualität auf Frontier-Niveau🏠 Lokal: leistungsstarke Hardware📄: Offene Gewichte
DeepSeek-Modelle anzeigen →02
Llamavon Meta Die am weitesten verbreitete Open-LLM-Familie mit dem größten Ökosystem an Werkzeugen, Feineinstellungen und Anleitungen. Ein zuverlässiger Allzweckassistent, der in seinen kleineren Größen gut lokal läuft. Wenn Sie unsicher sind, wo Sie anfangen sollen, fangen Sie hier an.
🎯 Am besten geeignet für: sicherster Ausgangspunkt🏠 Lokal: ja (kleinere Größen)📄: Llama Community License
Llama-Modelle anzeigen →03
Qwenvon Alibaba Eine Spitzenfamilie mit herausragenden mehrsprachigen Fähigkeiten, starker Programmierung und exzellenter Qualität in jeder Größe. Häufige Veröffentlichungen halten es auf dem neuesten Stand, und die großzügige Lizenzierung der meisten Varianten erleichtert den Aufbau.
🎯 Am besten geeignet für: mehrsprachig & Programmierung🏠 Lokal: ja📄: Apache 2.0 (meistens)
Qwen-Modelle anzeigen →04
Mistralvon Mistral AI 🇫🇷 Effiziente, in Europa entwickelte Modelle, die konstant über ihren Möglichkeiten liegen. Eine großartige Balance aus Geschwindigkeit, Qualität und Offenheit mit starker mehrsprachiger Unterstützung — ansprechend, wenn Sie Ihren Stack innerhalb der EU halten möchten.
🎯 Am besten geeignet für: Effizienz & EU-Hosting🏠 Lokal: ja📄: Apache 2.0 (offene Varianten)
Mistral-Modelle anzeigen →05
GLMvon Z.AI Eine auf Denken fokussierte Familie, die bei langfristiger, projektbezogener Programmierung und autonomen Agenten-Workflows glänzt — in der Lage, kontinuierlich an einer Aufgabe zu arbeiten, anstatt nur einzelne Fragen zu beantworten.
🎯 Am besten geeignet für: Programmierungsagenten🏠 Lokal: größere Größen benötigen Leistung📄: Offene Gewichte
GLM-Modelle anzeigen →06
Kimivon Moonshot AI Entwickelt für sehr langen Kontext und End-to-End-Programmierung mit multimodalem Input. Bewältigt große Codebasen und lange Dokumente in einem Durchgang, was es gut geeignet macht für agentische, mehrstufige Arbeiten über große Eingaben.
🎯 Am besten geeignet für: langer Kontext & Code🏠 Lokal: leistungsstarke Hardware📄: Offene Gewichte
Kimi-Modelle anzeigen →07
Gemmavon Google Die offenen Modelle von Google bieten einige der besten Qualität-für-Größe, die verfügbar sind, mit nativem multimodalem Input — und sie gehören zu den am einfachsten zu betreibenden Modellen in der Nähe der Grenze auf einer einzelnen GPU oder einem Mac.
🎯 Am besten geeignet für: lokal ausführen🏠 Lokal: ja, sehr zugänglich📄: Gemma-Nutzungsbedingungen (offen)
Gemma-Modelle anzeigen →08
gpt-ossvon OpenAI OpenAIs eigene Open-Weight-Modelle — eine vertraute Option, wenn Ihnen der Stil von ChatGPT gefällt, Sie aber etwas Selbstgehostetes und extrem Günstiges suchen. Die kleinere Variante läuft auf Consumer-Hardware.
🎯 Am besten geeignet für: ChatGPT-ähnlich, selbstgehostet🏠 Lokal: ja (20B-Variante)📄: Apache 2.0
gpt-oss-Modelle anzeigen →