Stand: 30. September 2026 · Source-first Referenz50 dokumentierte Open-Weight-Modelle · Keine bezahlten Rankings
OpenWeightModelle.de 50 Modelle ansehen
Modellübersicht

50 Open-Weight-Modelle

Deutschsprachige Model-Passports für lokale KI, Self-Hosting und Unternehmensentscheidungen. Keine Rangliste: Filtere nach deinem konkreten Einsatzzweck.

Oder direkt auswählen:

Kein Fachbegriff nötig: Wähle einfach einen Einsatzzweck oder nutze die freie Suche.

Alle Profile

Modelle durchsuchen

50 Modelle
O
High-End lokal

gpt-oss-20b

OpenAI · gpt-oss

OpenAIs kompakteres Open-Weight-Reasoning-Modell für lokale und selbst gehostete Inferenz. Es richtet sich an Nutzer, die Werkzeugnutzung, strukturiertes Denken und anpassbare…

Reasoning20B-KlasseApache 2.0
O
Server / Multi-GPU

gpt-oss-120b

OpenAI · gpt-oss

Die größere gpt-oss-Variante priorisiert Modellkapazität und Reasoning gegenüber einfacher Desktop-Inferenz. Sie ist vor allem für Teams interessant, die ein leistungsfähiges…

Reasoning120B-KlasseApache 2.0
L
Server / große Workstation

Llama 4 Scout 17B-16E Instruct

Meta · Llama 4

Llama 4 Scout ist Metas multimodales MoE-Modell mit 17 Milliarden aktivierten Parametern pro Token. Es kombiniert Text- und Bildverständnis mit sehr großem Kontext und ist eher für…

Multimodal17B aktiv · MoELlama 4 Community License
Text + BildProfil →
L
Server / Cluster

Llama 4 Maverick 17B-128E Instruct

Meta · Llama 4

Llama 4 Maverick ist die größere Experten-Variante der Llama-4-Familie. Der Fokus liegt auf multimodalem Verständnis und hoher Modellkapazität; für Selbsthosting ist vor allem die enorme…

Multimodal17B aktiv · 128 ExpertenLlama 4 Community License
Text + BildProfil →
L
Große Workstation / Server

Llama 3.3 70B Instruct

Meta · Llama 3.3

Llama 3.3 70B Instruct ist ein großes textbasiertes Instruktionsmodell aus Metas Llama-Familie. Es bleibt für Self-Hosting relevant, wenn eine etablierte Toolchain, starke…

Chat70BLlama 3.3 Community License
L
Sehr leicht

Llama 3.2 1B Instruct

Meta · Llama 3.2

Llama 3.2 1B Instruct ist eine besonders kompakte Llama-Variante für Edge-, Mobile- und ressourcenarme lokale Setups. Sie eignet sich eher für einfache Assistenz- und…

Chat1BLlama 3.2 Community License
L
Leicht lokal

Llama 3.2 3B Instruct

Meta · Llama 3.2

Llama 3.2 3B Instruct bietet mehr Kapazität als die 1B-Version, bleibt aber klein genug für viele Laptops und Mini-PCs. Damit ist es ein praktischer Einstieg in lokale Chat- und…

Chat3BLlama 3.2 Community License
L
Workstation

Llama 3.2 11B Vision Instruct

Meta · Llama 3.2 Vision

Llama 3.2 11B Vision Instruct erweitert die Llama-Familie um Bildverständnis in einer noch vergleichsweise workstation-tauglichen Größenklasse. Interessant ist es für Dokumentbilder,…

Multimodal11BLlama 3.2 Community License
Text + BildProfil →
L
Server / Multi-GPU

Llama 3.2 90B Vision Instruct

Meta · Llama 3.2 Vision

Die 90B-Vision-Variante richtet sich an multimodale Anwendungen, bei denen höhere Modellkapazität wichtiger ist als kompakte lokale Inferenz. Für Unternehmen ist sie vor allem als…

Multimodal90BLlama 3.2 Community License
Text + BildProfil →
G
Extrem leicht

Gemma 3 270M IT

Google · Gemma 3

Gemma 3 270M IT ist eine sehr kleine Instruktionsvariante der Gemma-3-Familie. Sie ist besonders interessant für Edge-Tests, Lernprojekte und stark begrenzte Hardware, ersetzt aber kein…

Chat270MGemma Terms
G
Sehr leicht

Gemma 3 1B IT

Google · Gemma 3

Gemma 3 1B IT ist die kleinste reguläre Textvariante von Gemma 3. Sie kombiniert einen geringen Speicherbedarf mit der modernen Gemma-Toolchain und eignet sich für einfache lokale…

Chat1BGemma Terms
G
Leicht bis mittel

Gemma 3 4B IT

Google · Gemma 3

Gemma 3 4B IT ist die kleinste multimodale Gemma-3-Variante. Sie verbindet Bild- und Textverarbeitung mit einer Größe, die noch für viele lokale Rechner interessant ist, und ist damit…

Multimodal4BGemma Terms
Text + BildProfil →
G
Workstation

Gemma 3 12B IT

Google · Gemma 3

Gemma 3 12B IT liegt zwischen kompakter lokaler Nutzbarkeit und deutlich höherer Modellkapazität. Für Nutzer mit stärkerer Workstation ist es eine vielseitige Option für Text-, Bild- und…

Multimodal12BGemma Terms
Text + BildProfil →
G
High-End lokal

Gemma 3 27B IT

Google · Gemma 3

Gemma 3 27B IT ist die große Gemma-3-Instruct-Variante und kombiniert multimodale Eingaben mit einer für lokale High-End-Workstations noch erreichbaren Modellgröße. Die Lizenz ist dabei…

Multimodal27BGemma Terms
Text + BildProfil →
G
On-device

Gemma 3n E2B IT

Google · Gemma 3n

Gemma 3n E2B IT ist auf On-Device-Nutzung und multimodale Eingaben ausgerichtet. Die Architektur zielt stärker auf mobile und edge-nahe Szenarien als klassische große LLM-Deployments und…

MultimodalE2B-KlasseGemma Terms
Text + Bild + AudioProfil →
G
On-device / Laptop

Gemma 3n E4B IT

Google · Gemma 3n

Gemma 3n E4B IT ist die leistungsstärkere On-Device-Variante der Gemma-3n-Familie. Sie richtet sich an multimodale Anwendungen, die mehr Kapazität als E2B benötigen, ohne in die…

MultimodalE4B-KlasseGemma Terms
Text + Bild + AudioProfil →
Q
Extrem leicht

Qwen3 0.6B

Qwen · Qwen3

Qwen3 0.6B ist die kleinste Qwen3-Variante und eignet sich für sehr ressourcenarme Experimente. Trotz der geringen Größe unterstützt die Familie moderne Chat- und Reasoning-Workflows,…

Reasoning0.6BApache 2.0
Q
Sehr leicht

Qwen3 1.7B

Qwen · Qwen3

Qwen3 1.7B bietet mehr Reserven als die 0.6B-Version und bleibt gleichzeitig laptop- und edgefreundlich. Es ist ein sinnvoller Kandidat für kompakte mehrsprachige Assistenz, wenn…

Reasoning1.7BApache 2.0
Q
Leicht lokal

Qwen3 4B

Qwen · Qwen3

Qwen3 4B liegt in einer für lokale Nutzung besonders interessanten Größenklasse: deutlich leistungsfähiger als Sub-2B-Modelle, aber weiterhin auf vielen Laptops oder kleinen GPUs…

Reasoning4BApache 2.0
Q
Desktop / Laptop

Qwen3 8B

Qwen · Qwen3

Qwen3 8B ist eine der ausgewogensten Größen für lokale General-Purpose-Nutzung. Es bietet genügend Kapazität für ernsthafte Chat-, Coding- und Reasoning-Experimente, ohne zwingend eine…

Reasoning8BApache 2.0
Q
Workstation

Qwen3 14B

Qwen · Qwen3

Qwen3 14B ist eine Mittelklasse-Variante für Nutzer, die mehr Qualität als bei 8B-Modellen suchen, aber keine 32B-Workstation oder Serverumgebung betreiben möchten. Besonders interessant…

Reasoning14BApache 2.0
Q
High-End Workstation

Qwen3 32B

Qwen · Qwen3

Qwen3 32B richtet sich an leistungsfähige lokale Workstations und Server, wenn die höhere Modellkapazität wichtiger ist als minimale Latenz. Es eignet sich für komplexere Analyse-,…

Reasoning32BApache 2.0
Q
Workstation

Qwen3 30B-A3B

Qwen · Qwen3 MoE

Qwen3 30B-A3B nutzt eine Mixture-of-Experts-Architektur: nur ein kleiner Teil der Gesamtparameter ist pro Token aktiv. Das kann eine interessante Balance aus Modellkapazität und…

Reasoning30B gesamt · 3B aktivApache 2.0
Q
Server / Multi-GPU

Qwen3 235B-A22B

Qwen · Qwen3 MoE

Qwen3 235B-A22B ist die große MoE-Variante der Familie. Sie aktiviert nur einen Teil der Parameter pro Token, benötigt aber weiterhin Infrastruktur für hunderte Milliarden gespeicherte…

Reasoning235B gesamt · 22B aktivApache 2.0
Q
Desktop / Laptop

Qwen2.5-Coder 7B Instruct

Qwen · Qwen2.5-Coder

Qwen2.5-Coder 7B Instruct ist eine kompakte Coding-Variante für lokale Entwickler-Workflows. Sie eignet sich für Codeerklärung, Generierung und kleinere Repository-Aufgaben, wenn ein…

Coding7BApache 2.0
Text / CodeProfil →
Q
Workstation

Qwen2.5-Coder 14B Instruct

Qwen · Qwen2.5-Coder

Qwen2.5-Coder 14B Instruct ist ein guter Mittelweg für lokale Coding-Assistenten. Gegenüber 7B steigt die Modellkapazität spürbar, ohne die Hardwareklasse eines 32B-Modells zu erzwingen.

Coding14BApache 2.0
Text / CodeProfil →
Q
High-End Workstation

Qwen2.5-Coder 32B Instruct

Qwen · Qwen2.5-Coder

Qwen2.5-Coder 32B Instruct ist die große Coding-Variante dieser Familie und zielt auf anspruchsvollere Codeerzeugung, Analyse und Refactoring-Aufgaben. Für lokale Nutzung ist eine große…

Coding32BApache 2.0
Text / CodeProfil →
Q
Desktop / Workstation

Qwen2.5-VL 7B Instruct

Qwen · Qwen2.5-VL

Qwen2.5-VL 7B Instruct kombiniert eine noch gut handhabbare Modellgröße mit Bild- und Videoverständnis. Damit ist es interessant für lokale Dokumentanalyse, Screenshots und visuelle…

Multimodal7BApache 2.0
Text + Bild + VideoProfil →
Q
High-End Workstation / Server

Qwen2.5-VL 32B Instruct

Qwen · Qwen2.5-VL

Qwen2.5-VL 32B Instruct skaliert die multimodale Qwen-Familie auf eine deutlich größere Kapazität. Es eignet sich für komplexere Bild-, Dokument- und visuelle Reasoning-Aufgaben,…

Multimodal32BApache 2.0
Text + Bild + VideoProfil →
M
High-End lokal

Mistral Small 3.2 24B Instruct

Mistral AI · Mistral Small 3

Mistral Small 3.2 24B Instruct ist ein kompaktes, aber leistungsfähiges General-Purpose-Modell mit Fokus auf Instruktionsbefolgung und Function Calling. Die 24B-Klasse ist besonders für…

Chat24BApache 2.0
M
Workstation

Mistral Nemo Instruct 2407

Mistral AI · Mistral Nemo

Mistral Nemo Instruct ist ein 12B-Modell mit gutem Verhältnis aus Größe, Mehrsprachigkeit und lokaler Nutzbarkeit. Es bleibt eine praktische Option für Chat, RAG und strukturierte…

Chat12BApache 2.0
M
Desktop / Laptop

Ministral 8B Instruct 2410

Mistral AI · Ministral

Ministral 8B Instruct ist für effiziente lokale und edge-nahe Inferenz konzipiert. Technisch passt die Größe gut zu Consumer-Hardware; bei kommerzieller Nutzung muss die Mistral Research…

Chat8BMistral Research License
M
Desktop / Laptop

Mistral 7B Instruct v0.3

Mistral AI · Mistral 7B

Mistral 7B Instruct v0.3 gehört zu den etablierten kompakten Open-Weight-Modellen und besitzt eine breite lokale Tool-Unterstützung. Für neue Projekte existieren modernere Varianten, als…

Chat7BApache 2.0
M
High-End lokal

Devstral Small 2505

Mistral AI · Devstral

Devstral Small 2505 ist Mistrals auf software-engineering-nahe Agenten- und Coding-Aufgaben ausgerichtete Open-Weight-Variante. Sie ist besonders für Repository-Analyse, Codeänderungen…

Coding24B-KlasseApache 2.0
Text / CodeProfil →
M
High-End lokal

Magistral Small 2506

Mistral AI · Magistral

Magistral Small 2506 erweitert Mistral Small um explizite Reasoning-Fähigkeiten. Das Modell ist mit 24B Parametern noch in einer High-End-Lokal-Klasse und damit interessant für Nutzer,…

Reasoning24BApache 2.0
M
Workstation

Pixtral 12B 2409

Mistral AI · Pixtral

Pixtral 12B 2409 ist Mistrals multimodales Modell für Text- und Bildverarbeitung. Die 12B-Klasse macht es zu einer vergleichsweise zugänglichen Option für visuelle…

Multimodal12B + Vision EncoderApache 2.0
Text + BildProfil →
M
Große Workstation / Server

Mixtral 8x7B Instruct v0.1

Mistral AI · Mixtral

Mixtral 8x7B war eines der prägenden offenen MoE-Modelle und bleibt als Referenz für effiziente Expertenarchitekturen relevant. Moderne Modelle können in vielen Bereichen weiter sein,…

Chat8×7B MoEApache 2.0
M
Server / Multi-GPU

Mixtral 8x22B Instruct v0.1

Mistral AI · Mixtral

Mixtral 8x22B skaliert das MoE-Prinzip deutlich über 8x7B hinaus. Für private Desktop-Nutzung ist das Modell kaum praktisch, für eigene Serverinferenz und Architekturvergleiche bleibt es…

Chat8×22B MoEApache 2.0
D
Server / Multi-GPU

DeepSeek-R1

DeepSeek · DeepSeek R1

DeepSeek-R1 ist ein großes Open-Weight-Reasoning-Modell mit Schwerpunkt auf mehrstufigem Problemlösen. Die vollständige Variante ist infrastrukturell sehr anspruchsvoll; für lokale…

Reasoninggroßes MoEMIT
D
Server / Cluster

DeepSeek-V3-0324

DeepSeek · DeepSeek V3

DeepSeek-V3-0324 ist eine große MoE-General-Purpose-Variante für Chat, Coding und Tool-Nutzung. Die MIT-Lizenz ist permissiv, die tatsächliche Hürde liegt vor allem in der sehr großen…

Chat685B-Klasse MoEMIT
D
Desktop / Laptop

DeepSeek-R1-Distill-Qwen-7B

DeepSeek · R1 Distill

DeepSeek-R1-Distill-Qwen-7B überträgt Reasoning-Verhalten aus R1 in eine deutlich kleinere Qwen-basierte Variante. Dadurch ist es eine populäre lokale Option für Mathematik, Analyse und…

Reasoning7BMIT
D
Workstation

DeepSeek-R1-Distill-Qwen-14B

DeepSeek · R1 Distill

Die 14B-Distill-Variante erhöht die Kapazität gegenüber dem 7B-Modell, bleibt aber auf leistungsfähigen lokalen Rechnern realistisch. Sie ist interessant, wenn Reasoning-Qualität…

Reasoning14BMIT
D
High-End Workstation

DeepSeek-R1-Distill-Qwen-32B

DeepSeek · R1 Distill

DeepSeek-R1-Distill-Qwen-32B ist die große lokale Distill-Option für Nutzer mit High-End-Workstation. Sie bringt deutlich mehr Kapazität als 7B und 14B mit, ohne die enorme Infrastruktur…

Reasoning32BMIT
D
Desktop / Workstation

DeepSeek-Coder-V2-Lite Instruct

DeepSeek · DeepSeek Coder V2

DeepSeek-Coder-V2-Lite Instruct ist eine ressourcenschonendere Coding-Variante der DeepSeek-Coder-Familie. Sie eignet sich für lokale Codegenerierung und Entwicklerassistenz; die…

CodingLite MoEDeepSeek License
Text / CodeProfil →
Φ
Workstation

Phi-4

Microsoft · Phi-4

Phi-4 ist Microsofts 14B-Textmodell mit Fokus auf hochwertige Trainingsdaten und Reasoning. Die MIT-Lizenz und überschaubare Größe machen es für lokale Forschung, private Assistenz und…

Reasoning14BMIT
Φ
Leicht lokal

Phi-4 Mini Instruct

Microsoft · Phi-4 Mini

Phi-4 Mini Instruct komprimiert die Phi-4-Familie auf eine laptopfreundliche Größenklasse. Es ist für Chat, Code und allgemeine Textaufgaben gedacht, wenn geringer Speicherbedarf und…

Chat3.8B-KlasseMIT
Φ
Workstation / Laptop

Phi-4 Multimodal Instruct

Microsoft · Phi-4 Multimodal

Phi-4 Multimodal Instruct kombiniert Text, Bild und Audio in einer relativ kompakten Modellfamilie. Das macht es interessant für lokale multimodale Assistenten, Sprachverarbeitung und…

MultimodalMini-basierte Multimodal-KlasseMIT
Text + Bild + AudioProfil →
Φ
Workstation

Phi-4 Reasoning Plus

Microsoft · Phi-4 Reasoning

Phi-4 Reasoning Plus ist eine auf längere Denk- und Problemlöseprozesse ausgerichtete Phi-4-Variante. Mit MIT-Lizenz und 14B-Klasse bleibt sie für leistungsfähige lokale Rechner…

Reasoning14B-KlasseMIT
I
Desktop / Workstation

Granite 3.3 8B Instruct

IBM · Granite 3.3

Granite 3.3 8B Instruct ist IBMs kompakte Unternehmens- und General-Purpose-Variante mit Apache-2.0-Lizenz. Sie eignet sich für Self-Hosted-RAG, strukturierte Assistenz und Anwendungen,…

Enterprise8BApache 2.0
I
Sehr leicht

Granite 3.3 2B Instruct

IBM · Granite 3.3

Granite 3.3 2B Instruct ist die kleinere Granite-3.3-Option für ressourcenarme Self-Hosted-Anwendungen. Sie ist besonders interessant für Unternehmen, die einfache lokale…

Enterprise2B-KlasseApache 2.0