gpt-oss-20b
OpenAIs kompakteres Open-Weight-Reasoning-Modell für lokale und selbst gehostete Inferenz. Es richtet sich an Nutzer, die Werkzeugnutzung, strukturiertes Denken und anpassbare…
Deutschsprachige Model-Passports für lokale KI, Self-Hosting und Unternehmensentscheidungen. Keine Rangliste: Filtere nach deinem konkreten Einsatzzweck.
Kein Fachbegriff nötig: Wähle einfach einen Einsatzzweck oder nutze die freie Suche.
OpenAIs kompakteres Open-Weight-Reasoning-Modell für lokale und selbst gehostete Inferenz. Es richtet sich an Nutzer, die Werkzeugnutzung, strukturiertes Denken und anpassbare…
Die größere gpt-oss-Variante priorisiert Modellkapazität und Reasoning gegenüber einfacher Desktop-Inferenz. Sie ist vor allem für Teams interessant, die ein leistungsfähiges…
Llama 4 Scout ist Metas multimodales MoE-Modell mit 17 Milliarden aktivierten Parametern pro Token. Es kombiniert Text- und Bildverständnis mit sehr großem Kontext und ist eher für…
Llama 4 Maverick ist die größere Experten-Variante der Llama-4-Familie. Der Fokus liegt auf multimodalem Verständnis und hoher Modellkapazität; für Selbsthosting ist vor allem die enorme…
Llama 3.3 70B Instruct ist ein großes textbasiertes Instruktionsmodell aus Metas Llama-Familie. Es bleibt für Self-Hosting relevant, wenn eine etablierte Toolchain, starke…
Llama 3.2 1B Instruct ist eine besonders kompakte Llama-Variante für Edge-, Mobile- und ressourcenarme lokale Setups. Sie eignet sich eher für einfache Assistenz- und…
Llama 3.2 3B Instruct bietet mehr Kapazität als die 1B-Version, bleibt aber klein genug für viele Laptops und Mini-PCs. Damit ist es ein praktischer Einstieg in lokale Chat- und…
Llama 3.2 11B Vision Instruct erweitert die Llama-Familie um Bildverständnis in einer noch vergleichsweise workstation-tauglichen Größenklasse. Interessant ist es für Dokumentbilder,…
Die 90B-Vision-Variante richtet sich an multimodale Anwendungen, bei denen höhere Modellkapazität wichtiger ist als kompakte lokale Inferenz. Für Unternehmen ist sie vor allem als…
Gemma 3 270M IT ist eine sehr kleine Instruktionsvariante der Gemma-3-Familie. Sie ist besonders interessant für Edge-Tests, Lernprojekte und stark begrenzte Hardware, ersetzt aber kein…
Gemma 3 1B IT ist die kleinste reguläre Textvariante von Gemma 3. Sie kombiniert einen geringen Speicherbedarf mit der modernen Gemma-Toolchain und eignet sich für einfache lokale…
Gemma 3 4B IT ist die kleinste multimodale Gemma-3-Variante. Sie verbindet Bild- und Textverarbeitung mit einer Größe, die noch für viele lokale Rechner interessant ist, und ist damit…
Gemma 3 12B IT liegt zwischen kompakter lokaler Nutzbarkeit und deutlich höherer Modellkapazität. Für Nutzer mit stärkerer Workstation ist es eine vielseitige Option für Text-, Bild- und…
Gemma 3 27B IT ist die große Gemma-3-Instruct-Variante und kombiniert multimodale Eingaben mit einer für lokale High-End-Workstations noch erreichbaren Modellgröße. Die Lizenz ist dabei…
Gemma 3n E2B IT ist auf On-Device-Nutzung und multimodale Eingaben ausgerichtet. Die Architektur zielt stärker auf mobile und edge-nahe Szenarien als klassische große LLM-Deployments und…
Gemma 3n E4B IT ist die leistungsstärkere On-Device-Variante der Gemma-3n-Familie. Sie richtet sich an multimodale Anwendungen, die mehr Kapazität als E2B benötigen, ohne in die…
Qwen3 0.6B ist die kleinste Qwen3-Variante und eignet sich für sehr ressourcenarme Experimente. Trotz der geringen Größe unterstützt die Familie moderne Chat- und Reasoning-Workflows,…
Qwen3 1.7B bietet mehr Reserven als die 0.6B-Version und bleibt gleichzeitig laptop- und edgefreundlich. Es ist ein sinnvoller Kandidat für kompakte mehrsprachige Assistenz, wenn…
Qwen3 4B liegt in einer für lokale Nutzung besonders interessanten Größenklasse: deutlich leistungsfähiger als Sub-2B-Modelle, aber weiterhin auf vielen Laptops oder kleinen GPUs…
Qwen3 8B ist eine der ausgewogensten Größen für lokale General-Purpose-Nutzung. Es bietet genügend Kapazität für ernsthafte Chat-, Coding- und Reasoning-Experimente, ohne zwingend eine…
Qwen3 14B ist eine Mittelklasse-Variante für Nutzer, die mehr Qualität als bei 8B-Modellen suchen, aber keine 32B-Workstation oder Serverumgebung betreiben möchten. Besonders interessant…
Qwen3 32B richtet sich an leistungsfähige lokale Workstations und Server, wenn die höhere Modellkapazität wichtiger ist als minimale Latenz. Es eignet sich für komplexere Analyse-,…
Qwen3 30B-A3B nutzt eine Mixture-of-Experts-Architektur: nur ein kleiner Teil der Gesamtparameter ist pro Token aktiv. Das kann eine interessante Balance aus Modellkapazität und…
Qwen3 235B-A22B ist die große MoE-Variante der Familie. Sie aktiviert nur einen Teil der Parameter pro Token, benötigt aber weiterhin Infrastruktur für hunderte Milliarden gespeicherte…
Qwen2.5-Coder 7B Instruct ist eine kompakte Coding-Variante für lokale Entwickler-Workflows. Sie eignet sich für Codeerklärung, Generierung und kleinere Repository-Aufgaben, wenn ein…
Qwen2.5-Coder 14B Instruct ist ein guter Mittelweg für lokale Coding-Assistenten. Gegenüber 7B steigt die Modellkapazität spürbar, ohne die Hardwareklasse eines 32B-Modells zu erzwingen.
Qwen2.5-Coder 32B Instruct ist die große Coding-Variante dieser Familie und zielt auf anspruchsvollere Codeerzeugung, Analyse und Refactoring-Aufgaben. Für lokale Nutzung ist eine große…
Qwen2.5-VL 7B Instruct kombiniert eine noch gut handhabbare Modellgröße mit Bild- und Videoverständnis. Damit ist es interessant für lokale Dokumentanalyse, Screenshots und visuelle…
Qwen2.5-VL 32B Instruct skaliert die multimodale Qwen-Familie auf eine deutlich größere Kapazität. Es eignet sich für komplexere Bild-, Dokument- und visuelle Reasoning-Aufgaben,…
Mistral Small 3.2 24B Instruct ist ein kompaktes, aber leistungsfähiges General-Purpose-Modell mit Fokus auf Instruktionsbefolgung und Function Calling. Die 24B-Klasse ist besonders für…
Mistral Nemo Instruct ist ein 12B-Modell mit gutem Verhältnis aus Größe, Mehrsprachigkeit und lokaler Nutzbarkeit. Es bleibt eine praktische Option für Chat, RAG und strukturierte…
Ministral 8B Instruct ist für effiziente lokale und edge-nahe Inferenz konzipiert. Technisch passt die Größe gut zu Consumer-Hardware; bei kommerzieller Nutzung muss die Mistral Research…
Mistral 7B Instruct v0.3 gehört zu den etablierten kompakten Open-Weight-Modellen und besitzt eine breite lokale Tool-Unterstützung. Für neue Projekte existieren modernere Varianten, als…
Devstral Small 2505 ist Mistrals auf software-engineering-nahe Agenten- und Coding-Aufgaben ausgerichtete Open-Weight-Variante. Sie ist besonders für Repository-Analyse, Codeänderungen…
Magistral Small 2506 erweitert Mistral Small um explizite Reasoning-Fähigkeiten. Das Modell ist mit 24B Parametern noch in einer High-End-Lokal-Klasse und damit interessant für Nutzer,…
Pixtral 12B 2409 ist Mistrals multimodales Modell für Text- und Bildverarbeitung. Die 12B-Klasse macht es zu einer vergleichsweise zugänglichen Option für visuelle…
Mixtral 8x7B war eines der prägenden offenen MoE-Modelle und bleibt als Referenz für effiziente Expertenarchitekturen relevant. Moderne Modelle können in vielen Bereichen weiter sein,…
Mixtral 8x22B skaliert das MoE-Prinzip deutlich über 8x7B hinaus. Für private Desktop-Nutzung ist das Modell kaum praktisch, für eigene Serverinferenz und Architekturvergleiche bleibt es…
DeepSeek-R1 ist ein großes Open-Weight-Reasoning-Modell mit Schwerpunkt auf mehrstufigem Problemlösen. Die vollständige Variante ist infrastrukturell sehr anspruchsvoll; für lokale…
DeepSeek-V3-0324 ist eine große MoE-General-Purpose-Variante für Chat, Coding und Tool-Nutzung. Die MIT-Lizenz ist permissiv, die tatsächliche Hürde liegt vor allem in der sehr großen…
DeepSeek-R1-Distill-Qwen-7B überträgt Reasoning-Verhalten aus R1 in eine deutlich kleinere Qwen-basierte Variante. Dadurch ist es eine populäre lokale Option für Mathematik, Analyse und…
Die 14B-Distill-Variante erhöht die Kapazität gegenüber dem 7B-Modell, bleibt aber auf leistungsfähigen lokalen Rechnern realistisch. Sie ist interessant, wenn Reasoning-Qualität…
DeepSeek-R1-Distill-Qwen-32B ist die große lokale Distill-Option für Nutzer mit High-End-Workstation. Sie bringt deutlich mehr Kapazität als 7B und 14B mit, ohne die enorme Infrastruktur…
DeepSeek-Coder-V2-Lite Instruct ist eine ressourcenschonendere Coding-Variante der DeepSeek-Coder-Familie. Sie eignet sich für lokale Codegenerierung und Entwicklerassistenz; die…
Phi-4 ist Microsofts 14B-Textmodell mit Fokus auf hochwertige Trainingsdaten und Reasoning. Die MIT-Lizenz und überschaubare Größe machen es für lokale Forschung, private Assistenz und…
Phi-4 Mini Instruct komprimiert die Phi-4-Familie auf eine laptopfreundliche Größenklasse. Es ist für Chat, Code und allgemeine Textaufgaben gedacht, wenn geringer Speicherbedarf und…
Phi-4 Multimodal Instruct kombiniert Text, Bild und Audio in einer relativ kompakten Modellfamilie. Das macht es interessant für lokale multimodale Assistenten, Sprachverarbeitung und…
Phi-4 Reasoning Plus ist eine auf längere Denk- und Problemlöseprozesse ausgerichtete Phi-4-Variante. Mit MIT-Lizenz und 14B-Klasse bleibt sie für leistungsfähige lokale Rechner…
Granite 3.3 8B Instruct ist IBMs kompakte Unternehmens- und General-Purpose-Variante mit Apache-2.0-Lizenz. Sie eignet sich für Self-Hosted-RAG, strukturierte Assistenz und Anwendungen,…
Granite 3.3 2B Instruct ist die kleinere Granite-3.3-Option für ressourcenarme Self-Hosted-Anwendungen. Sie ist besonders interessant für Unternehmen, die einfache lokale…