Welches lokale KI-Modell läuft auf deinem Rechner?

Der Check erkennt deine Grafikkarte und zeigt dir sofort, welche lokalen KI-Modelle darauf laufen — mit fertigem Befehl zum Kopieren. Ohne Anmeldung, ohne Registrierung.

Standardansicht für eine 12-GB-Grafikkarte — wähle dein Gerät für passgenaue Empfehlungen.

Womit arbeitest du?

Für Coding-Agenten

Modelle, die einen lokalen Coding-Agenten antreiben — Code verstehen, Dateien ändern, Werkzeuge bedienen.

DeepSeek R1 14B

Denkt vor der Antwort nach und ist dadurch stark bei kniffligen Aufgaben.

ollama run deepseek-r1:14blmstudio-community/DeepSeek-R1-Distill-Qwen-14B-GGUF
  1. Qwen 2.5 Coder 14B9,0 GBollama run qwen2.5-coder:14blmstudio-community/Qwen2.5-Coder-14B-Instruct-GGUF
  2. Code Llama 13B7,4 GBollama run codellama:13bCode Llama 13B

Für Dokumente & Wissensfragen (RAG)

Modelle, die deine PDFs und Notizen durchsuchen und Fragen dazu beantworten.

Llama 3.1 8B

Bewährtes Allround-Modell mit großer Community — läuft auch auf schwächerer Hardware flüssig.

ollama run llama3.1:8bLlama 3.1 8B
  1. Llama 3.2 3B2,0 GBollama run llama3.2:3bLlama 3.2 3B
  2. Gemma 3 12B8,1 GBollama run gemma3:12bGemma 3 12B
  3. Qwen 2.5 14B9,0 GBollama run qwen2.5:14blmstudio-community/Qwen2.5-14B-Instruct-GGUF
  4. Qwen 3 14B9,3 GBollama run qwen3:14blmstudio-community/Qwen3-14B-GGUF

Für Chat & allgemeine Aufgaben

Modelle zum Schreiben, Zusammenfassen und Nachdenken im Alltag.

Llama 3.1 8B

Bewährtes Allround-Modell mit großer Community — läuft auch auf schwächerer Hardware flüssig.

ollama run llama3.1:8bLlama 3.1 8B
  1. DeepSeek R1 14B9,0 GBollama run deepseek-r1:14blmstudio-community/DeepSeek-R1-Distill-Qwen-14B-GGUF
  2. Llama 3.2 3B2,0 GBollama run llama3.2:3bLlama 3.2 3B
  3. Gemma 3 12B8,1 GBollama run gemma3:12bGemma 3 12B
  4. Qwen 2.5 14B9,0 GBollama run qwen2.5:14blmstudio-community/Qwen2.5-14B-Instruct-GGUF

In LM Studio oben ins Suchfeld einfügen und das GGUF-Modell laden.

Alle Größenangaben beziehen sich auf die Standardquantisierung Q4_K_M bzw. das jeweilige Ollama-Standard-Tag.

Häufige Fragen

Wie viel VRAM brauche ich für ein 7B-Modell?

Ein 7B-Modell belegt bei der Standardquantisierung Q4_K_M rund 4 bis 5 GB. Mit Reserve für den Kontext bist du mit einer 8-GB-Grafikkarte gut dabei.

Was bedeutet Q4_K_M?

Q4_K_M ist eine Quantisierung: Das Modell wird auf etwa 4 Bit pro Gewicht komprimiert. Es wird deutlich kleiner und schneller, verliert dabei aber nur wenig Qualität. Bei Ollama ist das der übliche Standard.

Läuft ein lokales Modell auch ohne dedizierte Grafikkarte?

Ja. Kleine Modelle bis etwa 4 Milliarden Parameter laufen auch auf dem Prozessor oder integrierter Grafik — spürbar langsamer, aber für erste Schritte völlig brauchbar.

Warum bekomme ich andere Empfehlungen als mein Kollege?

Die Empfehlungen richten sich nach deiner erkannten Hardware. Andere Grafikkarte oder anderer Arbeitsspeicher bedeutet andere passende Modelle.

Stell Harald deine persönliche Frage

Ich nehme mir für jede Anfrage persönlich Zeit und antworte in der Regel innerhalb von 24 Stunden. Kostenlos und unverbindlich.
Direkt Google Meeting vereinbaren: Terminkalender
E-Mail senden:
Deine Daten werden ausschließlich für die Beantwortung der Fragen genutzt. Mehr zum Datenschutz erfährst du hier.