Modelle·lokal (eigene GPU)·geprüft 2026-06-09

Gemma 4 12B

Google · Gemma License

Unser Standard-Modell für alles, was auf der eigenen GPU laufen soll. Offene Gewichte, läuft via Ollama auf unserer RTX 3090 — kein API-Call, keine Kosten je Aufruf, nichts verlässt das Haus.

Anbieter
Google
Tier
lokal (eigene GPU)
Lizenz
Gemma License
Gewichte
offen (self-hostbar)
Selbst betrieben
ja
Parameter
12 Mrd
Modalitäten
Text
Aufgabe
Langtext
Unsere Sicht

Einschätzung

  • Gemma 4 12B ist aktuell das Default-Lokalmodell in mana-llm. Es ist der Beleg für unsere These „Frontier-nahe Qualität passt heute auf eigene Hardware" — gut genug für die meisten Text-Aufgaben, ohne eine fremde Cloud zu brauchen.
  • Es ist ein Thinking-Modell: Es erzeugt internen Reasoning-Overhead. Bei sehr eng gesetztem Token-Limit kann die eigentliche Antwort leer bleiben — ein Detail, das man beim Integrieren kennen muss.
Stärken
  • Offene Gewichte, vollständig self-hostbar.
  • Läuft auf einer einzelnen RTX 3090.
  • Keine Kosten und kein Datenabfluss pro Aufruf.
Grenzen
  • Gemma License ist offen, aber nicht so permissiv wie Apache-2.0.
  • Thinking-Overhead kostet Token und Latenz.
Im Verein

Wo wir es einsetzen

  • mana-llm — Default-Modell für lokale Text-Operationen.
Notizen

Gemma 4 12B wurde unser lokales Default-Modell, nachdem Ollama 0.30.6 einen Crash der Vorversion behob. gemma3:12b bleibt als Fallback-Netz erhalten.

Die ausführliche Recherche zur Frage, ob ein Modell dieser Klasse auf unserer eigenen GPU wirklich trägt, steht unter Recherchen.

Ein Steckbrief sagt, was ein Modell ist. Welches Modell eine konkrete Aufgabe gewinnt, entscheiden wir nicht aus dem Bauch, sondern messen es — Qualität gegen Kosten, pro Operation.