Modelle·lokal (eigene GPU)·geprüft 2026-06-09

Pixtral 12B

Mistral AI · Apache-2.0

Unser lokales Modell, wenn ein Bild eingeschätzt werden soll. Multimodal, Apache-2.0, aus Europa — und self-hostbar auf der eigenen GPU. Erster gemessen-gepinnter Eintrag in unserem Operations-Routing.

Anbieter
Mistral AI
Tier
lokal (eigene GPU)
Lizenz
Apache-2.0
Gewichte
offen (self-hostbar)
Selbst betrieben
ja
Parameter
12 Mrd
Modalitäten
Text · Bild verstehen
Aufgabe
Bild
Unsere Sicht

Einschätzung

  • Pixtral 12B verarbeitet Text und Bild zusammen. Das macht es zum lokalen Träger für Vision-Aufgaben — Bilderkennung, ohne das Foto an eine fremde Cloud zu geben.
  • Apache-2.0 und EU-Herkunft passen doppelt zu unserer Linie: frei self-hostbar und ohne die Souveränitäts-Frage eines US- oder CN-Anbieters.
Stärken
  • Multimodal (Text + Bild) bei offener Apache-2.0-Lizenz.
  • EU-Anbieter, vollständig self-hostbar.
  • Eval-belegt für die Food-Recognition-Operation.
Grenzen
  • Als allgemeines Vision-Modell über Food hinaus noch nicht breit gemessen.
Im Verein

Wo wir es einsetzen

  • nutriphi — Essen auf einem Foto erkennen (gemessen & gepinnt).
Notizen

Pixtral 12B war der erste Eintrag in unserem gepinnten Operations-Routing (nutriphi.food.recognize) — eine Entscheidung, die nicht aus dem Bauch kam, sondern aus einer Messung. Die Zahlen dazu stehen unter Messungen.

Belege

Quellen Dritter

Ein Steckbrief sagt, was ein Modell ist. Welches Modell eine konkrete Aufgabe gewinnt, entscheiden wir nicht aus dem Bauch, sondern messen es — Qualität gegen Kosten, pro Operation.