Pixtral 12B
Mistral AI · Apache-2.0
Unser lokales Modell, wenn ein Bild eingeschätzt werden soll. Multimodal, Apache-2.0, aus Europa — und self-hostbar auf der eigenen GPU. Erster gemessen-gepinnter Eintrag in unserem Operations-Routing.
- Anbieter
- Mistral AI
- Tier
- lokal (eigene GPU)
- Lizenz
- Apache-2.0
- Gewichte
- offen (self-hostbar)
- Selbst betrieben
- ja
- Parameter
- 12 Mrd
- Modalitäten
- Text · Bild verstehen
- Aufgabe
- Bild
Unsere Sicht
Einschätzung
- Pixtral 12B verarbeitet Text und Bild zusammen. Das macht es zum lokalen Träger für Vision-Aufgaben — Bilderkennung, ohne das Foto an eine fremde Cloud zu geben.
- Apache-2.0 und EU-Herkunft passen doppelt zu unserer Linie: frei self-hostbar und ohne die Souveränitäts-Frage eines US- oder CN-Anbieters.
Stärken
- Multimodal (Text + Bild) bei offener Apache-2.0-Lizenz.
- EU-Anbieter, vollständig self-hostbar.
- Eval-belegt für die Food-Recognition-Operation.
Grenzen
- Als allgemeines Vision-Modell über Food hinaus noch nicht breit gemessen.
Im Verein
Wo wir es einsetzen
- nutriphi — Essen auf einem Foto erkennen (gemessen & gepinnt).
Notizen
Pixtral 12B war der erste Eintrag in unserem gepinnten Operations-Routing
(nutriphi.food.recognize) — eine Entscheidung, die nicht aus dem Bauch
kam, sondern aus einer Messung. Die Zahlen dazu stehen unter
Messungen.
Belegt durch
Womit das zusammenhängt
Modelle
Weitere Steckbriefe
Ein Steckbrief sagt, was ein Modell ist. Welches Modell eine konkrete Aufgabe gewinnt, entscheiden wir nicht aus dem Bauch, sondern messen es — Qualität gegen Kosten, pro Operation.