„Open Source“ steht auf dem Download-Knopf — gemeint ist fast immer nur „Open Weights“. Was du damit darfst, entscheidet die Lizenz, und die ist 2026 im Mittelstand angekommen: Rechte erlöschen ab 20 Millionen Umsatz statt ab 700 Millionen Nutzern. Manche Klausel schließt EU-Firmen ganz aus — und steht nicht einmal in der Lizenzdatei.
„Die offenen Modelle haben aufgeholt“ stimmt — und führt in die Irre. Das beste offene Modell liegt nur 3 Punkte hinter dem Weltbesten, hat 2,8 Billionen Parameter und läuft nur im Rechenzentrum. Was auf deine Grafikkarte passt, liegt rund 23 Punkte zurück. „Offen“ heißt nicht „lokal“ — und ein kleingerechnetes Modell rauscht nicht, es lügt selbstsicher. Der Betrieb kostet mehr als die Karte.
„Lokale KI ist billiger“ fällt als Erstes, wenn man nachrechnet. Nicht der Token-Preis entscheidet, sondern was die fertige Arbeit kostet. Die eigene Karte landet bei realistischer Auslastung bei 27,70 € pro Million Token — und ist selbst bei Volllast (0,51 €) teurer als ein billiges Cloud-Modell (0,26 €), bei schlechterer Qualität. Der Preis ist kein Grund für lokal.