Alle Forschung

20. Januar 2026 · Vom Research-Team · 7 Min. Lesezeit

Kleine Modelle, große Arbeit

Offline-Installationen haben uns beigebracht, nicht reflexhaft zum größten Modell zu greifen. Gut orchestrierte kleine Spezialisten schlagen regelmäßig einen einzelnen Generalisten-Riesen.

Wenn das Rechenbudget ein Rack im Ministeriumskeller ist statt einer elastischen Cloud, ist Modellwahl keine Geschmacksfrage mehr. Wir lernten, kleine Spezialisten zu komponieren — und entdeckten dann, dass das Muster selbst dort gewinnt, wo Rechenleistung unbegrenzt ist.

01

Zerlegung schlägt Skala

Eine Vertragsprüfung ist nicht ein Problem; sie ist Extraktion, Klassifikation, Vergleich und Entwurf. Jeder Schritt hat eine Modellgröße, die seine Schwierigkeit sättigt. Leitet man jeden Schritt an das kleinste Modell, das ihn sättigt, wird die Pipeline schneller, günstiger und leichter zu debuggen als ein großes Modell, das alles auf einmal soll.

02

Qualität wohnt in der Orchestrierung

Die Gewinne stecken in den Nähten: Validierung zwischen Schritten, Wiederholungen mit geschärften Anweisungen bei sinkender Konfidenz, Eskalation zu einem größeren Modell nur, wenn ein Spezialist Unsicherheit meldet. Qualität ist eine Eigenschaft der Pipeline, nicht eines einzelnen Modells darin.

03

Arbeit messen, nicht Benchmarks

Benchmarks belohnen Modelle; Betrieb belohnt Systeme. Wir verfolgen Kosten je abgeschlossener Aufgabe, Überarbeitungsquote und Zeit bis zur Abnahme — Zahlen, die ein Kunde spürt. Auf diesen Zahlen ist ein gut orchestriertes Set kleiner Spezialisten die stärkste Konfiguration, die wir ausliefern — online wie offline.