Lokale KI im eigenen Betrieb.
Modelle, Hardware und Agenten - im laufenden Einsatz gemessen.
Ich teste Modelle, Hardware und Runtimes unter Unternehmensbedingungen: in produktiven Abläufen, mit echter Last. Hier steht, was funktioniert, was scheitert und was sich in einen laufenden Betrieb übernehmen lässt. Alle Zahlen stammen aus eigenen Messungen.
Modelle im Betrieb
Welche Sprach- und Bildmodelle bei mir laufen, wie sie quantisiert sind und womit sie starten.
Models ansehen
Die Maschinen
Was im Rack steht: GPUs, Speicher, Verbund - mit den Messwerten, die zeigen, was jede Maschine leistet.
Hardware ansehen
Messungen
Serving-Stacks, Durchsatz und Latenz - gemessen an realen Lasten.
Inference ansehenHier erscheinen in Kürze die ersten Beiträge.
Du baust auch mit lokaler KI?
Lass uns über Modelle, Hardware und echte Anwendungsfälle sprechen.
