Alle Beiträge.
Unternehmertum, Systeme & Prozesse, Digitalisierung und lokale KI - direkt aus der Praxis.
WingQ: Eine Kommunikationszentrale für mehrere KI-Harnesses
Ich nutze verschiedene Agenten-Laufzeiten. WingQ hält die Kommunikation zusammen: Gespräche, Dateien und Fortschritt in einer Oberfläche, während dahinter unterschiedliche Harnesses arbeiten.
DGX Spark: Kleine Maschine, erstaunlich viel lokale KI
Qwen3.8 Flash Next, DeepSeek-V4-Flash-0731 und gpt-oss-120b: Was ich mit meinen Sparks betreibe, warum Unified Memory so viel verändert und wo das Serving die Arbeit macht.
Tool Router: Warum er für meine lokalen Agenten unverzichtbar ist
Viele Werkzeuge müssen nicht viele Schemas im Startkontext bedeuten. Wie mein NEX Tool Router sucht, Beschreibungen nachlädt und ausführt – und welche neuen Fehlerquellen dabei entstehen.
Qwen3.8 Flash Next: Erst zwei Sparks. Jetzt reicht einer.
Qwen3.8 Flash Next läuft bei mir inzwischen auf einem DGX Spark. Wie hybrides Quantisieren, PLE-Mapping und sauberes Serving aus zwei gebundenen Rechnern zwei unabhängig nutzbare Maschinen machen.
NexClaw: Warum ich meinen eigenen Harness baue
Ich nutze fertige Harnesses und entwickle zusätzlich NexClaw. Dabei geht es um passende Abläufe, lokale Modelle und die Frage, woran ein Agent erkennt, dass eine Aufgabe wirklich erledigt ist.
Voice Pipe: Lokal auf 12 GB VRAM
Voice ist der ehrlichste Beweis dafür, dass lokale KI im Betrieb trägt: eine komplette Sprachkette aus Erkennung, Sprech-Helfer und Ausgabe läuft auf einer einzigen Consumer-Grafikkarte. Der Engpass ist nicht die Intelligenz der Modelle, sondern der Speicher.
Was ich in 16 Jahren Unternehmertum gelernt habe
Vor 16 Jahren habe ich mein erstes Gewerbe angemeldet. Was ich damals nicht wusste: Die nächsten Jahre würden mich an meine Grenzen bringen. Nicht weil das Geschäft…
