Blog

Alle Beiträge.

Unternehmertum, Systeme & Prozesse, Digitalisierung und lokale KI - direkt aus der Praxis.

Agents 2026-09-17

WingQ: Eine Kommunikationszentrale für mehrere KI-Harnesses

Ich nutze verschiedene Agenten-Laufzeiten. WingQ hält die Kommunikation zusammen: Gespräche, Dateien und Fortschritt in einer Oberfläche, während dahinter unterschiedliche Harnesses arbeiten.

Hardware 2026-09-17

DGX Spark: Kleine Maschine, erstaunlich viel lokale KI

Qwen3.8 Flash Next, DeepSeek-V4-Flash-0731 und gpt-oss-120b: Was ich mit meinen Sparks betreibe, warum Unified Memory so viel verändert und wo das Serving die Arbeit macht.

Agents 2026-09-17

Tool Router: Warum er für meine lokalen Agenten unverzichtbar ist

Viele Werkzeuge müssen nicht viele Schemas im Startkontext bedeuten. Wie mein NEX Tool Router sucht, Beschreibungen nachlädt und ausführt – und welche neuen Fehlerquellen dabei entstehen.

Models 2026-09-17

Qwen3.8 Flash Next: Erst zwei Sparks. Jetzt reicht einer.

Qwen3.8 Flash Next läuft bei mir inzwischen auf einem DGX Spark. Wie hybrides Quantisieren, PLE-Mapping und sauberes Serving aus zwei gebundenen Rechnern zwei unabhängig nutzbare Maschinen machen.

Development 2026-09-17

NexClaw: Warum ich meinen eigenen Harness baue

Ich nutze fertige Harnesses und entwickle zusätzlich NexClaw. Dabei geht es um passende Abläufe, lokale Modelle und die Frage, woran ein Agent erkennt, dass eine Aufgabe wirklich erledigt ist.

Voice 2026-09-01

Voice Pipe: Lokal auf 12 GB VRAM

Voice ist der ehrlichste Beweis dafür, dass lokale KI im Betrieb trägt: eine komplette Sprachkette aus Erkennung, Sprech-Helfer und Ausgabe läuft auf einer einzigen Consumer-Grafikkarte. Der Engpass ist nicht die Intelligenz der Modelle, sondern der Speicher.

Unternehmertum 2025-01-10

Was ich in 16 Jahren Unternehmertum gelernt habe

Vor 16 Jahren habe ich mein erstes Gewerbe angemeldet. Was ich damals nicht wusste: Die nächsten Jahre würden mich an meine Grenzen bringen. Nicht weil das Geschäft…