Projekte

Hier dokumentiere ich laufende Hardware-Projekte — Aufbau, Stolpersteine und gemessene Ergebnisse. Alles aus dem echten Betrieb, keine Theorie.

AGX Orin — lokaler KI-Server

64 GB RAM, 456 GB Disk, JetPack 7.0. Rolle: reiner Inferenz-Knoten (Ollama) hinter Tailscale — kein Telegram, keine Keys-Schreibrechte. Konfig-Master ist ein separater VPS, der AGX bekommt eine md5-verifizierte Lesekopie per Automatik. Status: produktiv — Artikel: AGX Orin als KI-Server.

Jetson-Cluster (Turing Pi 2)

Mehrere Orin-Nodes im Turing-Pi-2-Backplane, verwaltet über eine Dev-Maschine mit SLURM. Ziel: verteilte Inferenz und Modell-Parallelismus messen — nicht Theorie, sondern Watt und Tokens/s. Status: im Aufbau, Artikel folgt.

Local-AI-Messreihe (Ollama)

Gleiche Prompts über 5 Modelle: Tokens/s, RAM-Footprint, Leistungsaufnahme in Watt (jtop-Logging über Tage). Erste Messwerte aus dem Produktivbetrieb: qwen3.8:27b auf AGX — 0,89 s TTFT, 9,8 tok/s. Status: Messreihe läuft, Artikel mit kompletten Tabellen folgt.

Kommende Projekte

  • Orin Nano vs. AGX bei identischem Modell (fairer Vergleich, gleiche Thermik)
  • WoL-Orchestrierung: Cluster-Wecken per Broadcast vom Inferenz-Knoten
  • Agent-Mailbox-Betrieb: 24/7-Mail-Endpunkt mit Least-Privilege-Design