KI FÜR MÜNCHEN KI einführen. Richtig.

KI-Systeme, die man beweisen kann.

KI für München ist kein Beratungshaus, das Folien liefert. Hinter der Marke steht ein AI Platform Engineer mit der DNA eines Senior Test- und Qualitätsingenieurs: über 15 Jahre Erfahrung darin, stochastische Systeme testbar und beweisbar zu machen — heute angewandt auf KI-Agenten. Was wir empfehlen, läuft bei uns vorher in Produktion.

PROFIL / 01

Der Mensch dahinter

Stephan Walkowiak

ROLLE
AI Platform Engineer & Geschäftsführer
FUNDAMENT
Senior Test- & Qualitätsingenieur (15+ Jahre)
SCHWERPUNKT
Self-hosted Multi-Agenten-Systeme in Produktion
STANDORT
München

Ich baue self-hosted Multi-Agenten-Systeme, die in Produktion laufen — nicht im Prototyp. Mein Ansatz: den stochastischen Teil eines LLM einsperren und den Workflow drumherum reproduzierbar, prüfbar und compliance-fest machen.

Was mich unterscheidet, sind über 15 Jahre Erfahrung darin, stochastische Systeme testbar und beweisbar zu machen — Testautomatisierung, V-Modell, ISTQB. Genau dieses Handwerk wende ich heute auf KI-Agenten an. In über 3.000 Stunden mit Claude, Codex und Gemini habe ich mir autodidaktisch eine eigene KI-Infrastruktur aufgebaut und sie systematisch mit meinem Test- und Entwickler-Know-how verknüpft — datensouverän und EU-AI-Act-/DSGVO-konform by design, self-hosted statt Cloud-Zwang.

Seit Jahrzehnten arbeite ich eigenverantwortlich end-to-end: Ich übernehme Themen vollständig, bleibe eng im Gesamtplan eingebunden und kommuniziere proaktiv. Als Unternehmer plane, steuere und entscheide ich vorausschauend — damit Ziele schnell erreicht werden.

Diese Erfahrung, diesen Einblick und dieses Wissen biete ich Unternehmen an, die denselben Weg gehen wollen: Prozesse analysieren, Mehrwert identifizieren, umsetzen, betreuen. Alles aus einer Hand.

KERNKOMPETENZEN / 02

Vier Ebenen, ein roter Faden

Von der Agenten-Orchestrierung bis zur Compliance zur Laufzeit — jede Ebene steht auf demselben Fundament: Systeme so bauen, dass man ihnen vertrauen kann.

K-01

Agentic Systems & LLM-Engineering

Der stochastische Kern eingesperrt, der Workflow drumherum beweisbar.

Multi-Agenten-Orchestrierung (LangGraph, LangChain, Supervisor-Pattern)Human-in-the-Loopdeterministische Absicherung reproduzierbarer AgentenRAGStructured Output (Pydantic)Prompt-Injection-AbwehrMCP & API-Integrationautomatisierte Qualitätsbewertung von KI-Antworten

K-02

Local LLM & MLOps

KI auf eigener Hardware — messbar und kostenkontrolliert.

Lokale Inferenz auf AMD ROCm (llama.cpp, GGUF/Quantisierung)Modellauswahl (Qwen3, DeepSeek-R1, Mistral, BGE-M3)Observability & Token-/Kosten-Tracking (Langfuse, OpenTelemetry)reproduzierbare Benchmarks

K-03

Quality & Lifecycle Engineering — das Fundament

Über 15 Jahre darin, stochastische Systeme testbar und beweisbar zu machen.

Testautomatisierung (pytest, Robot Framework, Jenkins/CI)Application Lifecycle ManagementV-ModellIntegrations-, Performance- & Storage-QualifizierungRoot-Cause-DebuggingISTQB Foundation (Test Manager in Vorbereitung)

K-04

Governance, Infrastruktur & Compliance

Compliance nicht als Anhang, sondern als Laufzeit-Eigenschaft.

EU AI ActDSGVO / PII-Redaction als Runtime-HookData Sovereignty / Self-HostingDocker/Compose, LXDPostgreSQL/pgvector, Neo4j/Graphiti, RedisFastAPISecrets-Management (Infisical)TÜV-zertifizierter AI Officer & AI Coordinator

SYSTEME / 03

In Produktion, nicht im Prototyp

Drei laufende Systeme, an denen sich unser Ansatz zeigt — jedes mit Governance-Gates, Test-Absicherung und klaren Übergaben an den Menschen.

S-01

Agentische CI-Triage & Test-Automatisierung

Großes Münchner Technologieunternehmen · Kamerasysteme

2024 – heute
  • Agentisches CI-Triage-System als komponierbare Skill-Kette: roter Testlauf → Duplikat-Check → Evidence-Anreicherung → Klassifizierung → Fix-Routing — jeder Schritt mit klarer Read-/Write-Grenze.
  • Governance-Hooks zur Laufzeit: DSGVO-PII-Redaction (keine Klarnamen an den LLM-Provider), Test-Gate, Skill-Guard. Terminale Aktionen nur mit menschlicher Freigabe.
  • Anforderungs-zu-Test-Flow des V-Modells durchgängig automatisiert; im Produktivbetrieb über Jira, ReportPortal, Jenkins und GitLab.

S-02

Self-hosted KI- & E-Commerce-Plattform

ByteNubes GmbH

seit 2020
  • Produktions-Stack mit 50+ Docker-Containern / 26 Compose-Projekten im Live-Betrieb (u. a. die eigene Plattform paramaniac.shop) auf Saleor & ERPNext.
  • RAG-Chatbot & Voice-Agent: Claude API, LiveKit, Whisper (STT), Piper (TTS), Chatwoot, WhatsApp-Anbindung.
  • Omnichannel-Integration (WhatsApp, Instagram, TikTok, Meta) sowie Google-/Meta-Ads-APIs; Observability mit Grafana/Loki.

S-03

Local-Inference-Agentenplattform

Eigenentwicklung

2025 – heute
  • Hierarchische „Agenten-Firma" (Supervisor → Abteilungen → Worker, Human-in-the-Loop) auf AMD Ryzen AI Max+ / Radeon (ROCm) — vollständig lokal.
  • Wissensgraph & Memory: pgvector für schnellen Abruf, temporales Wissen („was galt wann") über Neo4j/Graphiti.
  • Referenzarchitektur für EU-AI-Act-konforme, cloud-freie KI.

WERDEGANG / 04

Zertifiziert, nicht behauptet

Wer Governance verkauft, muss sie nachweisen können. Qualifikationen öffentlich prüfbar — der Weg dahin über zwei Jahrzehnte Integration und Test.

seit 2021

Geschäftsführer · ByteNubes GmbH

Marke „KI für München" seit 2026. Unternehmerische Gesamtverantwortung: Strategie, Kunden, Umsetzung.

seit 2011

Test- & AI-Engineer (extern) · Großes Münchner Technologieunternehmen · Kamerasysteme

Testautomatisierung, HW-/SW-Integration und Storage-Qualifizierung; heute agentische CI-Automatisierung.

2008 – 2010

Postproduktion & System-Administration

Postproduktions-Abwicklung sowie Server- und Editing-Systeme.

2007 – 2019

Medien- & Kameraproduktion · freiberuflich

TV-Postproduktion, später Kamera- und Medienproduktion als zweites Standbein — ab 2020 vom E-Commerce-Aufbau abgelöst.

2001 – 2007

IT- & Netzwerktechnik · selbstständig

Netzwerke, Telefonanlagen und Sicherheitssysteme — frühe Praxis in Systemintegration und Administration.

METHODIK / 05

Was wir empfehlen, nutzen wir selbst

Unsere eigene Organisation läuft vollständig KI-geführt. Jede Empfehlung, die wir aussprechen, trägt bei uns vorher Produktivlast — auf fünf Ebenen.

  1. E-01

    Angebot & Vertrieb

    Anfragen, Angebote und Kundenkommunikation laufen KI-gestützt.

  2. E-02

    Entwicklung

    Code-Assistenz, Review-Automation und Dokumentation im täglichen Einsatz.

  3. E-03

    Test & Qualität

    Testfallableitung und automatisierte Regression — unser eigenes Handwerk.

  4. E-04

    Pipelines & Betrieb

    CI/CD mit KI-Gates, Monitoring und automatischer Befundbewertung.

  5. E-05

    Administration

    Reporting, Dokumentenmanagement und Planung — KI-geführt statt handgepflegt.

Das ist der Unterschied

Berater empfehlen, was sie gelesen haben. Praktiker empfehlen, was bei ihnen läuft. Wenn ein Tool unsere eigene Evaluation nicht übersteht, erreicht es Ihren Betrieb gar nicht erst.

GRUNDSÄTZE / 06

Woran Sie uns messen können

W-01

Datensouveränität

Self-hosted first. Ihre Daten, Ihr Wissen, Ihre Modelle bleiben unter Ihrer Kontrolle — Cloud nur, wo sie nachweisbar die bessere Wahl ist.

W-02

Deterministisch statt überraschend

Wir sperren den stochastischen Teil eines LLM ein und machen den Workflow drumherum reproduzierbar: definierte Gates, klare Übergaben an den Menschen, jedes System dokumentiert und auditierbar.

W-03

Service zuerst

Wir sind ein kleines Haus mit großem Anspruch: Der Kunde, den wir gewonnen haben, bleibt. Weil wir erreichbar sind, liefern und dranbleiben.

Abseits der Arbeit: Gleitschirm- und Ultralight-Pilot, Fotografie und Kamera — die Nähe zu präziser Technik bleibt auch in der Freizeit.

KONTAKT / 07

Lernen wir uns kennen

Ein Gespräch sagt mehr als jede Website. Erzählen Sie uns, wo Ihr Unternehmen steht — wir sagen Ihnen ehrlich, was wir tun würden.