Vision
Compliance-Audit funktioniert nur mit Determinismus. Jede Aussage muss zur Quelle zurückverfolgbar sein. Jede Konfidenz muss messbar sein. Jede Abweichung gerichtsfest dokumentiert.
Der Status quo.
Brandschutzkonzepte werden heute mit dem Schreibblock entwickelt. Schutzziel-Äquivalenz im Kopf des Fachplaners. Audit nur bei Schadensfall. Wenn der Prüfsachverständige nach zwei Jahren fragt „warum diese Abweichung?", existiert die Antwort als Erinnerung im Kalender — nicht als nachvollziehbares Dokument.
Das skaliert nicht in eine Welt, in der VdS, Gerichte, Versicherer und Bauaufsichten zunehmend Argumentationsketten verlangen, nicht Bauteilkataloge. Die Branche hat das gespürt, aber bisher mit mehr Excel-Tabellen geantwortet.
Wir sehen darin keine Excel-Frage, sondern eine Architektur-Frage. Und wir glauben, dass generative KI plus strukturierte Audit-Schicht die richtige Antwort sind — wenn man sie diszipliniert baut.
Was wir glauben.
Erstens. Konfidenz ist berechenbar. Eine Aussage mit zwei Citations und keinen Hedges ist messbar verlässlicher als eine mit drei „möglicherweise" und nullzwei „Annahme: ...". Wir definieren diese Messung offen — und stellen sie unter Falsifizierbarkeit (ADR-0018 Säule 2).
Zweitens. Ein Konzept ist erst dann verlässlich, wenn es einem adversarialen Prüfer standgehalten hat. Nicht „glaub mir, ich war 30 Jahre dabei", sondern „hier ist die fünf-Runden-Diskussion mit dem Schatten-Prüfer und sein finales Audit-Memo".
Drittens. Trainingsdaten dürfen niemals aus dem Mandantengeschäft stammen. Hard. Public-only. Keine Ausnahmen. Wer das einmal weicht, hat keine Compliance- Plattform mehr — er hat einen DSGVO-Vorfall.
Viertens. Eine Plattform, die parametrisch steuerbar ist (sieben Slider, sieben Variants), ist transparenter als eine, die ihre „Magie" hinter einem einzelnen Knopf versteckt. Der Bauherr soll sehen können, mit welcher Härte argumentiert wurde — und welche andere Variante genauso valide gewesen wäre.
Vier Säulen, ein Anspruch.
ADR-0018 (2026-05-03) hält die Methodik fest. Vier Säulen, jede einzeln nachweisbar verletzbar — und wenn verletzt, dann das Konzept zu verwerfen.
Citation-Trail-Determinismus
Jede Aussage hat zurückverfolgbare Quelle. § oder DIN oder VdL-Arbeitsblatt — explizit. Citation-Count fließt in den Konfidenz-Score. Kein „weil das LLM es gesagt hat".
4-Stufen-Konfidenz-Pyramide
stark · plausibel · schwach · spekulativ. Sichtbar pro Section. Score < 60 = visuell anders dargestellt — der Reviewer sieht sofort wo das Konzept Schwächen hat. Pricing- Hebel.
Multi-Layer-Triangulation
Drei Korpus-Schichten triangulieren jede Empfehlung — Normativ (LBOs, Sonderbau-VOs), Praxis (Mustervorschriften, vfdb-Leitfäden), Curriculum (EIPOS / TÜV / BZB / FeuerTrutz). „Stark" = aus min. 2 Schichten belegt.
Falsifizierbarkeit via Lab
Variants A–F sind ceteris paribus. Gleicher Input, nur Slider-Werte ändern sich. validation_gate.py mit State- Machine + 4 NoGo-Asserts setzt Schreibschutz wenn manipuliert.
Was bisher gebaut wurde.
Die folgenden Zahlen sind nicht Pitch-Behauptungen, sondern beim Build dieser Seite aus dem Repository gelesen. Quelldateien: web/public/graph-snapshot.json, data/training-pairs/, data/run-traces/, data/run-configs/variants.json, data/ontology/synonyms.json, data/notebooklm/master_quellenregister.jsonl.
Brandschutz-spezifische Bundes- und Landesquellen aufgefüllt
Stefan Truthän schickte uns einen Vergleichs-Benchmark: das BauR- Archiv eines koreanischen Architekten als Norm-Browser-Showcase. Wir nutzten den Vergleich, um Lücken zu identifizieren — und füllten sie:
- 11 Brandschutz-relevante Bundesverordnungen: ArbSchG, ArbStättV, GefStoffV, BetrSichV, BImSchG, 1./4./12. BImSchV, WHG, AwSV, SchfHwG — alle via gesetze-im-internet.de (BMJV, frei)
- 10 Feuerungsverordnungen der Länder (FeuVO): BW, BB, MV, NRW, RP, SL, SN, ST, SH, TH — via SerpAPI-Discovery + Bright Data + Landes-Justizportale
- Berlin + Bremen haben ihre FeuVO aufgehoben (durch VV TB ersetzt — sind als ⊘ deprecated im Master-Index)
- 4 Failures (BY/HH/HE/NI) ehrlich dokumentiert als B60 — Beck-Online-Modul (B55) würde diese Lücken in einem Zug schließen
Das ist nicht die finale Quellen-Tiefe — DIN- Normen (DIN 4102, DIN 18009, DIN 14675), VdS-Richtlinien und vfdb-Leitfäden stehen als B55-Investment-Block mit klarer User-Beschaffung-Pflicht im Backlog. Im Sinne von „je mehr Normen, umso besser die Argumentation": jede zusätzliche Quelle erhöht Argumentations-Tiefe — wir verkürzen nicht mit „90% reicht".
Wir machen etwas anderes als der Koreaner
Sungwoo Kim's BauR Archiv ist ein Norm-Browser — er zeigt was im Recht steht. Wir bauen Multi-Agent-Diskussion mit aktivem Judge auf derselben Norm-Basis — zeigt was im konkreten Fall gilt, inkl. Gegen-Argumentation und konfidenz-gewichtetem Verdict. Reihenfolge:
- Pentarchy (B56-B59) — Generator + Gegen- Argumentant + PrüfSV + Judge, Schema v0.3.0 JudgeScore-Formel aktivieren
- Self-Learning-Customer-Loop (späterer Sprint) — pro signiertes Konzept wird ein Pair-Record in den Customer- spezifischen Korpus aufgenommen, NICHT in unseren Stock-Korpus (Vertrauen + DSGVO)
- PDF-Output erst danach — weil ohne Pentarchy- Substanz hilft das PDF nichts
Voraussetzung für Pentarchy: A/B-Test im Lab zwischen unserer Ontologie (Schema v0.3.0) und Cognee-Auto-Discovery aus den jetzt verfügbaren 162 Rechtsquellen. Falsifikator: liefert Cognee mehr semantische Cross-Refs als unsere Hardcoded-Methodik?
Ein konkretes Beispiel der parametrischen Steuerung. Beide Runs gegen pair_001 (Mammitzsch · TU Dresden Diplomarbeit 2024 · Görges-Bau · GK4 · Denkmal · Versammlungsstätte- Element). Gleicher Input, gleiche zurückgehaltene Lösungs- Pages. Nur die sieben Slider unterscheiden sich.
| Indicator | Default | Variant F | Δ |
|---|---|---|---|
| Body-Chars total | 26 922 | 34 783 | +29 % |
| Citations Section 5 · Anlagentechnik | 2 | 7 | +250 % |
| Citations Section 6 · Organisatorisch | 1 | 4 | +300 % |
| Dialog · ❌ ungeklärt | 1 | 0 | −1 |
Der einzelne ungeklärte Punkt aus dem Default-Run wurde durch höhere nachweis_tiefe + argumentations_schaerfe in Variant F pre-emptive im Konzept adressiert. Slider- Wirkung ist kein Marketing-Trick — sie ist messbar.
Wo das hingeht.
Brandschutz ist der Pilot. Das Produkt ist eine Compliance-Audit-Plattform für alle Sachverständigen- getriebenen Industrien — Pharma, Lebensmittel, Verkehr, TÜV, Versicherer, Medizinprodukte, Cybersecurity. Schema domain-agnostisch, Master-Prompt-Stack pro Industrie kuratiert.
Nächste konkrete Schritte: Multi-Agent-Diskussion mit benannten Agent- Identitäten (virtuelle Fachplaner-Firma analog Pentarchy- Pattern, siehe Memory project_virtuelle_fachplaner_firma.md), Versicherungsrechtliche Asymmetrie als ontologische Schicht (VdS-Zwang vs baurechtlicher Brandschutz, Phase-15-Kandidat), Web-trigger-Re-Run-Button für serverseitig ausgelöste Pipeline-Runs (Backlog B30).
Phase 0 — Trigger-Research-Engine (Backlog B39): pro Kunden-Account beobachten was der Markt macht (neue Bauvorhaben, Personal-Veränderungen, Wettbewerbs-Wins, B-Plan-Veröffentlichungen). Agent dispatcht Research-Mission beim Trigger-Feuer und liefert ein 1-2-Seiten-Dossier zurück — nicht ein Mail-Alert. Phase 0 schließt den Loop vor der Phase-2-Plan-Ingest, damit das Plattform-Wissen die ganze Akquise-bis-Self-Learning-Kette begleitet, nicht erst nach Auftrag einsetzt.
PDF-Konzept-Output (Backlog B43): heute haben wir den Audit-Trail-Viewer als Lese-Fenster auf die Pipeline, aber kein fertiges Konzept-PDF das ein Fachplaner unterschreiben und ans Bauamt einreichen würde. Das ist die kritische Brücke zwischen Plattform-Output und Bauamt- Workflow — Konzept-Struktur, Citation-Anchors pro Aussage, Fachplaner-Signatur-Block, Audit-Trail-Anhang als separate Sektion. Im Bau.
Was wir nicht tun: kein „Phase X coming soon"-Marketing ohne formales Backlog-Item. Memory feedback_no_lipservice_in_commits.md ist HARDCODED. Was wir behaupten, ist gebaut. Was nicht gebaut ist, steht in der transparenten Roadmap (B1–B43 in CLAUDE.md).
Compliance-Audit-Plattform
Pilot Brandschutz · Ausweitung Sachverständigen-Industrien
2026-05-06
armand@my-mind.io