Bevor Sie nein sagen.
Zwoelf Fragen, die in jedem ersten Pitch-Gespraech kommen — von Architektinnen, Pruefingenieurinnen, Bauamts-Sachbearbeitern, Geschaeftsfuehrern. Hier steht jede Frage offen, mit Architektur- Antwort, Demo-Pfad und Backup-Quellen. Klicken Sie auf eine Frage, um die Tiefe aufzuklappen.
Die fuenf, die zaehlen.
der
Redaktion
Erfahrungsgemaess schauen Skeptiker bei einer Vendor-Praesentation nur die ersten fuenf Fragen ernsthaft an. Wer danach noch weiterliest, ist meistens schon Verbuendeter, kein Pruefer mehr. Deshalb sind die ersten fuenf hier in voller Tiefe ausgeschrieben — mit Angriffs-Frame, drei Bausteinen, Demo- Pfad, drei Antwort-Varianten, Backup-Quellen und einem Block »Was diese Antwort NICHT verspricht«. Letzteres ist die wichtigste Disziplin: nicht ueberverkaufen.
Fragen 06 bis 12 stehen weiter unten in kompakter Form. Vollstaendig, aber ohne dreifache Variant-Saetze.
01Halluziniert das nicht einfach?
Aufklappen
01
Tiefe
Die Frage ist selten technisch gemeint. Dahinter steckt ein konkretes Misstrauen: der Skeptiker hat selbst ChatGPT mit einem Brandschutz-Detail getestet, hat eine plausibel klingende, aber falsche Norm-Zitierung bekommen, und projiziert das auf jedes LLM-Tool. Was er hoeren muss, um abzuwinken: nicht »Es halluziniert nicht« — das wuerde er sofort als Marketing erkennen — sondern wie wir mit der Tatsache umgehen, dass es halluzinieren wird.
- Audit-Trail-Viewer oeffnenJede Aussage des Konzepts hat einen Citation-Stub. Klicken Sie eine Aussage an, sehen Sie die Quelle — Norm-Paragraph, Pruefverordnung, oder explizit »Annahme ohne Beleg«. → /platform/viewer
- Konfidenz-Heatmap lesenDie Formel ist Code, kein Marketing:
score = 100 − 8×Annahmen − 3×Hedges − 5×U-Flags + 2×min(Cites,10). Jede Aussage ohne Quelle kostet Punkte — ab Score <40 landet sie automatisch in der Stufe spekulativ. → /platform/trace - PruefSV-Schatten-Dialog durchspielenBevor das Konzept Sie erreicht, hat es fuenf Runden gegen einen adversarial gestimmten Pruefer-Agent bestanden. Jede Runde greift gezielt unbelegte Aussagen an — das Konzept muss verteidigen, nachzitieren, oder dokumentiert kapitulieren (»kann ich nicht beantworten«). → /platform/dialog
A — ehrlichHalluziniert es? Ja. Jedes LLM tut das. Bei uns hinterlaesst jede Halluzination einen Citation-Stub im Trace — und der Schatten-Pruefer findet sie spaetestens in Runde zwei.
B — technischWenn der Citation-Trail leer ist, ist die Aussage automatisch im Quadranten »spekulativ« — und ein Konzept mit spekulativem Anteil >10 Prozent geht so nicht ans Bauamt.
C — defensivWir behaupten nicht, dass es nicht halluziniert. Wir behaupten, dass jede Halluzination im Audit-Trail sichtbar ist — und das ist die einzige Eigenschaft, die fuer einen Pruefingenieur zaehlt.
- data/run-traces/*_trace.json — lauffaehige Beispiel-Traces im Repo
- scripts/build_run_trace.py — Konfidenz-Formel im Quelltext
- ADR-0018 — Citation-Trail-Determinismus als Saeule eins der 4-Saeulen-Methodik
- data/run-configs/variants.json — sieben Slider, sieben Varianten, ceteris paribus reproduzierbar
- MY-MIND Manifest 2026 / These 06 — »Trust by design« — *„Vertrauen ist eine Architektur, kein Workshop"*. Diese FAQ-Antwort ist das compilierbare Lese-Fenster auf die These.
- Nicht: »Es halluziniert nie.«
- Nicht: »Wir haben das Halluzinations-Problem geloest.«
- Nicht: »Unser Modell ist anders als ChatGPT.« (Es ist Claude Sonnet 4.6 — siehe Frage 05.)
- Sondern: Jede Halluzination ist sichtbar, gating-relevant und im Audit-Trail nachvollziehbar.
02Welche Datenquellen verwenden Sie?
Aufklappen
02
Tiefe
Hinter der Frage steckt selten der Wunsch nach einer Liste. Der Skeptiker testet drei Dinge gleichzeitig: (1) Habt ihr aktuelle Normen? (2) Habt ihr Praxis-Erfahrung jenseits des Lehrbuchs? (3) Habt ihr lizenzrechtlich saubere Quellen? Wer nur eine der drei beantwortet, hat verloren. Die ehrlichste Antwort benennt den 3-Layer-Korpus — Normativ, Praxis, Curriculum — und zeigt fuer jede Quelle, wann sie eingespeist wurde.
- Layer 1 — NormativMBO · M-PPVO · M-VStaettVO · M-VkVO · M-GarVO · MHHR · M-IndBauRL · M-SchulbauR. Plus landesspezifische Pendants (BauO NRW, BayBO usw.). Plus vfdb-Leitfaden TB 04-01 (494 Seiten Ingenieurmethoden). Stand: 166 echte Rechtsquellen + 2 Praxis-Leitfäden im Wissensgraph (1213 Nodes / 8578 Edges) nach KB-Sprint 1 + 2 + 2.6 (abgeschlossen 2026-05-17). Plus 11 Brandschutz-Bundesverordnungen (ArbSchG, ArbStättV, GefStoffV, BetrSichV, BImSchG-Familie, WHG, AwSV, SchfHwG) und 10 FeuVO der Länder. → Wissensgraph oeffnen
- Layer 2 — PraxisBaunetz-Sitemap mit 813 URLs, davon 65 Prozent (527) bereits ingested; Newsletter-Korpus (FeuerTrutz, baufachinformation); anonymisierte Pruefer-Bescheide aus oeffentlichen Vergabe-Portalen. Praxis ist das, was im Lehrbuch nicht steht aber im Bauamt entschieden wird — Auflagen-Aggregation pro Behoerde, Acceptance-Rate- Statistiken, Abweichungs-Genehmigungs-Praezedenzfaelle.
- Layer 3 — CurriculumSechs Anbieter-Curricula (EIPOS · TUeV-Rh · TUeV-Nord · BZB · FeuerTrutz · IQ-Zert) als 8 Curriculum-Pages, ~3 MB HTML. Layer 3 ist der Audit-Hebel: ohne ihn nur »Norm verletzt«, mit ihm »ein Sachverstaendiger haette das in der Pflicht-Schulung gelernt«.
A — ehrlichDrei Layer. Normativ (alle Mustervorschriften plus vfdb-Leitfaden), Praxis (Baunetz, Newsletter, anonymisierte Bescheide), Curriculum (sechs Anbieter-Schulungen). Pro Quelle steht im Trace, wann sie eingespeist wurde.
B — technisch1213 Knoten, 8578 Kanten im Wissensgraph. Jede Aussage im Konzept zeigt auf einen Knoten — und der Knoten zeigt auf die Original-PDF-Seite, das Curriculum-Modul, oder den Newsletter-Eintrag mit Datum.
C — defensivWir trainieren nichts. Wir sammeln, kuratieren, verschlagworten und machen den Korpus ueber Retrieval verfuegbar. Was Anthropic im Modell hat, ist nicht unser Korpus — siehe Frage 09.
- data/training-pairs/*.yaml — Aufgabe-Loesung-Paerchen mit Quellen-Anker
- data/ontology/synonyms.json — 22 Lemma-Familien fuer Begriffs-Normalisierung
- CLAUDE.md — KB-Sprint 1 Ingest-Tabelle — 166 echte Rechtsquellen + 2 Praxis-Leitfäden, >500 Cross-Edges, Commit-Hashes
- ADR-0017 — Schwarm-Discovery-Pipeline (1002 unique URLs in 70 Sekunden)
- MY-MIND Manifest 2026 / These 08 — »Data = governance« — *„Jeder Datenpunkt traegt Quelle, Konfidenz, Review-Zustand und Audit-Spur"*. 3-Layer-Korpus mit Provenance ist die wörtliche Umsetzung.
- Nicht: »Wir haben jede Norm, die je in Deutschland erlassen wurde.«
- Nicht: »Wir haben Zugriff auf jeden Pruefer-Bescheid.« (Privacy + Lizenz, siehe Frage 11.)
- Nicht: »Unser Korpus ist abgeschlossen.« (KB-Sprints sind kontinuierlich; Watch-Routinen monitoren neue Veroeffentlichungen.)
- Sondern: Drei Layer, 166 echte Rechtsquellen + 2 Praxis-Leitfäden mit Volltext, 1226 Wissensgraph-Knoten + 73 emergente Argumentations-Patterns aus 14 NotebookLM-Phasen, jede Quelle mit Provenance-Datum.
03Was, wenn der Pruefer eine andere Meinung hat?
Aufklappen
03
Tiefe
Diese Frage ist die politisch heikelste der fuenf. Hinter ihr stehen zwei verschiedene Skeptiker mit entgegengesetzter Sorge. Der Fachplaner fragt: »Was, wenn das Konzept mir den Pruefer aufdraengt, und ich verliere den Verhandlungs-Spielraum?« Der Pruefingenieur fragt: »Will mir dieses Tool meine hoheitliche Funktion abnehmen?« Wer beide Sorgen nicht gleichzeitig adressiert, hat den Raum verloren. Die Antwort muss klar machen: das Konzept ist Vorschlag, nicht Urteil; der Schatten-Dialog vorab heisst nicht Schatten-Dialog statt.
- PruefSV-Lifecycle-Trennung erklaertIm deutschen Recht gibt es zwei verschiedene Akteure: den PruefSV (ex-ante, hoheitlich, prueft im Genehmigungsverfahren) und den SV / Gutachter (ex-post, privatrechtlich, prueft bei Streit oder Schadensfall). Unser Schatten-Dialog simuliert den PruefSV-Angriff vorab — nicht um den echten PruefSV zu ersetzen, sondern um das Konzept so zu haerten, dass es den echten Termin ueberlebt.
- Final-Verdict-Stufen im TraceJeder Schatten-Dialog endet mit einem Verdict in drei Stufen: GENEHMIGUNGSFAEHIG / KONDITIONAL / ABLEHNUNG. Bei KONDITIONAL bleibt explizit ein Auflagen-Pfad offen — sichtbar im Audit-Trail mit den genauen Punkten, an denen der echte Pruefer noch nachhaken kann. → /platform/viewer#verdict
- Re-Submit-Pattern bei ❌-ungeklaertWenn der Schatten-Dialog einen Punkt als ❌ ungeklaert markiert (z.B. fehlender Nachweis fuer Hoersaal-2.RW), bleibt das im Trace stehen — nicht versteckt, nicht weggerundet. Der reale Pruefer bekommt damit ein Konzept inklusive der Stellen, an denen der Bauherr nachliefern muss. Das ist Verhandlungs-Vorteil fuer beide Seiten, nicht Bevormundung.
A — ehrlichUnser Konzept ist Vorschlag, nicht Urteil. Der Schatten-Pruefer vorab haertet das Konzept — der reale Pruefer entscheidet trotzdem. Das ist gewollt, nicht ein Nebeneffekt.
B — technischJedes Verdict hat drei moegliche Endzustaende: GENEHMIGUNGSFAEHIG, KONDITIONAL, ABLEHNUNG. Bei KONDITIONAL steht im Trace, welche Auflagen offen sind — das ist Vorlage fuer das echte Pruefer-Gespraech, nicht Ersatz.
C — defensivDie PruefSV-Rolle ist hoheitlich und kann nicht delegiert werden — das wissen wir, der Gesetzgeber weiss es, jeder Pruefer weiss es. Wir simulieren den Angriff vorab, damit der echte Termin nicht mit dem trivialen Einstieg startet. Mehr nicht.
- data/run-traces/*_trace.json — Verdict-Stufen + Auflagen-Pfade pro Run sichtbar
- scripts/run_pair_dialog.py — 5-Runden-Schatten-Dialog mit jurisdiction_addendum
- Memory
project_pruefsv_vs_sv_lifecycle.md— ex-ante/hoheitlich vs ex-post/privatrechtlich, Schema-Implikation v0.4.0 - ADR-0018 — Falsifizierbarkeit als Saeule vier (Schatten-Dialog muss Konzept auch ablehnen koennen, sonst ist er kein Pruefer)
- MY-MIND Manifest 2026 / These 07 — »Human + Agent« — *„Jeder Agent hat einen sauberen Vertrag: Scope, Mandat, Confidence-Schwelle, Audit-Pflicht"*. Der Schatten-Pruefer arbeitet, der echte Pruefer entscheidet.
- Nicht: »Unser Schatten-Pruefer ist so gut wie ein echter.«
- Nicht: »Wenn der Schatten-Pruefer GENEHMIGUNGSFAEHIG sagt, sagt der echte das auch.«
- Nicht: »Sie sparen sich den Pruefer-Termin.« (Der Termin ist gesetzlich, nicht optional.)
- Nicht: »Wir uebernehmen Pruefer-Verantwortung.« (Siehe Frage 06 zur Haftung.)
- Nicht: »Unser Pruefer kann Vor-Ort gehen, Bestand sichten, Rauchschutz-Tueren pruefen.« Plaene und Foto-Material sind Surrogate, nicht Ersatz. Sobald AR-Brillen alltagstauglich sind, schliesst sich diese Luecke — bis dahin bleibt sie offen.
- Sondern: Konzept ist gehaertet, Auflagen-Pfade sind dokumentiert, Verhandlung wird substantieller.
04Ist das nicht alles Black-Box?
Aufklappen
04
Tiefe
Diese Frage ist die methodische Kehrseite zu Frage 01. Halluzination ist was das Modell ausgibt; Black-Box ist wie es dorthin kommt. Der Skeptiker hat im Hinterkopf: »Wenn ich morgen denselben PDF reinwerfe, bekomme ich dann das gleiche Konzept?« Wer mit »ja, immer« antwortet, luegt — LLMs sind stochastisch. Wer mit »nein, nicht unbedingt« antwortet, hat verloren. Die einzige ehrliche Antwort: jeder Run ist reproduzierbar, weil Modell-ID, Slider-Werte und Prompt-Version gepinnt sind. Ceteris paribus, nicht magic.
- 7-Slider-Panel oeffnenSieben benannte Slider statt Temperatur-Magie:
argumentations_schaerfe,kompensations_stil,denkmal_strenge,nachweis_tiefe,risiko_akzeptanz,counter_example_pressure,precedent_anchoring. Pro Slider gibt es sieben Voreinstellungen (Variants A–F + Custom) indata/run-configs/variants.json. → /platform/generator - Variant-Hash am Run lesenJeder Run schreibt im Trace-Header:
model: claude-sonnet-4-6,prompt_version: v2026-05-06,variant: A,slider_hash: 9f3a1c. Wer denselben Hash morgen wieder fuettert, bekommt denselben Plan gerendert — das ist ceteris paribus, die methodische Grundlage fuer A/B-Vergleiche zwischen Konzept-Varianten. - Audit-Trail Schritt-fuer-Schritt durchklickenIm Viewer hat jede Section des Konzepts: Original-Prompt-Snippet, gezogene Korpus-Quellen (mit Datum), Konfidenz-Score, gefundene Citations, Hedges-Counter, Annahmen-Liste. Nichts ist hidden state. Wer den Trace nicht versteht, kann mich anrufen — aber er kann nicht behaupten, es waere nicht offen gelegt. → /platform/viewer
A — ehrlichBlack-Box ist Claude selbst — das stimmt. Unsere Pipeline drumherum ist es nicht: sieben benannte Slider, Modell-ID gepinnt, Prompt versioniert, Trace inspizierbar. Was reproduzierbar ist, ist nicht Black-Box.
B — technischJeder Run hat einen Variant-Hash. Mit demselben Hash bekommen Sie morgen dasselbe Konzept. Das ist ceteris paribus — die einzige Bedingung, unter der ein A/B-Vergleich zwischen zwei Brandschutz-Loesungen ueberhaupt etwas bedeutet.
C — defensivWir koennen Ihnen nicht zeigen, wie Claude intern Tokens waehlt. Aber wir koennen Ihnen jede Quelle zeigen, die reingegangen ist, jeden Slider, der gestellt war, und jede Aussage, die rauskam — mit ihrer Confidence. Das ist mehr Transparenz, als Sie heute von einem Lehrbuch-Autor bekommen.
- data/run-configs/variants.json — 7 Slider × 7 Variants als JSON
- scripts/run_pair_eval.py — Variant-Hash-Pinning + Reproduzierbarkeits-Lib
- scripts/build_run_trace.py — Trace-Format mit Header (model, prompt_version, slider_hash)
- ADR-0018 — Saeule vier: Falsifizierbarkeit nur unter ceteris paribus
- MY-MIND Manifest 2026 / These 06 + 08 — »Trust by design« + »Data = governance« — Reproduzierbarkeit ist die compilierbare Form von Trust. Was reproduzierbar ist, ist nicht Black-Box.
- Nicht: »Wir koennen Claude erklaeren.« (Niemand kann das vollstaendig.)
- Nicht: »Zwei Runs mit denselben Slidern sind bit-identisch.« (Stochastik bleibt — Konzept-Inhalt ist semantisch stabil, nicht textuell.)
- Nicht: »Sie muessen die sieben Slider verstehen, um das Tool zu nutzen.« (Default-Variant A ist productionsreif.)
- Sondern: Jeder Run hat einen Hash, jedes Konzept einen Trace, jede Aussage eine Quelle.
05Wie unterscheidet sich das von ChatGPT?
Aufklappen
05
Tiefe
Diese Frage hat einen versteckten Subtext: »Ich habe ChatGPT in der Kanzlei / im Buero fuer 20 Euro im Monat — warum brauche ich Sie?« Der Skeptiker testet, ob wir den Unterschied zwischen Modell und Pipelineverstehen. Wer hier antwortet »Unser Modell ist besser« hat verloren — weil ChatGPT (GPT-4o) und wir (Claude Sonnet 4.6) sich als Modelle nicht fundamental unterscheiden. Der Unterschied liegt woanders: ChatGPT ist ein Modell. Wir sind eine Pipeline mit Korpus, Schatten-Pruefer, Audit-Trail und Domain-Slidern. Modell ist eine Zutat. Konzept ohne Schatten-Dialog ist kein Konzept.
- Den Vergleich live machen lassenWerfen Sie dieselbe Brandschutz-Aufgabe in ChatGPT und in unsere Pipeline. ChatGPT liefert in ~10 Sekunden einen plausibel klingenden Text ohne Quellen. Wir liefern in ~3 Minuten ein Konzept mit Citation-Trail, Konfidenz-Score, Auflagen-Pfad und 5-Runden-Pruefer-Verdict. Beide nutzen ein LLM. Nur eines davon ist ein Konzept.
- Das Modell ist austauschbar — der Rest nichtWir nutzen heute
claude-sonnet-4-6+max_tokens 64000 streaming. Morgen koennte dasclaude-opus-5odergpt-5sein. Die Pipeline drumherum bleibt: Korpus, Schatten-Pruefer, Trace-Builder, Audit-Viewer. Niemand baut ChatGPT um. - Was ChatGPT strukturell nicht kannKorpus: ChatGPT hat keinen Wissensgraph mit 1213 Knoten und 8578 Kanten (166 echte Rechtsquellen + 2 Praxis-Leitfäden, davon 11 Brandschutz-Bundesverordnungen + 16 LBOs + 17 VV TB + 10 FeuVO + 58 Fachgesetze) ueber Mustervorschriften, vfdb-Leitfaden und Anbieter-Curricula. Schatten-Dialog: ChatGPT prueft sich nicht selbst gegen einen adversarial gestimmten PruefSV-Agent. Audit-Trail: ChatGPT-Output ist nicht reproduzierbar — keine Variant-Hashes, keine Citation-Stubs, keine Konfidenz-Heatmap. Das ist nicht Modell-Schwaeche. Das ist fehlende Pipeline.
A — ehrlichChatGPT ist ein Modell. Wir sind eine Pipeline. Konzept ohne Schatten-Dialog ist kein Konzept — egal, wie schoen der Text liest.
B — technischWir nutzen Claude Sonnet 4.6 als Inferenz-Engine, genauso wie Sie ChatGPT als Inferenz-Engine nutzen. Der Unterschied: drum herum ein kuratierter Korpus, ein Schatten-Pruefer-Layer und ein versionierter Audit-Trail. Der Wert liegt nicht im Modell, der Wert liegt im Drumherum.
C — defensivWenn jemand mit ChatGPT-Output zum Bauamt geht, wird das abgelehnt — nicht weil ChatGPT schlecht ist, sondern weil kein Pruefer einen Text ohne Quellen, Konfidenz und Reproduzierbarkeit als Konzept anerkennt. Unsere Pipeline schliesst genau diese Luecke.
- docs/architecture.md — 5-Layer-Pipeline (Ingestion / Generator / Dialog / Trace / Viewer)
- ADR-0018 — 4-Saeulen-Methodik als Trenn-Linie zu Lehrbuch-LLM
- data/training-pairs/ — Aufgabe-Loesung-Paerchen die ChatGPT strukturell nicht zieht
- Wissensgraph: 1213 Knoten, 8578 Kanten, 65 Prozent Baunetz-Sitemap-Coverage (Stand 2026-05-05)
- MY-MIND Manifest 2026 / These 02 + 04 — »Consulting with code« + »No new tool« — Modell ist Zutat, Pipeline ist Produkt. Und die Pipeline lebt dort, wo der Nutzer schon arbeitet (Teams).
- Nicht: »Unser Modell ist besser als GPT-4o.« (Modelle aendern sich quartalsweise — das ist nicht der Hebel.)
- Nicht: »ChatGPT ist nutzlos.« (ChatGPT ist gut fuer Erstrecherche, Brainstorming, Formulierungs-Hilfe.)
- Nicht: »Wir haben einen geheimen Prompt.« (Prompts sind im Repo versioniert. Der Hebel ist die Pipeline, nicht das Prompt.)
- Sondern: Modell ist Zutat. Pipeline ist Produkt. Konzept ohne Schatten-Dialog ist kein Konzept.
Die sieben, die zur Vollstaendigkeit gehoeren.
der
Redaktion
Wer es bis hierher gelesen hat, ist kein Skeptiker mehr. Trotzdem stehen die folgenden sieben Fragen vollstaendig — nicht jeder Pruefer, jeder Geschaeftsfuehrer, jede Anwaeltin teilt dieselben fuenf Top-Sorgen. Wer mit Haftung anfaengt, soll Haftung in voller Klarheit bekommen. Format: Angriffs-Frame knapp, ein Satz Architektur-Antwort, ein Backup-Link.
06Wer haftet, wenn das Konzept falsch ist?
Aufklappen
06
Der Skeptiker testet, ob wir hoheitliche Verantwortung ueberverkaufen. Im deutschen Recht haftet der unterschreibende Fachplaner / Pruefingenieur, nicht das Werkzeug, mit dem er arbeitet — das wissen Architektinnen, das wissen Anwaeltinnen, das wissen wir.
Das Konzept ist Vorschlag, der vom Fachplaner zu pruefen, zu ergaenzen, zu unterschreiben ist. Wir liefern Audit-Trail + Citation + Konfidenz — die Signatur bleibt bei der natuerlichen Person mit Berufshaftung. Das ist keine Schwaeche, das ist der einzig zulaessige Aufbau im Genehmigungs-Verfahren.
ADR-0014 + Memory project_anforderung_ablieferung_paar.md — Fachplaner-Signatur als Schema-Pflichtfeld.
07Wie aktuell sind Ihre Normen?
Aufklappen
07
Brandschutz-Normen aendern sich quartalsweise. Wer mit veralteten Mustervorschriften plant, baut Streitigkeiten fuer den naechsten Pruefer-Termin ein.
Jeder Knoten im Wissensgraph hat ein Provenance- Datum. Watch-Routinen (FeuerTrutz, baufachinformation) pruefen Quellen wochentlich auf Updates und triggern Re-Ingest. KB-Sprint-Update-Cadence: monatlich + ad-hoc bei Norm-Aenderungen.
CLAUDE.md / KB-Sprint-1-Tabelle · RoutineFeuerTrutz-Watch (woechentlich Montag).
08Koennen Sie das vor Gericht belegen?
Aufklappen
08
Bei einem Schadensfall steht der Sachverstaendige im Gerichts-Saal — und muss erklaeren, warum genau dieses Konzept genau diese Aussage getroffen hat.
Citation-Trail + Variant-Hash + Konfidenz-Stempel = gerichtsfeste Rekonstruktion. Jede Aussage hat einen Pfad zur Original-Quelle (PDF-Seite, Norm-Paragraph, Curriculum-Modul). Der Run laesst sich Jahre spaeter bit-aequivalent wieder rendern.
ADR-0018 / Saeule 1 (Citation-Trail-Determinismus) · data/run-traces/*_trace.json als Beweis-Format.
09Mit welchen Daten haben Sie trainiert?
Aufklappen
09
Der Skeptiker hat »trainieren« im Sinn von »Modell-Gewichte anpassen« — das ist rechtlich, lizenzrechtlich und reputational riskant.
Wir trainieren nichts. Claude Sonnet 4.6 ist Inferenz-Engine bei Anthropic. Unser Wertbeitrag ist RAG (Retrieval-Augmented Generation) ueber einen kuratierten, lizenz-sauberen Korpus + Prompt-Engineering + Schatten- Pruefer-Dialog. Kein Fine-Tuning, kein LoRA, keine Kunden-Daten zum Modell.
docs/architecture.md · Anthropic Data Processing Addendum (kein Training auf API-Inputs).
10Was, wenn Anthropic das Modell aendert?
Aufklappen
10
Sonnet 4.6 heute, 4.7 morgen, 5 uebermorgen. Aenderungen am Modell koennen Konzept-Output verschieben — wer re-prueft, sieht moeglicherweise andere Aussagen.
Variant-Hash pinnt Modell-ID, Prompt-Version, Slider-Werte. Bei Modell-Wechsel: Run bleibt rekonstruierbar gegen Pin. Vor Produktiv-Switch auf neues Modell durchlaeuft das Lab eine A/B-Validierung mit Variant F gegen 60 staged Records — semantische Drift wird messbar bevor sie produktiv wird.
ADR-0016 (Lab-/Prod-Trennung) · Schema v0.3.0 LabTestRun mit ceteris-paribus-Validator.
11Und DSGVO?
Aufklappen
11
Plaene enthalten projekt- und personenbezogene Daten (Bauherr, Architekt, Pruefer-Namen). Datenflug in die USA ist nicht verhandelbar.
Daten in westeurope (Azure-Region) gespeichert. Anthropic-API-Calls ueber EU-Endpoints. Pruefer-Identitaeten unterliegen der Public-Figure-Doctrine (oeffentlich-rechtliche Funktion = oeffentliche Information), private Personen werden vor Ingest anonymisiert. HARDCODED-Memory dokumentiert Daten-Ethik- Regeln.
Memory feedback_data_ethics_pruefer_identitaet.md · Bicep infra/main.bicep Location-Pin.
12Wie viel Zeit spare ich wirklich?
Aufklappen
12
Diese Frage haette als Eroeffnungs-Frage Marketing-Cliche ausgeloest. Als Frage 12 ist sie die ehrlichste — und gleichzeitig die falsch gestellte.
Die richtige Frage ist nicht „wie viel Zeit spare ich"— sondern „wie viele zusaetzliche Auftraege schaffe ich mit derselben Mannschaft". Ihre Engstelle ist nicht Geld, sondern Senior-Bandbreite. Wenn drei Seniors heute 60 Konzepte pro Jahr machen, koennen sie mit der Plattform 150 schaffen — gleiche Mannschaft, gleicher Stundensatz, andere Top-Line. Beschleunigung muss nach innen zur Volumen-Verdopplung werden, nicht nach aussen zur Preis-Reduktion. Stunden-Buchungen bleiben unveraendert, Margen und Auftragsvolumen wachsen.
Ehrliche Sub-Antwort fuer die urspruengliche Form der Frage: wir haben noch keine validierte Zahl. Die ersten fuenf End-to-End-Vergabe-Portal-Projekte laufen gerade. Sobald die durch sind, gibt es Streuungs-Werte (Konzept- Volume / Senior / Quartal), nicht Marketing-Mittelwerte. Wer eine Zahl jetzt gibt, hat sie geraten.
Memory project_business_model_frames_pricing_billing.md · project_e2e_vergabe_5_projekte.md · Manifest 2026 / These 09 (Speed) + 10 (We measure ROI)