WerkzeugkastenValidierungspaket (Entwurf)

Werkzeugkasten · Datenwerkstatt

Validierungspaket.

Grundlage für die Validierung der Datenwerkstatt im eigenen Qualitätsmanagementsystem: Zweck und Grenzen je Vorlage, Anforderungen mit Nachweis, Risikobewertung und Referenzdatensätze zum Nachrechnen.

Entwurf, fachliche Freigabe ausstehend. Anforderungen und Risikobewertung sind nach Fachliteratur und dem nachweisbaren Verhalten der Werkstatt formuliert; eine Durchsicht durch eine Fachperson aus Qualitätsmanagement oder Validierung steht aus. Das Paket ersetzt nicht die Validierung für den eigenen Einsatzzweck.

Vorgehen und Stand

Das Paket orientiert sich am risikobasierten Vorgehen für Software in Qualitätsprozessen (ISO/TR 80002-2:2017; FDA Guidance „Computer Software Assurance for Production and Quality System Software“). Hohe und mittlere Risiken sind mit skriptgestützten Prüfungen und Sollwerten belegt; die Prüfungen laufen automatisch und vergleichen gegen unabhängige Rechnungen (SciPy, scikit-learn, NumPy, pandas, NIST) und gegen Lösungen von Testdaten einer fremden Quelle (Blindtests).

Stand06.10.2026 20:51
Prüfsumme des geprüften Codes (SHA-256, Rechenkern und Datenwerkstatt)cae9689c7a085feb6d036988b873ec524f8126d5033876126b2df4b6a467dc9a
Anforderungen76, davon 76 am aktuellen Code belegt
Risiken57, Restrisiko nach Maßnahme höchstens „mittel“

Aufgaben beim Anwender: Installationsnachweis (eingesetzter Browser und Version der Seite, Prüfsumme oben), Funktionsnachweis mit den Referenzdatensätzen je Vorlage (erwartetes Ergebnis nachrechnen), Leistungsnachweis mit eigenen Daten im vorgesehenen Einsatz, eigene Risikobewertung des Einsatzzwecks, Freigabe nach eigenem Verfahren.

Bewertungsschlüssel: S = Schwere der Folge (1 gering bis 5 falsche Freigabe), W = Wahrscheinlichkeit (1 sehr selten bis 5 häufig) ohne bzw. mit Maßnahme; Restrisiko = S × W mit Maßnahme: bis 4 niedrig, 5 bis 9 mittel, ab 10 hoch. Status „belegt“: alle genannten Prüfreihen am aktuellen Code bestanden.

Gemeinsame Grundlage

Gemeinsame Grundlage aller Vorlagen: Einlesen, Datenprofil, Aufbereitung mit Protokoll, Pipeline, Bericht, Speichern und Laden.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
ALL-01Tabellen werden als CSV, TSV oder eingefügter Text gelesen; Trennzeichen, Dezimalzeichen, Kopfzeile und Einheitenzeile werden erkannt.dw_pokayoke · 06.10.2026 20:19
dw_blind · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt
ALL-02Spaltentypen (Zahl, Kategorie, Datum, Ja/Nein, Kennung, Text) werden bestimmt; Kennzahlen je Spalte stimmen mit pandas überein.dw_profil · 06.10.2026 20:18✓ belegt
ALL-03Datenfehler werden als Frage gemeldet, nie still verändert: leere und unlesbare Werte, gemischte Dezimalzeichen, Faktor-10-Fehler, Nachweisgrenzen, unmögliche negative Werte, ungültige und unplausible Daten, Duplikate, Summenzeilen, verrutschte Zeilen, Schreib- und Bedeutungsvarianten, breites Format.dw_aufbereitung · 06.10.2026 20:18
dw_blind · 06.10.2026 20:22
dw_blind2 · 06.10.2026 20:22
dw_blind3 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt
ALL-04Jede Aufbereitung wird mit Zeit, Bearbeiter, Befund, Entscheidung, Begründung und betroffenen Zeilen protokolliert; Rohdaten bleiben unverändert (ALCOA).dw_aufbereitung · 06.10.2026 20:18
dw_auf_browser · 06.10.2026 20:24
dw_bericht_a · 06.10.2026 20:36
dw_bericht_b · 06.10.2026 20:38
✓ belegt
ALL-05Riskante oder unzulässige Entscheidungen werden je Ziel gesperrt oder verlangen eine Begründung (Gatekeeper); eine Änderung, die das gewählte Ziel bricht, wird rückgefragt.dw_gate · 06.10.2026 20:18
dw_gate_browser · 06.10.2026 20:24
✓ belegt
ALL-06Die Pipeline prüft vor dem Rechnen Reihenfolge und Datenanforderungen jedes Bausteins (Datenverträge) und sperrt bei Verstößen.dw_pipeline · 06.10.2026 20:18
dw_pipeline_browser · 06.10.2026 20:24
✓ belegt
ALL-07Ein Prüfpunkt vor dem Rechnen fasst ausgelassene Werte, riskante Entscheidungen und belassene Extremwerte zusammen; Risiken müssen bestätigt werden.dw_gate_browser · 06.10.2026 20:24✓ belegt
ALL-08Mehrere Tabellen werden über Schlüssel, Angleichung oder Zeitbezug verbunden, ohne Zeilen zu vermehren; die Zuordnung stimmt mit pandas merge und merge_asof überein.dw_modell · 06.10.2026 20:18
dw_modell_browser · 06.10.2026 20:25
✓ belegt
ALL-09Abgeleitete Spalten werden nur mit festen Rechenarten ohne Zukunftswissen berechnet und stimmen mit pandas überein; Zirkelschlüsse werden gesperrt.dw_abgeleitet · 06.10.2026 20:18
dw_abgeleitet_browser · 06.10.2026 20:25
✓ belegt
ALL-10Der Bericht enthält die Pflichtabschnitte, nennt das Kriterium vor dem Ergebnis, das vollständige Protokoll, die Grenzen und ein leeres Freigabefeld; der Druck enthält keine Bedienelemente.dw_bericht_a · 06.10.2026 20:36
dw_bericht_b · 06.10.2026 20:38
✓ belegt
ALL-11Eine Pipeline wird mit Prüfsumme (SHA-256) gespeichert; beim Laden werden Format, Version, Prüfsumme und Inhalt streng geprüft; gleiche Daten ergeben gleiche Ergebnisse.dw_speichern · 06.10.2026 20:25✓ belegt
ALL-12Die Voranalyse empfiehlt passende Vorlagen mit Begründung und erkennt Fälle ohne passendes Verfahren (Lebensdauer, zerstörende Prüfung).dw_voranalyse · 06.10.2026 20:18
dw_voranalyse_browser · 06.10.2026 20:25
dw_blind2 · 06.10.2026 20:22
✓ belegt
ALL-13Die Oberfläche ist am Desktop und mobil ohne Überbreite und ohne Skriptfehler bedienbar.dw_analyse_browser · 06.10.2026 20:33
mobil · 06.10.2026 20:39
ueberlauf · 06.10.2026 20:40
✓ belegt
ALL-14Spaltenrollen werden aus Struktur und Namen erkannt und je Rolle als sicher, bitte prüfen oder fehlt gezeigt; eine falsche Zuordnung erscheint nie als sicher (85 Szenarien der Runde 5).dw_blind5_zuordnung · 06.10.2026 20:23
dw_voranalyse · 06.10.2026 20:18
✓ belegt
ALL-15Schreib- und Aufbauvarianten (Synonyme, Tippfehler, Dezimalkomma, Einheiten, Info-, Einheiten- und Summenzeilen, Spaltenreihenfolge, Trennzeichen) ändern weder Zuordnung noch Ergebnis (Daten-Fuzzer, 300 Varianten).dw_fuzz · 06.10.2026 20:24✓ belegt
ALL-16Die fachlichen Sollwerte der Blindtest-Runde 5 werden getroffen; Abweichungen von Lösungen sind unabhängig nachgerechnet und begründet.dw_blind5 · 06.10.2026 20:23✓ belegt
ALL-17Fachliche Weggabelungen, die die Daten nicht verraten (zerstörende Prüfung, gleiche Teile vorher und nachher, Bedeutung von „Censored“), werden als Frage gestellt und im Bericht festgehalten.dw_wirksam_browser · 06.10.2026 20:26
dw_paketB_browser · 06.10.2026 20:27
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RG-01Zahl falsch gelesen (Dezimalzeichen, Einheit in der Zelle, Faktor 10)plausible, aber falsche Kennzahlen54Erkennung gemischter Dezimalzeichen und Faktor-Fehler mit Rückfrage; Einheiten werden abgetrennt; Profil zeigt Ausreißer15 (mittel)ALL-01, ALL-03
RG-02Datenfehler still übernommen (Duplikat, Summenzeile, verrutschte Zeile, Tippfehler in Kategorien)verzerrte Gruppen oder Kennzahlen44Jeder Befund wird als Frage gestellt; Anwenden erst nach Entscheidung aller Fragen14 (niedrig)ALL-03
RG-03Aufbereitung nicht nachvollziehbarAudit-Feststellung, Ergebnis nicht reproduzierbar43Protokoll nach ALCOA mit Begründung; Rohdaten unverändert; Protokoll im Bericht und als CSV14 (niedrig)ALL-04
RG-04Riskante Bereinigung beschönigt das Ergebnis (Ausreißer gelöscht, Median eingesetzt)zu gute Fähigkeit oder Messsystem53Gatekeeper: Sperre oder Begründungspflicht je Ziel; Prüfpunkt vor dem Rechnen mit Bestätigung15 (mittel)ALL-05, ALL-07
RG-05Falsche Vorlage oder Rolle gewählt (falsche Zielgröße, Phasenspalte, Reihenfolge)Analyse beantwortet eine andere Frage43Voranalyse mit Begründung; Datenverträge und Zuordnungsprüfung sperren unpassende Ketten; Bericht nennt Vorlage und Zuordnung28 (mittel)ALL-06, ALL-12
RG-09Falsche Spaltenrolle als sicher angezeigtAnwender prüft nicht, Analyse beantwortet eine andere Frage53Erkennung mit drei Stufen; Rückfall auf bisherigen Vorschlag nur als „bitte prüfen“; Fuzzer und Runde 5 prüfen „nie falsch und sicher“15 (mittel)ALL-14, ALL-15
RG-10Ergebnis hängt von Schreibweise oder Dateiaufbau abgleiche Daten, verschiedene Ergebnisse43Ergebnis-Invarianz im Fuzzer (300 Varianten mit festem Startwert, Erkundung mit neuem Startwert)14 (niedrig)ALL-15
RG-11Urteil hängt vom gewählten Verteilungsmodell abNachweis im Audit angreifbar43Toleranzintervall rechnet Normal- und Lognormal-Modell und meldet Widersprüche als „nicht sicher erbracht“28 (mittel)ALL-16
RG-06Tabellen falsch verbunden (falscher Schlüssel, Zeilenvermehrung, Zukunftswissen)Scheinzusammenhänge43Vorschau mit Trefferquote; Sperre unter 30 % und bei nicht eindeutigen Schlüsseln; keine Vermehrung; Zeitbezug nur rückwärts14 (niedrig)ALL-08
RG-07Ergebnis nicht wiederholbar (andere Pipeline, veränderte Datei)Validierung nicht übertragbar42Versionierte Pipeline mit SHA-256; strenge Prüfung beim Laden; Wiederholbarkeit geprüft14 (niedrig)ALL-11
RG-08Bericht unvollständig oder Kriterium nachträglich gewähltFreigabe auf unvollständiger Grundlage52Pflichtabschnitte, Kriterium vor Ergebnis, Status „Entwurf“, leeres Freigabefeld15 (mittel)ALL-10, WIR-01

Messsystemanalyse Verfahren 2

Zweck: Eignung eines messenden Prüfmittels mit mehreren Prüfern (gekreuzter Versuch: alle Prüfer messen dieselben Teile mehrfach).

Nicht vorgesehen für: zerstörende Prüfung (verschachteltes Modell nötig; die Werkstatt gibt einen Hinweis); Verfahren 1 (Messmittelfähigkeit Cg/Cgk) und Verfahren 3 (ohne Prüfereinfluss) als eigene Vorlage; attributive Prüfung (dafür „Prüferübereinstimmung Sichtprüfung“).

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
MSA-01Der Versuchsplan wird geprüft (mindestens 5 Teile, 2 Prüfer, Wiederholungen); unvollständige Teile werden ausgelassen und genannt.dw_rechnen · 06.10.2026 20:18
dw_blind2 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt
MSA-02%GRR, Anteile und ndc nach Varianzanalyse; Wechselwirkung bei p > 0,05 zusammengelegt; Werte stimmen mit der unabhängigen Rechnung überein.dw_rechnen · 06.10.2026 20:18
verifikation_scipy · 06.10.2026 20:21
dw_blind4 · 06.10.2026 20:22
✓ belegt
MSA-03Mittelwert je Prüfer und größte Abweichung werden ausgewiesen.dw_blind3 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt
MSA-04Urteil gegen die Kriterien 10 % und 30 % (Gesamtstreuung oder Toleranz).dw_rechnen · 06.10.2026 20:18✓ belegt
MSA-05Hinweis bei vermutlich zerstörender Prüfung.dw_blind2 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RM-01Formelfehler in der Varianzanalysefalsches Urteil über das Messsystem52Abgleich mit unabhängiger Rechnung und Blindtests15 (mittel)MSA-02
RM-02Unvollständiger Plan verzerrt die Varianzanteilefalsches Urteil43unvollständige Teile ausgelassen und genannt14 (niedrig)MSA-01
RM-03Zerstörende Prüfung mit gekreuztem Modell ausgewertetMessstreuung überschätzt33Hinweis bei zerstörender Messgröße oder Probenspalte; Grenze im Zweck genannt26 (mittel)MSA-05

Referenzdatensatz zum Nachrechnen (OQ)

referenz_msa2.csv · Quelle: Blindtest Szenario 29 · belegt durch Prüfreihe dw_blind4

Ablauf: Datei in der Datenwerkstatt laden, bei allen 2 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Messsystemanalyse Verfahren 2“, Zuordnung: messwert: F_max_N · teil: Faden_ID · pruefer: Pruefer. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Versuchsplan prüfen (Messsystem)10 Teile × 3 Prüfer × 3 ausgewertetTeile: 10
Prüfer: 3
Wiederholungen je Teil und Prüfer: 3
Verfahren 2 (Varianzanalyse)%GRR bezogen auf die Gesamtstreuung 58,2 % (> 30 %)%GRR bezogen auf die Gesamtstreuung: 58,2 %
unterscheidbare Klassen (ndc): 1
Wechselwirkung Teil × Prüfer: nicht signifikant, zusammengelegt
Mittelwert je Prüfer: Schmidt: 44,7900 · Klein: 46,5667 · Müller: 45,0867
größte Abweichung eines Prüfers: Klein: +1,0856 (Prüfer unterscheiden sich, p 0,030; Einweisung oder Messmethode prüfen)

Prozessfähigkeit in der Serie

Zweck: Fähigkeit eines zeitlich geordneten Serienmerkmals gegen ein- oder zweiseitige Toleranz.

Nicht vorgesehen für: Erstmusterfreigabe mit sehr wenigen Teilen (Kennzahlen werden mit Untergrenze und Hinweis ausgewiesen); Lebensdauer- und zensierte Daten (gesperrt); mehrere Merkmale gleichzeitig.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
CAP-01Cp, Cpk, Pp, Ppk mit 95-%-Untergrenze nach Bissell; Werte gegen Formeln und SciPy geprüft.dw_rechnen · 06.10.2026 20:18
verifikation_formeln · 06.10.2026 20:21
✓ belegt
CAP-02Stabilität wird vorher geprüft; bei Instabilität ist die Fähigkeit nicht belegt.dw_rechnen · 06.10.2026 20:18
dw_blind · 06.10.2026 20:22
✓ belegt
CAP-03Bei deutlich schiefen Daten Perzentil-Methode (ISO 22514-2) mit Verteilungsauswahl; Quantile und Anpassung gegen SciPy.dw_nnf · 06.10.2026 20:19
dw_nnf_browser · 06.10.2026 20:27
dw_blind2 · 06.10.2026 20:22
✓ belegt
CAP-04Einseitige Toleranz ist möglich; untere ≥ obere Grenze wird gesperrt.dw_nnf_browser · 06.10.2026 20:27
dw_blind2 · 06.10.2026 20:22
✓ belegt
CAP-05Zeitliche Abhängigkeit, Zyklus und Drift werden erkannt und benannt.dw_blind2 · 06.10.2026 20:22
dw_blind3 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RC-01Normalverteilung unterstellt bei schiefen DatenFähigkeit zu gut oder zu schlecht53Perzentil-Methode mit Verteilungsauswahl; „beste Näherung“ nie grün15 (mittel)CAP-03
RC-02Fähigkeit trotz instabilem Prozess bescheinigtfalsche Freigabe53Stabilitätsprüfung vorgeschaltet; Urteil „nicht belegt“15 (mittel)CAP-02
RC-03Drift oder Zyklus übersehenFähigkeit nur scheinbar43Erkennung von Zeitbezug, Zyklus und Drift14 (niedrig)CAP-05
RC-04Zu wenige Werteunsichere Kennzahl3395-%-Untergrenze nach Bissell, Hinweis26 (mittel)CAP-01

Referenzdatensatz zum Nachrechnen (OQ)

referenz_serie.csv · Quelle: Beispiel Spritzguss der Werkstatt · belegt durch Prüfreihe dw_rechnen

Ablauf: Datei in der Datenwerkstatt laden, bei allen 6 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Prozessfähigkeit in der Serie“, Zuordnung: messwert: Wandstärke [mm] · zeit: Zeitstempel · usg: 1,17 · osg: 1,23. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Zeitfolge prüfenWerte geordnetReihenfolge: sortiert nach „Zeitstempel“
Zeilen: 240
Verteilung prüfenkeine Abweichung von der Normalverteilung erkennbarWerte: 240
Anderson-Darling A²: 0,520
p-Wert: 0,185
Stabilität (Regelkarte)45 Signale für besondere UrsachenWerte: 240
Signale: 45
Mittellinie: 1,2020
Eingriffsgrenzen: 1,1804 bis 1,2236
Fähigkeit (Cp, Cpk, Pp, Ppk)Kriterium Cpk ≥ 1,33 nicht erfülltCp: 1,39
Cpk: 1,30 (95-%-Untergrenze 1,18)
Pp: 1,08
Ppk: 1,01
Werte: 240

Stabilität überwachen

Zweck: Prüfung eines zeitlich geordneten Merkmals auf besondere Ursachen (Signale, Sprünge, Drift).

Nicht vorgesehen für: Regelkarten für Zähldaten (p-, np-, c-, u-Karte); Zeitreihenzerlegung bei Zyklen (die Werkstatt meldet „nicht beurteilbar“).

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
STA-01Regelkarte für Einzelwerte mit Signalregeln; Grenzen gegen Formeln geprüft.dw_rechnen · 06.10.2026 20:18
verifikation_formeln · 06.10.2026 20:21
✓ belegt
STA-02Änderungspunkte (binäre Segmentierung) stimmen mit der Python-Umsetzung überein; keine Fehlalarme bei Reihen ohne Sprung.dw_aenderung · 06.10.2026 20:18✓ belegt
STA-03Drift mit Bruchstelle wird erkannt; Zyklen und echte Sprünge werden unterschieden (Gegenproben).dw_blind3 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt
STA-04Bei schiefen Daten Grenzen aus der angepassten Verteilung.dw_nnf · 06.10.2026 20:19
dw_nnf_browser · 06.10.2026 20:27
✓ belegt
STA-05Ereignisse aus verbundenen Tabellen (Wechsel, Wartung) werden neben Änderungspunkten gezeigt.dw_aenderung · 06.10.2026 20:18
dw_wirksam_browser · 06.10.2026 20:26
✓ belegt
STA-06Bei Zyklen wird zerlegt (Trend, Muster, Rest); Zerlegung stimmt mit NumPy überein; Szenario 7 ergibt Periode 24 h und Trend +0,005 °C/h; der Rest wird geprüft.dw_zerlegung · 06.10.2026 20:21
dw_paketC_browser · 06.10.2026 20:28
dw_blind2 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RS-01Fehlalarme durch Zyklus oder Schiefeunnötige Eingriffe34Zerlegung bei Zyklen (Rest wird geprüft); Verteilungsgrenzen bei Schiefe13 (niedrig)STA-03, STA-04, STA-06
RS-03Trend im Tagesgang übersehenschleichender Ausfall (etwa Klimaanlage)43Trend aus der Zerlegung mit p-Wert, als besondere Ursache gemeldet14 (niedrig)STA-06
RS-02Sprung übersehenProzessänderung unbemerkt42binäre Segmentierung, gegen Python und Gegenproben geprüft14 (niedrig)STA-02

Referenzdatensatz zum Nachrechnen (OQ)

referenz_stabil.tsv · Quelle: Blindtest Szenario 28 · belegt durch Prüfreihe dw_blind4

Ablauf: Datei in der Datenwerkstatt laden, bei allen 3 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Stabilität überwachen“, Zuordnung: messwert: Schichtdicke_um · zeit: Datum_Zeit. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Zeitfolge prüfenWerte geordnetReihenfolge: sortiert nach „Datum_Zeit“
Zeilen: 350
Stabilität (Regelkarte)732 Signale für besondere UrsachenWerte: 349
ausgelassen (leer oder keine Zahl): 1
Signale: 732
Mittellinie: 14,5089
Eingriffsgrenzen: 13,8527 bis 15,1650
Änderungspunkte1 Änderungspunkt gefunden; bitte mit Ereignissen abgleichen (Wechsel, Wartung)2026-12-10 08:00: 15,0403 → 13,8039 (Sprung -1,2364, p < 0,001)

Wirksamkeit einer Maßnahme (vorher – nachher)

Zweck: Nachweis, dass eine Maßnahme (etwa CAPA) gewirkt hat, gegen ein vorab festgelegtes Kriterium.

Nicht vorgesehen für: gepaarte Messungen an denselben Teilen (gepaarter Test nicht vorgesehen); mehr als zwei Phasen.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
WIR-01Ohne vorab festgelegtes Kriterium ist das Rechnen gesperrt.dw_wirksam_browser · 06.10.2026 20:26✓ belegt
WIR-02Welch-Test, Brown-Forsythe-Test und Ppk vorher/nachher stimmen mit SciPy überein.dw_aenderung · 06.10.2026 20:18✓ belegt
WIR-03Trennung über Phasenspalte oder Zeitpunkt; ungeeignete Phasenspalten und ungültige Zeitpunkte werden gemeldet.dw_wirksam_browser · 06.10.2026 20:26✓ belegt
WIR-04Ergebnisse der Blindtests entsprechen den Lösungen.dw_blind · 06.10.2026 20:22
dw_blind3 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RW-01Kriterium nach dem Ergebnis gewähltWirksamkeit nur scheinbar belegt53Rechnen erst nach Festlegung; Kriterium im Bericht vor dem Ergebnis15 (mittel)WIR-01
RW-02Phasen falsch getrenntfalsche Gruppen42Prüfung der Phasenspalte und des Zeitpunkts14 (niedrig)WIR-03

Referenzdatensatz zum Nachrechnen (OQ)

referenz_wirksam.tsv · Quelle: Blindtest Szenario 35 · belegt durch Prüfreihe dw_blind4

Ablauf: Datei in der Datenwerkstatt laden, bei allen 2 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Wirksamkeit einer Maßnahme“, Zuordnung: messwert: Ausschuss_% · phase: Phase · kriterium: kleiner. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Vorher und nachher trennen35 Werte vorher, 23 nachherVor Training: 35 Werte
Nach Training: 23 Werte
Wirksamkeit prüfenKriterium erfüllt: Die Maßnahme ist nach dem vorab festgelegten Kriterium wirksamMittelwert vorher → nachher: 8,2371 → 3,1565 (Welch p < 0,001)
Standardabweichung vorher → nachher: 2,0196 → 0,9890 (Brown-Forsythe p 0,005)

Prüferübereinstimmung Sichtprüfung

Zweck: Bewertung attributiver Prüfer (Gut/Schlecht) untereinander, mit sich selbst und gegen eine Referenz.

Nicht vorgesehen für: mehr als zwei Kategorien (ordinale Bewertungen); Stichprobenpläne.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
ATT-01Fleiss’ und Cohens Kappa, Übersehen- und Fehlalarmrate je Prüfer; Werte gegen die unabhängige Rechnung geprüft.dw_rechnen · 06.10.2026 20:18✓ belegt
ATT-02Gemischte Bezeichnungen (OK, Pass, 1, Dicht …) werden vereinheitlicht, die Bedeutung von 0/1 wird geschätzt und offen gezeigt; breites Format wird umgewandelt.dw_aufbereitung · 06.10.2026 20:18
dw_blind · 06.10.2026 20:22
dw_blind3 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt
ATT-03Der schwächste Prüfer der Blindtests wird erkannt.dw_blind · 06.10.2026 20:22
dw_blind3 · 06.10.2026 20:22
dw_blind4 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RA-01Bezeichnungen falsch zugeordnet (0/1, Pass/Fail)Prüfer falsch bewertet43Vereinheitlichung als Frage mit Anzeige der Zuordnung; Bedeutung von 0/1 über die Referenzspalte geschätzt, umkehrbar14 (niedrig)ATT-02
RA-02Nur ein Durchgang: Wiederholbarkeit nicht bewertbarunvollständige Bewertung23ausdrücklicher Hinweis „nur ein Durchgang“24 (niedrig)ATT-01

Referenzdatensatz zum Nachrechnen (OQ)

referenz_sicht.tsv · Quelle: Blindtest Szenario 31 · belegt durch Prüfreihe dw_blind4

Ablauf: Datei in der Datenwerkstatt laden, bei allen 2 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Prüferübereinstimmung Sichtprüfung“, Zuordnung: urteil: Urteil · teil: Blister_ID · pruefer: Prüfer · referenz: Master. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Versuchsplan prüfen (Gut/Schlecht)40 Teile × 3 Prüfer × 1 ausgewertetTeile: 40
Prüfer: 3
Wiederholungen je Teil und Prüfer: 1
Übereinstimmung (Kappa)mäßige ÜbereinstimmungFleiss’ Kappa zwischen allen Prüfern: 0,48 (95 %: 0,28 bis 0,68)
Prüfer Anna mit sich selbst: nur ein Durchgang
Prüfer Bernd mit sich selbst: nur ein Durchgang
Prüfer Clara mit sich selbst: nur ein Durchgang
Abgleich mit ReferenzMindestens ein Prüfer übersieht zu viele fehlerhafte TeilePrüfer Anna: übersehen 0 %, Fehlalarm 8 %, Kappa zur Referenz 0,89 (95 %: 0,73 bis 1,00)
Prüfer Bernd: übersehen 0 %, Fehlalarm 4 %, Kappa zur Referenz 0,95 (95 %: 0,81 bis 1,00)
Prüfer Clara: übersehen 71 %, Fehlalarm 0 %, Kappa zur Referenz 0,34 (95 %: 0,09 bis 0,63)

Schichten, Maschinen oder Chargen vergleichen

Zweck: Unterschiede in Lage und Streuung zwischen Gruppen.

Nicht vorgesehen für: verschachtelte oder mehrfaktorielle Pläne (dafür Kombinationsspalte oder Versuchsplan).

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
GRP-01Varianzanalyse, Games-Howell-Paarvergleich und Brown-Forsythe-Test stimmen mit SciPy überein.dw_rechnen · 06.10.2026 20:18
verifikation_scipy · 06.10.2026 20:21
✓ belegt
GRP-02Gruppen mit gleicher Bedeutung (Abkürzungen, Tippfehler) werden vor dem Vergleich zusammengeführt.dw_blind2 · 06.10.2026 20:22
dw_blind3 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RV-01Gleiche Gruppe unter mehreren NamenScheinunterschiede33Varianten- und Abkürzungserkennung13 (niedrig)GRP-02
RV-02Streuungsunterschied übersehenfalsche Gruppe bevorzugt32Brown-Forsythe-Test13 (niedrig)GRP-01

Referenzdatensatz zum Nachrechnen (OQ)

referenz_vergleich.csv · Quelle: Blindtest Szenario 11 · belegt durch Prüfreihe dw_blind2

Ablauf: Datei in der Datenwerkstatt laden, bei allen 4 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Schichten, Maschinen oder Chargen vergleichen“, Zuordnung: messwert: Mass_mm · gruppe: Maschine. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Verteilung prüfenkeine Abweichung von der Normalverteilung erkennbarWerte: 179
ausgelassen (leer oder keine Zahl): 1
Anderson-Darling A²: 0,632
p-Wert: 0,098
Gruppen vergleichenmindestens zwei Gruppen unterscheiden sich; die Streuung unterscheidet sich, am größten bei M3Gruppen: 3
Mittelwert je Gruppe: M1: 5,0066 (n = 59) · M2: 4,9674 (n = 60) · M3: 5,0018 (n = 60)
p-Wert (Varianzanalyse): 0,006
unterscheiden sich: M1 und M2
Streuung je Gruppe: M1: 0,0427 · M2: 0,0709 · M3: 0,0925

Ursachen eingrenzen

Zweck: Kandidaten für Einflussgrößen einer Zielgröße aus Bestandsdaten, als Grundlage für einen Versuch; kein Ursachenbeweis.

Nicht vorgesehen für: Ursachennachweis (dafür Versuchsplan); Vorhersage im Einsatz (kein freigegebenes Prognosemodell).

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
TRB-01Kreuzvalidierte Güte mit Bootstrap-Vertrauensbereich; Urteil „nicht sicher besser als Raten“, wo zutreffend.dw_treiber · 06.10.2026 20:18
dw_perm · 06.10.2026 20:19
✓ belegt
TRB-02Permutationswichtigkeit (Kategorien als Ganzes) stimmt in Rangfolge und Toleranz mit scikit-learn überein.dw_perm · 06.10.2026 20:19✓ belegt
TRB-03Abhängigkeitskurven und Schwellen stimmen mit scikit-learn überein; bekannte Schwellen werden gefunden.dw_pd · 06.10.2026 20:19✓ belegt
TRB-04Auffällige Zeilen werden nachgezählt; bekannte Ursachen der Blindtests werden benannt.dw_auffaellig · 06.10.2026 20:19
dw_blind4 · 06.10.2026 20:22
✓ belegt
TRB-05Zirkelschluss und stark zusammenhängende Einflussgrößen werden gesperrt bzw. gewarnt.dw_abgeleitet_browser · 06.10.2026 20:25
dw_blind2 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RU-01Zusammenhang als Ursache gelesenfalsche Maßnahme44„Kandidaten, kein Beweis“; Screening-Plan als nächster Schritt28 (mittel)TRB-01
RU-02Überangepasstes Modell bei wenigen DatenScheinkandidaten43Kreuzvalidierung, Vertrauensbereich, „nicht sicher von null verschieden“14 (niedrig)TRB-01, TRB-02
RU-03Zirkelschluss oder stark zusammenhängende Einflussgrößenfalsche Rangfolge33Sperre bzw. Warnung13 (niedrig)TRB-05

Referenzdatensatz zum Nachrechnen (OQ)

referenz_ursache.csv · Quelle: Beispiel Spritzguss der Werkstatt · belegt durch Prüfreihe dw_perm

Ablauf: Datei in der Datenwerkstatt laden, bei allen 6 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Ursachen eingrenzen“, Zuordnung: ziel: Wandstärke [mm] · einfluss: Werkzeugtemperatur [°C], Einspritzdruck [bar], Zykluszeit [s], Schicht, Maschine, Charge. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Kategorien kodieren (One-Hot)6 Merkmale → 12 Rechenspaltenvollständige Zeilen: 235 (5 mit Lücken ausgelassen)
Spalten nach dem Kodieren: 12
Kreuzvalidierung einrichten5-fache Kreuzvalidierung auf 235 ZeilenZeilen: 235
Falten: 5 (zufällig, fester Startwert)
Art: Regression (Zahl)
Random ForestDas Modell erklärt einen Teil der ZielgrößeR² (vorhergesagt aus unbekannten Daten): 0,43 (95 %: 0,32 bis 0,53)
zum Vergleich: Raten: 0,00
Bäume: 100
Einflussgrößen (Wichtigkeit)wichtigste Einflussgröße: ChargeCharge: R² sinkt um 0,655 (± 0,102)
Werkzeugtemperatur [°C]: R² sinkt um 0,296 (± 0,041)
Einspritzdruck [bar]: R² sinkt um 0,035 (± 0,020) · nicht sicher von null verschieden
Schicht: R² sinkt um 0,020 (± 0,005)
Zykluszeit [s]: R² sinkt um -0,001 (± 0,017) · nicht sicher von null verschieden

Datenüberblick

Zweck: Korrelationen, Hauptkomponenten und natürliche Gruppen als erster Überblick.

Nicht vorgesehen für: Entscheidungen über Produkte oder Prozesse allein auf Grundlage gefundener Gruppen.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
MUS-01Korrelation, Hauptkomponenten, k-Means und Silhouette stimmen mit scikit-learn und NumPy überein.dw_muster · 06.10.2026 20:18✓ belegt
MUS-02Gruppenzahl bei kleinen Daten begrenzt (höchstens eine Gruppe je 5 Zeilen).dw_blind2 · 06.10.2026 20:22✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RÜ-01Gruppen bei kleinen Daten überinterpretiertScheinstruktur23Begrenzung der Gruppenzahl, Silhouette12 (niedrig)MUS-02

Referenzdatensatz zum Nachrechnen (OQ)

referenz_ueberblick.csv · Quelle: Beispiel Spritzguss der Werkstatt · belegt durch Prüfreihe dw_muster

Ablauf: Datei in der Datenwerkstatt laden, bei allen 6 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Datenüberblick“, Zuordnung: merkmale: Werkzeugtemperatur [°C], Einspritzdruck [bar], Zykluszeit [s], Wandstärke [mm]. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Korrelationenschwacher, aber belegter Zusammenhang: Werkzeugtemperatur [°C] und Wandstärke [mm] (r = 0,48, p < 0,001)Werkzeugtemperatur [°C] · Wandstärke [mm]: r = 0,48 (p < 0,001) · Spearman ρ = 0,47
Zykluszeit [s] · Wandstärke [mm]: r = -0,16 (p 0,016) · Spearman ρ = -0,15
Werkzeugtemperatur [°C] · Einspritzdruck [bar]: r = -0,11 (p 0,097) · Spearman ρ = -0,12
Kategorien kodieren (One-Hot)4 Merkmale → 4 Rechenspaltenvollständige Zeilen: 235 (5 mit Lücken ausgelassen)
Spalten nach dem Kodieren: 4
Skalieren (z-Werte)alle Größen auf Mittelwert 0 und Streuung 1skalierte Spalten: 4
Hauptkomponenten (PCA)Zwei Achsen zeigen 64 % der StreuungAchse 1 erklärt: 38,9 %
Achse 2 erklärt: 25,4 %
Achse 1 geprägt von: Wandstärke [mm] (0,67), Werkzeugtemperatur [°C] (0,66), Zykluszeit [s] (-0,30)
Clustering (k-Means)keine klare GruppenstrukturGruppen: 2
Silhouette: 0,23
Größen: 130 · 105
geprüft: k = 2: 0,23, k = 3: 0,20, k = 4: 0,20, k = 5: 0,19, k = 6: 0,20

Wirkungsfläche auswerten (Optimum)

Zweck: Optimum der wichtigsten 2 bis 5 Faktoren aus zentral zusammengesetzten oder Box-Behnken-Plänen mit quadratischem Modell.

Nicht vorgesehen für: mehrere Zielgrößen gleichzeitig; Mischungspläne; Optimierung außerhalb des Versuchsraums.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
FLA-01Pläne (CCD flächenzentriert/drehbar, Box-Behnken) haben die richtige Laufzahl, den richtigen Sternpunktabstand und sind ausgewogen.dw_flaeche · 06.10.2026 20:21✓ belegt
FLA-02Koeffizienten, p-Werte, fehlende Anpassung, stationärer Punkt, Eigenwerte und Optimum stimmen mit NumPy/SciPy überein; bekanntes Optimum wird gefunden.dw_flaeche · 06.10.2026 20:21
dw_paketC_browser · 06.10.2026 20:28
✓ belegt
FLA-03Rundreise Plan → CSV → Auswertung; ungültige Stufen, zu wenige Läufe und ungültiges Ziel werden gesperrt; Optimum am Rand wird gemeldet.dw_paketC_browser · 06.10.2026 20:28
dw_pipeline · 06.10.2026 20:18
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RF-01Optimum außerhalb des Versuchsraums übernommenProzess außerhalb des Bekannten43Optimum nur im Versuchsraum, Warnung am Rand, Hinweis auf Bestätigungsläufe14 (niedrig)FLA-03
RF-02Quadratisches Modell passt nichtfalsches Optimum43Test auf fehlende Anpassung mit Warnung14 (niedrig)FLA-02
RF-03Sternpunkte nicht fahrbarPlan nicht umsetzbar23Hinweis beim drehbaren Plan12 (niedrig)FLA-01

Referenzdatensatz zum Nachrechnen (OQ)

referenz_flaeche.csv · Quelle: Blindtest flaeche · belegt durch Prüfreihe dw_flaeche

Ablauf: Datei in der Datenwerkstatt laden, bei allen 0 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Wirkungsfläche auswerten (Optimum)“, Zuordnung: faktoren: Temp, Zeit · ziel: Kraft_N · zielart: max. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Wirkungsfläche (quadratisches Modell)Optimum bei Temp 167,4109, Zeit 3,6622: 21,132Läufe: 13
Bestimmtheitsmaß R² (bereinigt): 1,000 (0,999)
Gesamttest des Modells: p < 0,001
fehlende Anpassung: p 0,024
Temp: +1,9604 (p < 0,001) · belegt

Messsystemanalyse bei zerstörender Prüfung

Zweck: Eignung eines Messsystems, wenn jede Probe nur einmal gemessen werden kann (Zug, Schälkraft, Berstdruck, Siegelnaht): verschachteltes Modell mit Chargen statt Teilen.

Nicht vorgesehen für: nicht homogene Chargen (die Probenstreuung wird dann als Messstreuung gezählt; Ergebnis zu pessimistisch); zerstörungsfreie Prüfungen (dafür Verfahren 2).

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
MSN-01Mittlere Quadrate, p-Werte, Varianzanteile, %GRR und ndc stimmen mit NumPy/SciPy überein; Szenario 14 ergibt Tom etwa +0,8 N gegenüber Lisa.dw_msanest · 06.10.2026 20:21✓ belegt
MSN-02Mit Probenspalte wird die verschachtelte Analyse zuerst empfohlen; nur am Namen erkennbar beide Varianten; zu kleine Pläne gesperrt.dw_paketB_browser · 06.10.2026 20:27
dw_pipeline · 06.10.2026 20:18
dw_blind4 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RMN-01Gekreuzte Analyse bei zerstörender PrüfungMessstreuung falsch beurteilt43Erkennung über Probenspalte und Messgröße, verschachtelte Vorlage14 (niedrig)MSN-02
RMN-02Inhomogene ChargenMesssystem zu schlecht beurteilt33Hinweis in jeder Kachel26 (mittel)MSN-01

Referenzdatensatz zum Nachrechnen (OQ)

referenz_msanest.tsv · Quelle: Blindtest Szenario 14 · belegt durch Prüfreihe dw_msanest

Ablauf: Datei in der Datenwerkstatt laden, bei allen 1 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Messsystemanalyse bei zerstörender Prüfung“, Zuordnung: messwert: Peel_Kraft_N · teil: Batch · pruefer: Pruefer. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Messsystem verschachtelt (zerstörend)%GRR bezogen auf die Gesamtstreuung 50,2 % (> 30 %), verschachteltes ModellPlan: 2 Prüfer × 4 Chargen × 5 Proben (verschachtelt)
%GRR bezogen auf die Gesamtstreuung: 50,2 %
unterscheidbare Klassen (ndc): 2
Anteile an der Varianz: Wiederholung (mit Probenstreuung) 14,6 % · Prüfer 10,6 % · Chargen 74,8 %
Mittelwert je Prüfer: Lisa: 11,4205 · Tom: 12,2375

Lebensdauer und Zuverlässigkeit

Zweck: Lebensdauer- und Zuverlässigkeitsprüfungen mit rechtszensierten Daten: Kaplan-Meier, Weibull, B10 und Zuverlässigkeit zu einer Zeit.

Nicht vorgesehen für: beschleunigte Prüfungen mit Belastungsmodell (Arrhenius); Vergleich mehrerer Gruppen (Log-Rank); links- oder intervallzensierte Daten; dreiparametrische Weibull-Verteilung.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
LEB-01Kaplan-Meier und Vertrauensband stimmen mit scipy.stats.ecdf überein; Weibull-Schätzer mit weibull_min.fit für zensierte Daten.dw_leben · 06.10.2026 20:21✓ belegt
LEB-02Vertrauensbereiche halten die Abdeckung (Simulation, 90 bis 99 %); B10 und R(t) stimmen.dw_leben · 06.10.2026 20:21✓ belegt
LEB-03Lebensdauerdaten werden erkannt und empfohlen; negative Dauern gemeldet; zu wenige Ausfälle und Ziel ohne Zeitpunkt gesperrt; Zensierung wird berücksichtigt und ihr Einfluss gezeigt.dw_paketB_browser · 06.10.2026 20:27
dw_leben · 06.10.2026 20:21
dw_blind2 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RL-01Zensierte Werte weggelassenLebensdauer deutlich unterschätzt54Zensierung im Modell, Vergleichswert ohne Zensierung im Hinweis15 (mittel)LEB-01, LEB-03
RL-02Zu wenige Ausfälle für WeibullScheingenauigkeit43Sperre unter 2, Hinweis unter 5 Ausfällen, Vertrauensbereiche14 (niedrig)LEB-02, LEB-03
RL-03Übertragung auf andere Belastungenfalsche Zuverlässigkeitsaussage43Hinweis „gilt für die geprüften Bedingungen“28 (mittel)LEB-03

Referenzdatensatz zum Nachrechnen (OQ)

referenz_leben.tsv · Quelle: Blindtest Szenario 8 · belegt durch Prüfreihe dw_leben

Ablauf: Datei in der Datenwerkstatt laden, bei allen 2 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Lebensdauer und Zuverlässigkeit“, Zuordnung: dauer: Dauer_Tage · ereignis: Event_Beobachtet · zeitpunkt: 500 · zielR: 95. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Lebensdauer (Weibull, Kaplan-Meier)Zuverlässigkeit bei 500: mindestens 93,9 % (95 %) – Ziel 95,0 % nicht erreichtPrüflinge: 199, davon 131 ausgefallen, 68 zensiert (liefen noch)
Weibull-Form β: 2,78 (95 %: 2,39 bis 3,22) · Verschleiß (β sicher über 1: Ausfallrate steigt mit der Zeit)
charakteristische Lebensdauer η (63,2 % ausgefallen): 1622 (95 %: 1525 bis 1726)
B10 (10 % ausgefallen): 721 (95 %: 633 bis 821)
B1 (1 % ausgefallen): 309 (95 %: 242 bis 396)

Toleranzintervall (Verifikation)

Zweck: Nachweis, dass ein festgelegter Anteil der Teile mit festgelegter Sicherheit innerhalb der Grenzen liegt (etwa 99/95), als Annahmekriterium in Verifikation und Validierung.

Nicht vorgesehen für: Prozesse ohne Stabilität (das Intervall beschreibt dann nur die Stichprobe); mehrere Merkmale gleichzeitig; Daten, die weder normal noch transformierbar sind und für das verteilungsfreie Verfahren zu wenige Werte haben (Hinweis mit nötigem Umfang).

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
TOL-01Einseitige und zweiseitige Faktoren stimmen mit SciPy überein (exakt nach ISO 16269-6); zweiseitig zusätzlich per Simulation bestätigt.dw_tol · 06.10.2026 20:21✓ belegt
TOL-02Verfahrenswahl: normal, Box-Cox oder verteilungsfrei, offen benannt; verteilungsfreie Umfänge (59, 93, 473) stimmen.dw_tol · 06.10.2026 20:21
dw_paketA_browser · 06.10.2026 20:27
✓ belegt
TOL-03Ungültiger Anteil oder Vertrauen, fehlende Grenzen und zu wenige Werte werden gesperrt.dw_paketA_browser · 06.10.2026 20:27
dw_pipeline · 06.10.2026 20:18
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RT-01Cpk statt Toleranzintervall bei kleiner Stichprobezu optimistische Freigabe53Vorlage mit exaktem Faktor und Hinweis15 (mittel)TOL-01
RT-02Normalverteilung unterstellt bei schiefen DatenIntervall zu eng53Verfahrenswahl mit Anpassungstest; Box-Cox oder verteilungsfrei15 (mittel)TOL-02
RT-03Instabiler ProzessErgebnis nicht übertragbar43Stabilität vorgeschaltet, Kachel nie grün28 (mittel)TOL-02

Referenzdatensatz zum Nachrechnen (OQ)

referenz_tol.csv · Quelle: Beispiel Spritzguss der Werkstatt · belegt durch Prüfreihe dw_tol

Ablauf: Datei in der Datenwerkstatt laden, bei allen 6 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Toleranzintervall (Verifikation)“, Zuordnung: messwert: Wandstärke [mm] · zeit: Zeitstempel · usg: 1,17 · osg: 1,23 · anteil: 99 · vertrauen: 95. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Zeitfolge prüfenWerte geordnetReihenfolge: sortiert nach „Zeitstempel“
Zeilen: 240
Verteilung prüfenkeine Abweichung von der Normalverteilung erkennbarWerte: 240
Anderson-Darling A²: 0,520
p-Wert: 0,185
Stabilität (Regelkarte)45 Signale für besondere UrsachenWerte: 240
Signale: 45
Mittellinie: 1,2020
Eingriffsgrenzen: 1,1804 bis 1,2236
Toleranzintervall99/95-Toleranzintervall 1,1762 bis 1,2278 mm liegt innerhalb der Grenzen 1,1700 bis 1,2300Verfahren: Normalverteilung (ISO 16269-6, exakter Faktor)
Werte: 240
Mittelwert und Standardabweichung: 1,2020 · 0,0092 · Faktor k 2,7928
99/95-Toleranzintervall: 1,1762 bis 1,2278 mm
Grenzen: 1,1700 bis 1,2300

Nachweis aus Gut/Schlecht-Prüfungen

Zweck: Belegte Zuverlässigkeit aus attributiven Prüfungen (etwa 59 ohne Fehler für 95/95) und nötiger Prüfumfang; Planung von Annahmestichproben.

Nicht vorgesehen für: nicht repräsentative oder abhängige Stichproben; Prüfungen ohne vorab festgelegte Fehlerdefinition; sequenzielle Pläne und ISO-2859-Tabellenpläne.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
NAW-01Nötiger Umfang, belegte Zuverlässigkeit (Clopper-Pearson) und Operationscharakteristik stimmen mit SciPy überein; bekannte Umfänge (59, 93, 299, 22).dw_stich · 06.10.2026 20:21✓ belegt
NAW-02Zwei-Punkt-Annahmeplan erfüllt beide Risiken und ist minimal.dw_stich · 06.10.2026 20:21✓ belegt
NAW-03Ein durchgehendes Prüfergebnis (alle Gut) wird nicht zum Entfernen vorgeschlagen; „noch nötige Prüfungen“ wird ausgewiesen.dw_paketA_browser · 06.10.2026 20:27✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RN-01Zu kleiner PrüfumfangNachweis nicht erbracht, aber angenommen53belegte Untergrenze und nötiger Umfang ausgewiesen15 (mittel)NAW-01
RN-02Prüfergebnis-Spalte versehentlich entferntNachweis nicht möglich33„behalten“ als erste Antwort bei Ergebnisspalten13 (niedrig)NAW-03
RN-03Fehlerklasse falsch erkanntZuverlässigkeit falsch52Erkennung per Bezeichnung, Anzeige der Fehlerklasse15 (mittel)NAW-01

Referenzdatensatz zum Nachrechnen (OQ)

referenz_nachweis.csv · Quelle: Blindtest nachweis · belegt durch Prüfreihe dw_stich

Ablauf: Datei in der Datenwerkstatt laden, bei allen 1 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Nachweis aus Gut/Schlecht-Prüfungen“, Zuordnung: urteil: Ergebnis · anteil: 95 · vertrauen: 95. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Nachweis (Zuverlässigkeit)59 Prüfungen mit 0 Fehlern belegen mindestens 95,05 % Zuverlässigkeit mit 95 % Sicherheit: Ziel 95/95 erreichtPrüfungen: 59
Fehler („Schlecht“): 0
belegte Zuverlässigkeit (95 % Sicherheit): mindestens 95,05 %
Ziel: 95/95
nötiger Umfang bei 0 Fehlern: 59

Messmittelfähigkeit (Verfahren 1)

Zweck: Wiederholbarkeit und systematische Abweichung eines Messmittels an einem Referenzteil (Cg, Cgk, Auflösung).

Nicht vorgesehen für: Prüfer- und Teileeinfluss (dafür Verfahren 2); Referenzteile ohne bekannten, rückgeführten Wert.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
MS1-01Cg, Cgk, Mittelwert, Standardabweichung und t-Test stimmen mit NumPy/SciPy überein; Fälle Bias, Streuung und Auflösung werden richtig beurteilt.dw_msa1 · 06.10.2026 20:21✓ belegt
MS1-02Ohne Referenzwert oder Toleranz und unter 10 Messungen gesperrt.dw_paketA_browser · 06.10.2026 20:27
dw_pipeline · 06.10.2026 20:18
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RM1-01Falscher ReferenzwertBias falsch beurteilt43Referenzwert als Pflichtangabe, im Bericht ausgewiesen28 (mittel)MS1-02
RM1-02Formelfehlerfalsches Urteil42Abgleich mit NumPy/SciPy14 (niedrig)MS1-01

Referenzdatensatz zum Nachrechnen (OQ)

referenz_msa1.csv · Quelle: Blindtest verfahren1.csv · belegt durch Prüfreihe dw_msa1

Ablauf: Datei in der Datenwerkstatt laden, bei allen 0 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Messmittelfähigkeit (Verfahren 1)“, Zuordnung: messwert: Durchmesser [mm] · xm: 10,000 · toleranz: 0,1. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Verfahren 1 (Cg, Cgk)Cg 3,17, Cgk 3,11: Messmittel fähigMessungen: 50
Referenzwert und Toleranz: 10,00000 · T = 0,10000 mm
Mittelwert und Standardabweichung: 10,00021 · 0,00105
Cg: 3,17
Cgk: 3,11

Stabilität von Fehlerzahlen (p-, np-, c-, u-Karte)

Zweck: Stabilität von Anteilen fehlerhafter Teile oder Fehlerzahlen je Los über die Zeit.

Nicht vorgesehen für: Messwerte (dafür Regelkarte für Einzelwerte); Lose mit unbekanntem Prüfumfang bei Anteilen.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
ZKA-01Kartentyp, Mittellinie, Grenzen und Signale stimmen mit der unabhängigen Rechnung überein; Laney-Korrektur nur bei Überdispersion großer Lose.dw_zaehl · 06.10.2026 20:21✓ belegt
ZKA-02Kartentyp wird begründet; ungültige Zähldaten, zu wenige Lose und mehr Fehler als Umfang werden gesperrt.dw_paketA_browser · 06.10.2026 20:27
dw_pipeline · 06.10.2026 20:18
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RZ-01Falscher Kartentyp (Teile statt Fehler)falsche Grenzen43Typ begründet, Art überschreibbar28 (mittel)ZKA-02
RZ-02Fehlalarme bei großen Losenunnötige Eingriffe34Laney-Korrektur bei Überdispersion13 (niedrig)ZKA-01

Referenzdatensatz zum Nachrechnen (OQ)

referenz_zaehl.csv · Quelle: Blindtest ausschuss · belegt durch Prüfreihe dw_zaehl

Ablauf: Datei in der Datenwerkstatt laden, bei allen 0 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Stabilität von Fehlerzahlen“, Zuordnung: anzahl: Ausschuss_Teile · umfang: Prüfumfang · zeit: Datum · zaehlart: Teile. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Zeitfolge prüfenWerte geordnetReihenfolge: sortiert nach „Datum“
Zeilen: 30
Regelkarte für Zähldaten1 Signal für besondere Ursachen (p-Karte)Karte: p
Lose: 30
mittlerer Umfang: 150,4
Mittellinie: 4,676 %
Signale: 1 außerhalb der Grenzen, 0 Folgen von 8 auf einer Seite

Zusammenhang beschreiben (Regression)

Zweck: Stärke und Richtung des Zusammenhangs zwischen einer Zielgröße (Zahl: linear; Ja/Nein: logistisch) und Einflussgrößen, mit Vertrauensbereich und Prüfung der Voraussetzungen.

Nicht vorgesehen für: Ursachennachweis (dafür Versuchsplan); Vorhersage außerhalb des untersuchten Bereichs; nichtlineare Zusammenhänge, gemischte Modelle, schrittweise Variablenauswahl; Zielgrößen mit mehr als zwei Klassen.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
REG-01Lineare Regression: Koeffizienten, Standardfehler, p, Vertrauensbereiche, R², F stimmen mit NumPy/SciPy überein; bekannte Koeffizienten liegen im Vertrauensbereich.dw_reg · 06.10.2026 20:19✓ belegt
REG-02Voraussetzungen: Anderson-Darling, Breusch-Pagan, Cook-Distanz, Durbin-Watson, VIF stimmen mit NumPy/SciPy überein; ungleiche Streuung, Hebelpunkte und Kollinearität werden erkannt.dw_reg · 06.10.2026 20:19✓ belegt
REG-03Logistische Regression: Koeffizienten, Standardfehler, p, McFadden-R² und LR-Test stimmen mit scikit-learn und NumPy überein; vollständige Trennung wird gemeldet statt gerechnet.dw_reg · 06.10.2026 20:19✓ belegt
REG-04Die Bedeutung von 0 und 1 wird über Referenzspalte oder Anteile geschätzt, offen gezeigt und ist umkehrbar.dw_aufbereitung · 06.10.2026 20:18
dw_reg_browser · 06.10.2026 20:27
✓ belegt
REG-05Klartext mit Einheit, Richtung und Gültigkeitsbereich; Sperre bei zu wenigen Zeilen; Blindtest-Sollwert (Szenario 9) wird getroffen.dw_reg · 06.10.2026 20:19
dw_reg_browser · 06.10.2026 20:27
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RR-01Zusammenhang als Ursache gelesenfalsche Maßnahme44Hinweis „Zusammenhang, keine Ursache“ in jeder Kachel; Versuchsplan als Weg zum Beleg28 (mittel)REG-05
RR-02Aussage außerhalb des untersuchten Bereichs angewendetfalsche Einstellung43Gültigkeitsbereich je Einflussgröße wird genannt28 (mittel)REG-05
RR-030 und 1 falsch gedeutetRichtung der Effekte vertauscht53Schätzung über Referenz oder Anteile, offen gezeigt, beide Lesarten wählbar15 (mittel)REG-04
RR-04Voraussetzungen verletzt (Streuung, Ausreißer, Kollinearität)zu enge Vertrauensbereiche33Diagnosen mit Warnung13 (niedrig)REG-02
RR-05Formelfehlerfalsche Koeffizienten52Abgleich mit NumPy/SciPy/scikit-learn15 (mittel)REG-01, REG-03

Referenzdatensatz zum Nachrechnen (OQ)

referenz_regression.csv · Quelle: Blindtest Szenario 9 · belegt durch Prüfreihe dw_reg

Ablauf: Datei in der Datenwerkstatt laden, bei allen 2 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Zusammenhang beschreiben (Regression)“, Zuordnung: ziel: Ergebnis · einfluss: Schweiss_Temp, Zug_Speed. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Regression (Koeffizienten)Belegt: Schweiss_Temp Chance ×1,164 je Einheit, Zug_Speed Chance ×0,817 je EinheitModell: logistisch, Zielklasse „Schlecht“
Zeilen: 285
Schweiss_Temp: je +1: Chance auf „Schlecht“ ×1,164 (95 %: 1,082 bis 1,252) (p < 0,001) · belegt
Zug_Speed: je +1: Chance auf „Schlecht“ ×0,817 (95 %: 0,771 bis 0,865) (p < 0,001) · belegt
Modell gegen ohne Einflussgrößen (LR-Test): p < 0,001

Versuchsplan auswerten

Zweck: Haupteffekte und Zweifach-Wechselwirkungen aus voll- oder teilfaktoriellen Plänen mit zwei Stufen, mit Krümmungstest über Mittelpunkte.

Nicht vorgesehen für: Wirkungsflächen (Central Composite, Box-Behnken); mehr als zwei Stufen je Faktor; mehrere Zielgrößen.

Anforderungen

KennungAnforderungNachweis (Prüfreihe, letzter Lauf)Status
DOE-01Effekte und p-Werte stimmen mit NumPy/SciPy überein, auch bei gesättigten Plänen (Lenth).dw_doe · 06.10.2026 20:19✓ belegt
DOE-02Planprüfung: Stufen, Eckläufe, Ausgewogenheit, Vermengung; ungeeignete Faktoren werden gesperrt.dw_doe_browser · 06.10.2026 20:26
dw_pipeline · 06.10.2026 20:18
✓ belegt
DOE-03Erzeugte Pläne sind ausgewogen und orthogonal; die angegebene Vermengung stimmt mit der aus der Planmatrix bestimmten überein.dw_doe_plan · 06.10.2026 20:19✓ belegt
DOE-04Effekte der Blindtest-Versuchspläne entsprechen den Lösungen.dw_doe · 06.10.2026 20:19
dw_blind4 · 06.10.2026 20:22
✓ belegt

Risikobewertung

Kennungmöglicher FehlerFolgeSW ohneMaßnahmeW mitRestrisikoabgesichert durch
RD-01Faktor nicht sauber zweistufig oder Plan unausgewogenverzerrte Effekte43Planprüfung mit Sperre und Hinweisen14 (niedrig)DOE-02
RD-02Vermengung im Teilplan übersehenEffekt falschem Faktor zugeschrieben43Vermengung offen ausgewiesen, geprüft gegen die Planmatrix14 (niedrig)DOE-03
RD-03Formelfehler bei Effekten oder Signifikanzfalsche Faktoren52Abgleich mit NumPy/SciPy und Blindtests15 (mittel)DOE-01, DOE-04

Referenzdatensatz zum Nachrechnen (OQ)

referenz_doe.tsv · Quelle: Blindtest Szenario 36 · belegt durch Prüfreihe dw_blind4

Ablauf: Datei in der Datenwerkstatt laden, bei allen 1 Fragen der Aufbereitung die erste (empfohlene) Antwort wählen, Vorlage „Versuchsplan auswerten“, Zuordnung: faktoren: Zeit [min], Temp [C], Power [W] · ziel: Partikel_Count. Erwartetes Ergebnis:

Bausteinerwartetes Urteilerwartete Kennzahlen
Versuchsplan prüfen (Faktoren)vollfaktorieller Plan mit 3 FaktorenFaktoren: Zeit [min] (5 / 15) · Temp [C] (40 / 60) · Power [W] (100 / 200)
Läufe: 8 Eckläufe, 3 Mittelpunkte
Plan: vollfaktoriell 2^3
Effekte und WechselwirkungenBelegt: Power [W] -55,75, Zeit [min] -43,75, Temp [C] -30,75, Zeit [min] × Temp [C] +24,75Power [W]: -55,750 (p < 0,001) · belegt
Zeit [min]: -43,750 (p < 0,001) · belegt
Temp [C]: -30,750 (p 0,002) · belegt
Zeit [min] × Temp [C]: +24,750 (p 0,004) · belegt
Temp [C] × Power [W]: +5,750 (p 0,146)

Über diese Seite

Gefügewerk ist eine Fachseite von Dennis Schopenhauer über Prozessoptimierung: wie Methoden, Daten, Menschen und Rahmenbedingungen zusammenwirken.

Kontakt: kontakt@gefuegewerk.com