BreakMySystem.ai

FAQ & Vergleich

Antworten auf die häufigsten Fragen — und eine ehrliche Einordnung gegenüber den Alternativen.

Ist das nicht einfach ChatGPT mit einem Fintech-Prompt?

Nein: ein deterministisches Vier-Wert-Verdict, eine Eval-kalibrierte Trefferquote, eine wachsende Failure-Pattern-Bibliothek und artefaktübergreifende Traceability sind strukturell nicht aus einem Chat-Fenster ableitbar.

Warum nicht einfach gut prompten?

Weil vier strukturelle Differenzierer bleiben, die aus einem Chat-Fenster nicht entstehen: ein blockierendes Gate, Eval-Kalibrierung, eine wachsende Failure-Pattern-Bibliothek und durchgängige Traceability — plus eine Audit-Spur.

Ersetzt ihr GitHub Copilot, CodeRabbit oder Greptile?

Nein. Gegenüber GitHub Copilot, CodeRabbit und Greptile setzen wir bewusst upstream an (Issue/Architektur/Plan vor dem Pull Request) — keine Code-Review-Feature-Parität. Gegenüber Baz, das ebenfalls schon vor dem Code ansetzt, reicht dieses Argument allein nicht: unsere Abgrenzung sind ein Requirement-Gate direkt am Issue im Tracker (produktiv), ein deterministischer Graph-/Drift-Kern (produktiv), ein blockierendes Gate mit vierwertigem Verdict inkl. kalibrierter Enthaltung und Verdict-Snapshots (produktiv) sowie eine heterogene Multi-Modell-Debatte (produktiv). Ein EU-residenter Betriebs-/BYOK-Pfad ist Roadmap.

Ist das ein Security-Scanner wie Snyk oder ein Infra-Tool?

Nein, komplementär: Wir prüfen Produkt- und Systementscheidungen vor der Umsetzung, nicht Code-Schwachstellen oder Infrastruktur.

Was kostet das?

Drei Stufen (Solo, Team, Enterprise auf Anfrage), Solo und Team je mit einer deterministischen und einer LLM-Variante — die aktuellen, vorläufigen Preise stehen in der Preis-Sektion.

Zur Preis-Sektion

Woher wisst ihr, dass eure Findings stimmen und nicht nur Lärm sind?

Ein Eval-Harness mit hartem Go/No-Go-Schwellenwert prüft die Finding-Qualität systematisch, statt sie nur zu behaupten — heute real angewandt an der Code-Stufe. Für die Requirement-Stufe steht der Beleg noch aus.

Was passiert mit unserem Code und unseren Daten?

Kurz: kein Training auf euren Eingaben, minimale Datenflüsse, verpflichtende Secrets-Redaction sowie lokale bzw. kontrollierte Speicherung — Details teilen wir auf Anfrage aus dem Trust-Pack.

Im Vergleich

Dimension BreakMySystem.ai „Gut prompten" Code-Review-Tools Policy-/Security-Gates Baz
Eingriffspunkt Vor der Implementierung (Issue/Architektur/Plan) Ad hoc, beliebig Nach der Implementierung (Pull Request) Code-/Dependency-Ebene Plan-/Repo-Kontext aus dem Coding-Agenten heraus; kein Issue-Gate im Tracker dokumentiert
Determinismus Vier-Wert-Verdict, reproduzierbar Keiner (formulierungsabhängig) Teils regelbasiert Ja, regelbasiert Agentenbasiert; kein deterministischer Kern dokumentiert
Belegmechanik Evidence-Pflicht + Eval-Kalibrierung Keine Teils Regel-Referenz Regel-/CVE-Referenz Agenten-Reviews mit Repo-/Ticket-Kontext (Spec-/Security-/SRE-/Fixer-Agenten); ein Eval-Go/No-Go ist öffentlich nicht dokumentiert
Buyer CTO/Head of Engineering Niemand (kostenfrei) Entwickler/Teamleitung Security-/Compliance-Team Engineering-Teams im PR-/Change-Workflow; US-/IL-Anbieter (Vertragsrecht); BYOK/EU-Residenz öffentlich nicht dokumentiert