diff options
| author | Matthias Andreas Benkard <code@mail.matthias.benkard.de> | 2026-08-24 07:37:17 +0200 |
|---|---|---|
| committer | Matthias Andreas Benkard <code@mail.matthias.benkard.de> | 2026-08-24 07:44:51 +0200 |
| commit | 9feaf3b9eebd79a37a252c2ffdf241f4190b2637 (patch) | |
| tree | 3775b5196b2a50d2d6dc200b6211851265d248aa /src/test/java | |
| parent | e13b58a5e3b602b475c46e6d595749d375148836 (diff) | |
Der Browser bekommt den Notausgang, den die Befehlszeile schon hatte
Die Browserfassung galt als die vollwertige zweite Fassung des Erzeugnisses. Zwei
Angaben der Befehlszeile fehlten ihr aber: die Beschränkung auf einen einzelnen
Artikel und die Ausgabe des maschinell gelesenen Textes. Die erste war im Vordruck
nicht vorgesehen, obwohl Arbeiter und Rechenwerk den Wert längst durchreichten —
das Formular sandte an ihrer Stelle hart einen leeren Wert. Die zweite war
überhaupt nicht erreichbar.
Das Fehlende wiegt ungleich. Die Artikelangabe erspart Mühe; die Textausgabe
dagegen ist der einzige Weg, einem unerklärlich unangewandten Befehl auf den Grund
zu gehen. Wer im Browser arbeitete, stand vor einem Ergebnis, das er nicht
nachprüfen konnte, und war auf die Befehlszeile verwiesen — also gerade auf das,
was die Browserfassung entbehrlich machen sollte.
Die Textgewinnung wandert deshalb aus der Befehlszeilenklasse in den gemeinsamen
Kern (Pipeline.extrahiereText); beide Fassungen nehmen fortan denselben Weg. Der
Vordruck erhält das Feld „Anzuwendender Artikel“ und das Ankreuzfeld „Statt der
Synopse nur den maschinell gelesenen Text der Änderungsdokumente ausgeben“; das
Ergebnis kommt wie die Synopse als Verweis zum Öffnen und Sichern. Nebenbei
verträgt die Umsetzung nach Wahrheitswerten nun ein nicht gesetztes Feld, das als
„undefined“ herüberkommt. Das Handbuch zählt die Absätze des § 14 wieder
fortlaufend — es führte (6) und (7) zweimal — und stellt die Angaben des Vordrucks
den Schaltern des § 6 Absatz 2 gegenüber.
Eine neue Prüfung hält die Ausgabe des Notausgangs gegen den Text, den der Parser
bekommt: Führte sie einen anderen vor, so wiese sie in die Irre. Der Prüfbestand
umfasst hiernach 335 Prüfungen, sämtlich grün; REUSE meldet 174/174.
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
Change-Id: I2a9aee042b6454f8d591bc415a5c6f1c1e7b40b6
Diffstat (limited to 'src/test/java')
| -rw-r--r-- | src/test/java/eu/mulk/aendggner/EndToEndTest.java | 28 |
1 files changed, 28 insertions, 0 deletions
diff --git a/src/test/java/eu/mulk/aendggner/EndToEndTest.java b/src/test/java/eu/mulk/aendggner/EndToEndTest.java index 2698fa5..fe98b84 100644 --- a/src/test/java/eu/mulk/aendggner/EndToEndTest.java +++ b/src/test/java/eu/mulk/aendggner/EndToEndTest.java @@ -99,6 +99,34 @@ class EndToEndTest { * die Rechnung vollständig auf: <b>75 von 75</b>, kein Rest. Das ist zugleich der Beleg, dass die * 27 nie ein Mangel des Werkzeugs waren. */ + /** + * Der Notausgang (§ 6 Absatz 2 des Handbuchs) gibt aus, was das Erzeugnis gelesen hat, und geht + * dabei denselben Weg wie die Synopse — auf ihn verlässt sich, wer einem unerklärlichen Rest + * nachgeht, und seit Welle 21 tut das auch die Browserfassung. + */ + @Test + void notausgangLiefertDenGelesenenText() throws Exception { + assumeTrue(Files.exists(STAMMGESETZ), "IfSG-Beispieldaten fehlen"); + assumeTrue(Files.exists(AENDERUNGSGESETZ), "BGBl-Beispiel-PDF fehlt"); + + var stamm = Quelle.lies(STAMMGESETZ); + var patches = List.of(Quelle.lies(AENDERUNGSGESETZ)); + + var bereinigt = Pipeline.extrahiereText(stamm, patches, false); + var roh = Pipeline.extrahiereText(stamm, patches, true); + + // Wortgleich mit dem, was der Parser bekommt — sonst führte der Notausgang in die Irre. + assertThat(bereinigt) + .isEqualTo( + TextBereiniger.bereinige(new PatchTextExtraktor().extrahiere(AENDERUNGSGESETZ)) + "\n"); + assertThat(bereinigt).contains("Nach § 28 wird folgender § 28a eingefügt"); + // Die Bereinigung nimmt fort, was der Satz beisteuert (Kolumnentitel, Trennstriche); der + // Rohtext ist deshalb länger und trägt den Kopf des Gesetzblatts noch. + assertThat(roh).hasSizeGreaterThan(bereinigt.length()); + assertThat(roh).contains("Bundesgesetzblatt"); + assertThat(bereinigt).doesNotContain("Bundesgesetzblatt Jahrgang 2020 Teil I Nr."); + } + @Test void ifsgGegenZeitrichtigenStamm() throws Exception { var xml = SAMPLEDATA.resolve("IfSG/BJNR104510000-2020.xml"); |
