| Commit message (Collapse) | Author | Age | Files | Lines |
| |
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
|
| |
Bisher nahm ÄndGgner nur verkündete Artikelgesetze und Gesetzentwürfe an, ohne
den Unterschied zu kennen. Dokumente, die einen Entwurf ändern statt ein
Gesetz, lieferten still null Befehle.
Neu:
* Dokumentart-Erkennung aus dem Rohtext (DokumentErkenner, DokumentArt,
DokumentKopf) — vor der Bereinigung, weil gerade die Drucksachenköpfe als
Kolumnentitel wegfallen. Erkannt wird nie am Dateinamen: Die Beispieldaten
enthalten eine Datei namens Beschlussempfehlung, die in Wahrheit ein
Entschließungsantrag ist. Dokumente ohne Befehle erzeugen jetzt eine
benannte Warnung statt stiller Leere.
* Änderungsanträge (AenderungsantragParser, EntwurfsPatcher): Der Antrag wird
auf den Entwurfstext angewandt, der geänderte Entwurf danach wie gewohnt auf
das Stammgesetz — eine komponierte Synopse. Drucksachen- und Gesetzesstellen
bleiben getrennte Typen; die Zuordnung Antrag→Entwurf läuft über die
Drucksachennummer, nicht über die Argumentreihenfolge. Der 1910 Zeilen große
BefehlAnwender bleibt unberührt.
* Beschlussempfehlungen werden erkannt und mit Begründung übergangen, die den
brauchbaren Entwurf beim Namen nennt. Die Spaltentrennung der
Zusammenstellung ist gebaut (FontgroessenFilter.Spalte, koordinatenbasiert
am Steg) und belegt: Die linke Spalte ergibt Befehl für Befehl den
Regierungsentwurf. Die rechte Spalte bleibt bewusst offen — sie vermerkt
„unverändert“ auch zeilenweise innerhalb zitierter Blöcke, ihre
Anführungszeichen gehen daher nicht auf; nötig ist die zeilenweise Zuordnung
beider Spalten über die gemeinsame Grundlinie.
Die Synopse kennzeichnet eine Entwurfsfassung als solche.
296 Tests grün (vorher 269); alle gepinnten Akzeptanzzahlen unverändert.
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
Change-Id: I0001d25fcbd9969fc06eea675edc4326ce2e02f9
|
| |
|
|
|
|
|
|
|
|
| |
Extracts the CLI pipeline into a reusable Pipeline class and exposes it
via a dependency-free JDK HttpServer (upload form, bounded worker pool
with 503 on overload, per-request size/time limits, no persisted
uploads), plus nginx/systemd deploy templates and Impressum/Datenschutz
placeholders for public operation.
Change-Id: I6e8e7afa3c4b1082cdf9e82da0fae0b5b49470ad
|
| |
|
|
|
|
|
|
|
|
|
|
|
|
| |
Bump all dependencies and plugins to current versions. Replace the
tika-parsers bundle with a direct PDFBox dependency (we need
PDFTextStripper control), add java-diff-utils for the synopsis diff,
and add JUnit 5 with AssertJ for testing. Drop unused dependencies
(tess4j, Lanterna, term4j, sqlite-jdbc, imageio codecs, annotation
libraries) in favour of jspecify. Regenerate the Maven wrapper with
the official plugin (Takari is dead) and remove the vestigial Ant
wrapper and Tika configuration.
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
Change-Id: I0e1813b3967027cbb0bb978591d345ce138fa0a0
|
|
|
With the new configuration, Tika can now extract text from PDFs and
XML documents.
Also configures logging for the application.
Change-Id: I7a89c2b232ed4e220665dd335a5f5a0cc3ef2994
|