fix(faktencheck): Zahl der Faktenaussagen richtet sich nach dem Material

In allen Auftraegen stand fest "5-10 wichtigste Faktenaussagen", bei der
Aktualisierung "3-5 neue". Die Zahl hatte damit nichts mit der Menge des
Materials zu tun. Aus 16 Meldungen wurden genauso viele Fakten wie aus 91.

Beide Wege lasen dieselbe Vorgabe verschieden. Der Weg ueber die Anthropic-CLI
behandelte sie als Richtwert und lag zwischen 9 und 21 Fakten, ueberschritt die
Zehn also regelmaessig. Das Modell auf dem EU-Weg las sie als Zielvorgabe und
traf sie in neun von siebzehn Laeufen exakt. Daher wirkten die EU-Berichte so
gleichfoermig, nicht die Lage bestimmte den Umfang, sondern die Zahl im Text.

Bei der Ceuta-Lage bedeutete das, dass zehn Punkte eine europaweite Krise
abbilden mussten, in der Opferzahlen, die schwimmende Barriere, das
Sondertreffen der Innenminister, Italiens Schengen-Aussetzung, der offene Brief
von 22 Staaten, die Rueckfuehrungen und mehrere Regierungsaeusserungen
vorkamen.

faktenspanne() berechnet den Richtwert jetzt aus der Zahl der Meldungen, grob
eine Aussage je fuenf Meldungen, begrenzt auf 5 bis 20 bei der Erstpruefung und
3 bis 10 bei der Aktualisierung. 16 Meldungen ergeben weiterhin 5 bis 10, 88
Meldungen ergeben 9 bis 18. Alle Werte sind ueber Umgebungsvariablen
einstellbar.

Dazu die Formulierung. Die Spanne ist jetzt ausdruecklich als Richtwert und
nicht als Zielvorgabe bezeichnet, mit der Erlaubnis, weniger zu nennen wenn das
Material nicht mehr hergibt, und mehr wenn sonst wichtige Punkte fehlen wuerden.
Betroffen sind die vier Faktencheck-Vorlagen und die Triage.

Neu sind 25 Pruefungen, insgesamt laufen 279 ohne Netzzugriff und ohne Kosten.

Co-Authored-By: Claude Opus 5 (1M context) <noreply@anthropic.com>
Dieser Commit ist enthalten in:
claude-dev
2026-08-02 11:47:56 +00:00
Ursprung b00076d320
Commit e440ef93d1
4 geänderte Dateien mit 196 neuen und 5 gelöschten Zeilen

Datei anzeigen

@@ -162,6 +162,7 @@ tests/:
hinweis: "Laufen ohne Netzzugriff und ohne Kosten, Modell, Suche und Datenbank sind durch Testdoubles ersetzt. Aufruf aus dem Projektstamm, zum Beispiel venv/bin/python tests/test_eu_factcheck.py"
test_eu_factcheck.py: "EU-Faktencheck, Nachhak-Runde, Quellenzuordnung, plus Regressionsschutz fuer den Anthropic-Weg"
test_eu_belegsuche.py: "Gezielte Belegsuche ueber staan, Planung, Grenzen, Entdopplung, Ausfallverhalten"
test_faktenspanne.py: "Richtwert fuer die Zahl der Faktenaussagen, waechst mit der Menge der Meldungen"
test_qc_und_runden.py: "Absicherung der Duplikatpruefung und Abbruch der Suchrunden bei erreichter Treffergrenze"
test_mehrfachantwort.py: "Antworten, in denen sich das Modell selbst korrigiert und mehrere Fassungen liefert, die ausfuehrlichste muss gewinnen"
test_faktencheck_belegtiefe.py: "Belegzaehlung nach Medienhaus, Nachbedingung fuer bestaetigte Fakten, Sperre gegen das Hochstufen von developing, getrennte Bezeichnungen fuer Widerspruch und Widerlegung"