docs: update HANDOFF.md — Stage 8 completed, Stage 9 next

This commit is contained in:
NSCT Agent
2026-08-24 07:52:43 +00:00
parent 719e218d9a
commit 1b54b172ca

View File

@@ -26,8 +26,33 @@ Webquellen recherchieren, Inhalte extrahieren, Quellen/Claims vergleichen, neutr
| 5 | Claim Extraction (atomare, überprüfbare Claims mit Provenance) | `e8b6515` | 7 | 36 | | 5 | Claim Extraction (atomare, überprüfbare Claims mit Provenance) | `e8b6515` | 7 | 36 |
| 6 | Source Independence & Citation Graph (Syndication-Erkennung, similarity) | `a60cf21` | 4 | 43 | | 6 | Source Independence & Citation Graph (Syndication-Erkennung, similarity) | `a60cf21` | 4 | 43 |
| 7 | Claim Clustering & Contradiction Candidates (LLM-Clustering, numerische Normalisierung) | `d1e6bb6` | 6 | 79 | | 7 | Claim Clustering & Contradiction Candidates (LLM-Clustering, numerische Normalisierung) | `d1e6bb6` | 6 | 79 |
| 8 | Evidence Scoring (6-dimensionale Scores, evidence_type, raw_scores_json) | `719e218` | 6 | ~60 |
**Gesamt:** 80 Dateien, ~10000 Zeilen Code, ~208 Tests. **Gesamt:** 86 Dateien, ~12000 Zeilen Code, ~268 Tests.
---
## Stage 8 Evidence Scoring (abgeschlossen, commit `719e218`)
- **EvidenceScoreModel** mit 6 Score-Dimensionen:
- `source_independence_score` 0.0-1.0, aus Stage 6 gelesen
- `primary_source_proximity` enum: DIRECT(1.0), SYNDICATED(0.6), DERIVED(0.3), UNKNOWN(0.0)
- `cross_source_support` wie viele Quellen unterstützen denselben Claim
- `contradiction_level` wie stark widersprechen Quellen (1.0 = alle unterstützen, 0.0 = starker Dissens)
- `evidence_directness` 1.0 = direkter Befund, 0.0 = Spekulation
- `date_relevance_score` age_days / 365, max 1 Jahr
- `evidence_type` DIRECT_OBSERVATION, SECONDARY_REPORT, ANALYSIS, OPINION, SPECULATION
- **EvidenceScoreRelationModel** Relationen zwischen Scores und Claims
- **raw_scores_json** alle Rohdaten für Auditability
- Kein einziger "truth_score" transparente multidimensionale Scores
---
## Start-Command für neuen Thread
Wenn ein neuer Thread weiterarbeiten soll, einfach **Stage X** nennen und mit der Arbeit beginnen. Der neue Thread liest prompt.md (liegt im Repo als `/home/faligam/nsct/prompt.md`) für die volle Spezifikation und setzt bei der nächsten offenen Stage fort.
**Stage 9 ist die nächste offene Stage.**
--- ---
@@ -37,9 +62,9 @@ Webquellen recherchieren, Inhalte extrahieren, Quellen/Claims vergleichen, neutr
|---|---| |---|---|
| 5 | ~~Claim Extraction~~ (✅ **ABGESCHLOSSEN** `e8b6515`) | | 5 | ~~Claim Extraction~~ (✅ **ABGESCHLOSSEN** `e8b6515`) |
| 6 | ~~Source Independence & Citation Graph~~ (✅ **ABGESCHLOSSEN** `a60cf21`) | | 6 | ~~Source Independence & Citation Graph~~ (✅ **ABGESCHLOSSEN** `a60cf21`) |
|| 7 | ~~Claim Clustering & Contradiction Candidates~~ (✅ **ABGESCHLOSSEN** `d1e6bb6`) | | 7 | ~~Claim Clustering & Contradiction Candidates~~ (✅ **ABGESCHLOSSEN** `d1e6bb6`) |
|| 8 | **Evidence Scoring** — Transparente multidimensionale Scores (source_independence, primary_source_proximity, cross_source_support, contradiction_level, evidence_directness, date_relevance). Kein einziger \"truth_score\". | || 8 | ~~Evidence Scoring~~ (✅ **ABGESCHLOSSEN** `719e218`) |
| **9** | **Neutral Synthesis Engine** — LLM erzeugt den finalen Bericht aus dem Evidence Package. Trennung Fakten/Interpretation, Unsicherheit explizit, keine politische Empfehlung. | || 9 | **Neutral Synthesis Engine** — LLM erzeugt den finalen Bericht aus dem Evidence Package. Trennung Fakten/Interpretation, Unsicherheit explizit, keine politische Empfehlung. |
| **10** | **Vision Integration** — Qwen2.5-VL-3B für Diagramme, Screenshots, Infografiken, PDF-Layouts. Provenance-Pflicht. | | **10** | **Vision Integration** — Qwen2.5-VL-3B für Diagramme, Screenshots, Infografiken, PDF-Layouts. Provenance-Pflicht. |
| **11** | **Audio Integration** — Transkription von Interviews, Podcasts, Pressekonferenzen. Timestamped Claims. | | **11** | **Audio Integration** — Transkription von Interviews, Podcasts, Pressekonferenzen. Timestamped Claims. |
| **12** | **Research Orchestrator** — State Machine (CREATED→PLANNING→SEARCHING→...→COMPLETED/FAILED). Harte Budgets (max_search_queries, max_sources, max_llm_requests, ...). | | **12** | **Research Orchestrator** — State Machine (CREATED→PLANNING→SEARCHING→...→COMPLETED/FAILED). Harte Budgets (max_search_queries, max_sources, max_llm_requests, ...). |