From 1b54b172caea79a6ecfad1ff9ab8d3dcffebbccf Mon Sep 17 00:00:00 2001 From: NSCT Agent Date: Mon, 24 Aug 2026 07:52:43 +0000 Subject: [PATCH] =?UTF-8?q?docs:=20update=20HANDOFF.md=20=E2=80=94=20Stage?= =?UTF-8?q?=208=20completed,=20Stage=209=20next?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit --- HANDOFF.md | 33 +++++++++++++++++++++++++++++---- 1 file changed, 29 insertions(+), 4 deletions(-) diff --git a/HANDOFF.md b/HANDOFF.md index aa07112..62bc08b 100644 --- a/HANDOFF.md +++ b/HANDOFF.md @@ -26,8 +26,33 @@ Webquellen recherchieren, Inhalte extrahieren, Quellen/Claims vergleichen, neutr | 5 | Claim Extraction (atomare, überprüfbare Claims mit Provenance) | `e8b6515` | 7 | 36 | | 6 | Source Independence & Citation Graph (Syndication-Erkennung, similarity) | `a60cf21` | 4 | 43 | | 7 | Claim Clustering & Contradiction Candidates (LLM-Clustering, numerische Normalisierung) | `d1e6bb6` | 6 | 79 | +| 8 | Evidence Scoring (6-dimensionale Scores, evidence_type, raw_scores_json) | `719e218` | 6 | ~60 | -**Gesamt:** 80 Dateien, ~10000 Zeilen Code, ~208 Tests. +**Gesamt:** 86 Dateien, ~12000 Zeilen Code, ~268 Tests. + +--- + +## Stage 8 – Evidence Scoring (abgeschlossen, commit `719e218`) + +- **EvidenceScoreModel** mit 6 Score-Dimensionen: + - `source_independence_score` – 0.0-1.0, aus Stage 6 gelesen + - `primary_source_proximity` – enum: DIRECT(1.0), SYNDICATED(0.6), DERIVED(0.3), UNKNOWN(0.0) + - `cross_source_support` – wie viele Quellen unterstützen denselben Claim + - `contradiction_level` – wie stark widersprechen Quellen (1.0 = alle unterstützen, 0.0 = starker Dissens) + - `evidence_directness` – 1.0 = direkter Befund, 0.0 = Spekulation + - `date_relevance_score` – age_days / 365, max 1 Jahr + - `evidence_type` – DIRECT_OBSERVATION, SECONDARY_REPORT, ANALYSIS, OPINION, SPECULATION +- **EvidenceScoreRelationModel** – Relationen zwischen Scores und Claims +- **raw_scores_json** – alle Rohdaten für Auditability +- Kein einziger "truth_score" – transparente multidimensionale Scores + +--- + +## Start-Command für neuen Thread + +Wenn ein neuer Thread weiterarbeiten soll, einfach **Stage X** nennen und mit der Arbeit beginnen. Der neue Thread liest prompt.md (liegt im Repo als `/home/faligam/nsct/prompt.md`) für die volle Spezifikation und setzt bei der nächsten offenen Stage fort. + +**Stage 9 ist die nächste offene Stage.** --- @@ -37,9 +62,9 @@ Webquellen recherchieren, Inhalte extrahieren, Quellen/Claims vergleichen, neutr |---|---| | 5 | ~~Claim Extraction~~ (✅ **ABGESCHLOSSEN** – `e8b6515`) | | 6 | ~~Source Independence & Citation Graph~~ (✅ **ABGESCHLOSSEN** – `a60cf21`) | -|| 7 | ~~Claim Clustering & Contradiction Candidates~~ (✅ **ABGESCHLOSSEN** – `d1e6bb6`) | -|| 8 | **Evidence Scoring** — Transparente multidimensionale Scores (source_independence, primary_source_proximity, cross_source_support, contradiction_level, evidence_directness, date_relevance). Kein einziger \"truth_score\". | -| **9** | **Neutral Synthesis Engine** — LLM erzeugt den finalen Bericht aus dem Evidence Package. Trennung Fakten/Interpretation, Unsicherheit explizit, keine politische Empfehlung. | +| 7 | ~~Claim Clustering & Contradiction Candidates~~ (✅ **ABGESCHLOSSEN** – `d1e6bb6`) | +|| 8 | ~~Evidence Scoring~~ (✅ **ABGESCHLOSSEN** – `719e218`) | +|| 9 | **Neutral Synthesis Engine** — LLM erzeugt den finalen Bericht aus dem Evidence Package. Trennung Fakten/Interpretation, Unsicherheit explizit, keine politische Empfehlung. | | **10** | **Vision Integration** — Qwen2.5-VL-3B für Diagramme, Screenshots, Infografiken, PDF-Layouts. Provenance-Pflicht. | | **11** | **Audio Integration** — Transkription von Interviews, Podcasts, Pressekonferenzen. Timestamped Claims. | | **12** | **Research Orchestrator** — State Machine (CREATED→PLANNING→SEARCHING→...→COMPLETED/FAILED). Harte Budgets (max_search_queries, max_sources, max_llm_requests, ...). |