docs: update HANDOFF.md — Stage 8 completed, Stage 9 next
This commit is contained in:
33
HANDOFF.md
33
HANDOFF.md
@@ -26,8 +26,33 @@ Webquellen recherchieren, Inhalte extrahieren, Quellen/Claims vergleichen, neutr
|
||||
| 5 | Claim Extraction (atomare, überprüfbare Claims mit Provenance) | `e8b6515` | 7 | 36 |
|
||||
| 6 | Source Independence & Citation Graph (Syndication-Erkennung, similarity) | `a60cf21` | 4 | 43 |
|
||||
| 7 | Claim Clustering & Contradiction Candidates (LLM-Clustering, numerische Normalisierung) | `d1e6bb6` | 6 | 79 |
|
||||
| 8 | Evidence Scoring (6-dimensionale Scores, evidence_type, raw_scores_json) | `719e218` | 6 | ~60 |
|
||||
|
||||
**Gesamt:** 80 Dateien, ~10000 Zeilen Code, ~208 Tests.
|
||||
**Gesamt:** 86 Dateien, ~12000 Zeilen Code, ~268 Tests.
|
||||
|
||||
---
|
||||
|
||||
## Stage 8 – Evidence Scoring (abgeschlossen, commit `719e218`)
|
||||
|
||||
- **EvidenceScoreModel** mit 6 Score-Dimensionen:
|
||||
- `source_independence_score` – 0.0-1.0, aus Stage 6 gelesen
|
||||
- `primary_source_proximity` – enum: DIRECT(1.0), SYNDICATED(0.6), DERIVED(0.3), UNKNOWN(0.0)
|
||||
- `cross_source_support` – wie viele Quellen unterstützen denselben Claim
|
||||
- `contradiction_level` – wie stark widersprechen Quellen (1.0 = alle unterstützen, 0.0 = starker Dissens)
|
||||
- `evidence_directness` – 1.0 = direkter Befund, 0.0 = Spekulation
|
||||
- `date_relevance_score` – age_days / 365, max 1 Jahr
|
||||
- `evidence_type` – DIRECT_OBSERVATION, SECONDARY_REPORT, ANALYSIS, OPINION, SPECULATION
|
||||
- **EvidenceScoreRelationModel** – Relationen zwischen Scores und Claims
|
||||
- **raw_scores_json** – alle Rohdaten für Auditability
|
||||
- Kein einziger "truth_score" – transparente multidimensionale Scores
|
||||
|
||||
---
|
||||
|
||||
## Start-Command für neuen Thread
|
||||
|
||||
Wenn ein neuer Thread weiterarbeiten soll, einfach **Stage X** nennen und mit der Arbeit beginnen. Der neue Thread liest prompt.md (liegt im Repo als `/home/faligam/nsct/prompt.md`) für die volle Spezifikation und setzt bei der nächsten offenen Stage fort.
|
||||
|
||||
**Stage 9 ist die nächste offene Stage.**
|
||||
|
||||
---
|
||||
|
||||
@@ -37,9 +62,9 @@ Webquellen recherchieren, Inhalte extrahieren, Quellen/Claims vergleichen, neutr
|
||||
|---|---|
|
||||
| 5 | ~~Claim Extraction~~ (✅ **ABGESCHLOSSEN** – `e8b6515`) |
|
||||
| 6 | ~~Source Independence & Citation Graph~~ (✅ **ABGESCHLOSSEN** – `a60cf21`) |
|
||||
|| 7 | ~~Claim Clustering & Contradiction Candidates~~ (✅ **ABGESCHLOSSEN** – `d1e6bb6`) |
|
||||
|| 8 | **Evidence Scoring** — Transparente multidimensionale Scores (source_independence, primary_source_proximity, cross_source_support, contradiction_level, evidence_directness, date_relevance). Kein einziger \"truth_score\". |
|
||||
| **9** | **Neutral Synthesis Engine** — LLM erzeugt den finalen Bericht aus dem Evidence Package. Trennung Fakten/Interpretation, Unsicherheit explizit, keine politische Empfehlung. |
|
||||
| 7 | ~~Claim Clustering & Contradiction Candidates~~ (✅ **ABGESCHLOSSEN** – `d1e6bb6`) |
|
||||
|| 8 | ~~Evidence Scoring~~ (✅ **ABGESCHLOSSEN** – `719e218`) |
|
||||
|| 9 | **Neutral Synthesis Engine** — LLM erzeugt den finalen Bericht aus dem Evidence Package. Trennung Fakten/Interpretation, Unsicherheit explizit, keine politische Empfehlung. |
|
||||
| **10** | **Vision Integration** — Qwen2.5-VL-3B für Diagramme, Screenshots, Infografiken, PDF-Layouts. Provenance-Pflicht. |
|
||||
| **11** | **Audio Integration** — Transkription von Interviews, Podcasts, Pressekonferenzen. Timestamped Claims. |
|
||||
| **12** | **Research Orchestrator** — State Machine (CREATED→PLANNING→SEARCHING→...→COMPLETED/FAILED). Harte Budgets (max_search_queries, max_sources, max_llm_requests, ...). |
|
||||
|
||||
Reference in New Issue
Block a user