NSCT Agent b8181deb05 Stage 4: Research Planner — LLM-basierte Recherchestrategie-Generierung
- src/nsct/agents/planner.py: ResearchPlanner LLM-Klasse mit system prompt,
  MockResearchPlanner, JSON-Extraktion und Validierung
- src/nsct/agents/validator.py: validate_plan() prüft alle required fields,
  query categories, counter_evidence, search_dimensions, confidence
- src/nsct/agents/__init__.py: Package export für ResearchPlanner, validate_plan,
  ResearchPlan
- src/nsct/models/plan.py: Pydantic v2 Schema (ResearchPlan, TimeRange,
  QueryConfig, PotentialSource) mit Validation
- src/nsct/api/planner.py: POST /research/planner Endpoint mit Debug-Support
- src/nsct/api/main.py: Mount des planner routers
- src/nsct/crawler/pdf.py: exportiere extract_pdf_content als Alias
- src/nsct/api/crawler.py: Pydantic BaseModel für Request-Models
- tests/test_planner.py: 25 Tests für Planner, Validator, Schema, API

- Search-Bias-Reduktion: 6+ Query-Typen, counter_evidence, beide Seiten
- Keine TODOs, keine unvollständigen Funktionen
- Alle Dateien syntaktisch korrekt und getestet
2026-08-23 13:28:23 +00:00

============================================================

NSCT — Neutral Search Crawler Tool

============================================================

NSCT ist ein vollständig lokal betreibbares, containerisiertes Recherche- und Analyse-System. Es durchsucht Webquellen, extrahiert Inhalte, vergleicht Behauptungen (Claims) aus verschiedenen Quellen und erzeugt einen neutralen, quellengestützten Bericht.

NSCT steht für: Neutral Search Crawler Tool.

Architektur-Übersicht

┌─────────────┐    ┌──────────────┐    ┌───────────────┐
│  User / CLI  │───▶│  NSCT API    │───▶│  FastAPI /    │
│              │    │  (FastAPI)   │    │  uvicorn      │
└─────────────┘    └──────────────┘    └───────────────┘
                           │
              ┌────────────┼─────────────┐
              ▼            ▼             ▼
        ┌───────────┐ ┌─────────┐  ┌──────────┐
        │ LLM       │ │ Vision  │  │  Audio   │
        │ Provider  │ │ Model   │  │  Model   │
        └───────────┘ └─────────┘  └──────────┘
              │            │             │
              ▼            ▼             ▼
        ┌─────────────────────────────────────┐
        │   PostgreSQL (evidence store)        │
        └─────────────────────────────────────┘
              ▲
              │
        ┌──────────────┐
        │  SearXNG      │ (optional search backend)
        └──────────────┘

Quick Start

Docker Compose

# 1. Kopiere die Beispiel-Env
cp .env.example .env
# 2. Trage deine Endpunkte ein (LLM, Vision, Audio, PostgreSQL)

# 3. Starte alles
docker compose up --build

# 4. Prüfe den Health-Check
curl http://localhost:8080/health

Die API ist danach unter http://localhost:8080 erreichbar. /docs zeigt die auto-generierte Swagger-Dokumentation (nur bei NSCT_DEBUG=true).

Projektstruktur

nsct/
├── src/nsct/
│   ├── api/          # FastAPI-Routen
│   ├── models/       # Pydantic-Schemata
│   ├── providers/    # Abstrakte Provider-Interfaces
│   ├── security/     # SSRF-Schutz, URL-Validierung
│   └── storage/      # SQLAlchemy Models + Engine
├── tests/            # pytest-Tests
├── docker-compose.yml
├── Dockerfile
├── pyproject.toml
├── README.md
├── ARCHITECTURE.md
├── SECURITY.md
├── METHODOLOGY.md
├── API.md
├── DEPLOYMENT.md
└── .env.example

Status

Stage 0 — Repository und Architekturgrundlage.

Stage 0 enthält:

  • Vollständige Projektstruktur mit allen Konfigurationsdateien
  • Pydantic v2 Datenmodelle
  • SQLAlchemy 2.0 Persistenzmodelle
  • Sicherheitshards (SSRF-Schutz, IP-Blocklist)
  • Provider-Interfaces (abstrakte Basisklassen)
  • Health-, Ready- und Provider-Endpunkte
  • Strukturiertes Logging
  • Docker-Konfiguration für PostgreSQL, SearXNG und NSCT

Die eigentliche Evidence-Pipeline (Search, Fetch, Extract, Claim, Compare, Report) wird in späteren Stages implementiert.

Lizenz

MIT

Description
No description provided
Readme 1.5 MiB
Languages
Python 99.9%
Dockerfile 0.1%