spb/trouve-ka Public
Trouve-KA — moteur de recherche web indépendant, Québec-first. Crawler distribué, index OpenSearch, ranking bilingue, galerie d'images. En prod : www.trouve-ka.com
Python 76.8%
TypeScript 15.7%
SQL 3.9%
Shell 1.4%
CSS 1.3%
Dockerfile 0.7%
1# Trouve-KA — Observabilité23Author: Simon-Pierre Boucher — Contact: contact@spboucher.ai45## En place (MVP)67- **Logs structurés JSON** (une ligne par événement) sur stdout de chaque service,8 avec contexte `worker_id, url_id, domain_id, url, outcome, quebec_score, ms`9 (`packages/logging`). Consultables via `docker compose logs -f crawler-worker`.10- **Métriques opérationnelles** exposées par l'API :11 - `GET /api/status` (public) : pages indexées, domaines, débits horaires, état du crawler.12 - `GET /api/admin/overview` (protégé) : files par statut, débits, distribution HTTP,13 latences fetch p50/p95, top domaines, erreurs récentes, backlog d'enrichissement.14 - Toutes calculées sur les vraies tables (`crawl_attempts`, `frontier_items`) —15 aucun compteur simulé (§ fake).16- **Dashboard admin** : `/admin` sur le web (flux live du crawl, contrôles pause/seeds/blocage).1718## Prochaine étape (post-MVP)1920Exporter ces mêmes agrégats au format Prometheus (`/metrics`) et brancher21Grafana — les requêtes SQL de `Database.admin_overview()` sont la source de vérité,22l'export est un simple reformatage. Choix pragmatique conforme au CLAUDE.md §13.23