spb/ka-guardian
Public
Python 57.1%
Shell 13.8%
CSS 12%
JavaScript 10%
HTML 7.2%
-
Tue, Aug 25, 2026 1
-
veilleur de sites: surveillance up/down des sites publics par agent
…
- topology.json: service vraiprix (M3U96a:8090, site seulement) ajouté a ka6; politique du veilleur (intervalle 120s, 2 echecs, throttle restart 10 min, fenetres watching/cooldown courtes pour _site) - orchestrator/main.py: site_engine — check du site public de chaque service, down confirme → pm2 restart auto via runner /restart, toujours down → incident site_down (priorite max) + mission Claude d investigation (build_site_down_prompt); current_status/_site, resolution auto au retour en ligne, garde anti-boucle abandonnes 24h; /api/state expose sites - runner/runner.py: endpoint POST /restart (pm2 restart + healthcheck, sans git) - app.js: libelle site_down; CLAUDE.md: doc du veilleur Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
-
-
Mon, Aug 24, 2026 3
-
fix(runner): watchdog de timeout indépendant du flux stdout
…
Le contrôle du deadline vivait dans la boucle for line in proc.stdout : il ne s exécutait qu à l arrivée d une ligne. Un claude qui se tait (outil qui pend) ou qui n exit jamais après son résultat laissait la mission « running » pour toujours et bloquait le nœud (mission f9eb9d1b59c8 du 2026-08-24 : travail fini à 10:38, processus zombie tué à la main à 15:46). Un thread watchdog tue désormais le processus au deadline quoi qu il arrive. Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
-
Rollback ciblé (revert des seuls commits [ka*], plus jamais de reset/revert de plage) + pousseur launchd com.ka.pousseur (push binaires Apple, contourne LNP) + consignes: push raté en mission = attendu
…
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
-
Consignes: les agents committent ET poussent sur spbgit (git push origin main obligatoire); rollback runner pousse aussi (force-with-lease); retrait artefact M4M36luster-projects
…
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
-
-
Sun, Aug 23, 2026 4
-
Runner: flush du transcript ligne par ligne
…
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
-
Robustesse: réconciliation des missions fantômes (runner /mission-result + final persisté), retries courrier 3x, deploy refuse un runner occupé, transfert tar-over-ssh
…
Cause racine du blocage 2026-08-23 14h: kickstart des runners (rotation jeton) a tué la mission claude en vol; l'événement final n'existait pas et la file restait bloquée jusqu'au délai zombie. Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
-
Page /commander (onglets, durée max, coût max estimé live, effort inspection dégradés) + garde-fou coût runner + commits conservés si plafond atteint
…
Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
-
KA Guardian v1 — ka2/ka4/ka6 renaissent en agents autonomes de réparation des connecteurs
…
Orchestrateurs (M4M36) + runners claude -p sur les nœuds d'apps + courrier zsh (contournement Local Network Privacy macOS 26) + dashboards live style Groupe KA + efforts commandés (nouveau connecteur / enrichissement). Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
-