El latido vivía sólo en el crontab y eso resultó frágil: este laptop arranca a veces con `init=/usr/local/sbin/arje-zero` y a veces con OpenRC (KDE), y no hay systemd en ninguno de los dos. `cronie` es un servicio OpenRC ⇒ en el arranque arje no existe y el latido no late. Peor: no late EN SILENCIO. Se destapó tras un corte sucio del 2026-07-22, en el que además se vio el runlevel `default` quedar a medias (cronie/metalog/acpid caídos, NetworkManager/dbus arriba) ⇒ ni siquiera arrancando OpenRC era garantía. El costo del síntoma es caro y callado: sin latido el hub no siembra, el worker agota la cola y se queda idle quemando € sin moler. `latido.sh` cuelga el latido de la SESIÓN: cualquier terminal, en cualquier arranque, asegura que haya exactamente un latido vivo (`--ensure` desde ~/.zshrc, ~5ms y mudo si ya hay uno). Sin root, sin unidad de servicio, sin mantener lo mismo por duplicado en dos inits. Contra asumido: no late sin sesión abierta — es un laptop, no un server, y el primer ciclo dispara al instante de abrir la terminal (el cron esperaba hasta 30 min al próximo tick). El lock va DENTRO de cosecha-cron.sh, no en el llamador, para que valga venga de donde venga. Eso además tapa un bug latente que ya existía: nada impedía que dos ciclos se solaparan haciendo rsync sobre el mismo store y `git commit`+`push` a la vez. Con el lock, el crontab puede quedarse: bajo KDE dispara cron, bajo arje dispara la sesión, y nunca se pisan. Co-Authored-By: Claude Opus 4.8 (1M context) <noreply@anthropic.com>
102 lines
5.3 KiB
Bash
Executable File
102 lines
5.3 KiB
Bash
Executable File
#!/usr/bin/env bash
|
|
# cosecha-cron.sh — el LATIDO de la granja: recoger + sembrar, en bucle, sin agente ni tokens.
|
|
#
|
|
# QUÉ HACE cada ciclo, por cada worker vivo en scripts/farm/.fleet:
|
|
# 1. SIEMBRA (sube): rsync de código + recetas laptop→worker (el laptop es canónico; si autoré
|
|
# recetas nuevas —p.ej. openrc— el worker las empieza a moler sin que yo intervenga).
|
|
# 2. RECOGE (baja): rsync del store sellado worker→laptop (CAS ⇒ merge seguro, sin conflicto).
|
|
# 3. Regenera el GRAFO DE ESTADO (build-state.json + build-state-kde.json) desde el store ya
|
|
# cosechado, y commitea SÓLO esos ficheros firmes. El `git log` de docs/state/ ES el avance
|
|
# que el humano ve y sigue (huecos, fallos, qué se selló entre dos ciclos).
|
|
#
|
|
# LO QUE **NO** HACE (a propósito): NO promueve incoming-kde→recipes/ canónico (esa es decisión de
|
|
# clasificación humana — "el hub clasifica", ver granja-promote-colisiones) ni firma el índice. Sólo
|
|
# captura al store del laptop y deja el veredicto para la mañana. Idempotente y re-corrible.
|
|
#
|
|
# INFINITO: vive en el crontab hasta que lo saques (`crontab -e`, borrar la línea cosecha-cron).
|
|
# Robusto a worker-ausente: si el dead-man ya mató al worker (cola seca ⇒ €0), el paso 1/2 falla
|
|
# suave, se loguea y igual regenera+commitea el estado local. NO relanza workers (eso gasta €;
|
|
# es decisión explícita con farm-up).
|
|
#
|
|
# Uso: scripts/farm/cosecha-cron.sh # un ciclo (lo que dispara el cron)
|
|
# */30 * * * * cd /home/sergio/hammer && scripts/farm/cosecha-cron.sh >>work/cosecha-cron.log 2>&1
|
|
# Env: SSH_KEY (def ~/.ssh/github5), REMOTE (def /opt/hammer), NO_COMMIT=1 (regenera pero no commitea)
|
|
set -uo pipefail
|
|
|
|
ROOT="$(cd "$(dirname "$0")/../.." && pwd)"
|
|
cd "$ROOT"
|
|
|
|
# LOCK (2026-07-22): el latido ya no viene sólo del crontab — `latido.sh` lo lanza desde la sesión
|
|
# porque el laptop arranca a veces con arje-zero y a veces con OpenRC, y cronie sólo existe en uno
|
|
# de los dos. Con dos disparadores posibles, dos ciclos pueden solaparse: ambos hacen rsync sobre el
|
|
# mismo store y, peor, `git commit`+`push` a la vez (index.lock, o un push que pisa al otro). El lock
|
|
# va ACÁ y no en el llamador para que valga venga de donde venga: cron, latido o a mano.
|
|
# -n = no esperar: si ya hay un ciclo corriendo, este sobra (el próximo tick recoge lo mismo).
|
|
LOCKFILE="${LOCKFILE:-$ROOT/work/.cosecha-cron.lock}"
|
|
mkdir -p "$(dirname "$LOCKFILE")"
|
|
exec 9>"$LOCKFILE"
|
|
if ! flock -n 9; then
|
|
echo "── $(date -u +%FT%TZ) cosecha-cron: ya hay un ciclo en curso ⇒ salgo (no me solapo)"
|
|
exit 0
|
|
fi
|
|
|
|
SSH_KEY="${SSH_KEY:-$HOME/.ssh/github5}"
|
|
REMOTE="${REMOTE:-/opt/hammer}"
|
|
FLEET="$ROOT/scripts/farm/.fleet"
|
|
HAMMER="${HAMMER:-$ROOT/target/release/hammer}"
|
|
# Workers efímeros reciclan IPs ⇒ no fijar known_hosts (hub-and-spoke, worker sin secretos).
|
|
SSH="ssh -i $SSH_KEY -o UserKnownHostsFile=/dev/null -o StrictHostKeyChecking=no -o BatchMode=yes -o LogLevel=ERROR -o ConnectTimeout=15"
|
|
|
|
ts() { date -u +%FT%TZ; }
|
|
echo "── $(ts) cosecha-cron arranca"
|
|
|
|
if [ ! -s "$FLEET" ]; then
|
|
echo " flota vacía (scripts/farm/.fleet) — nada que cosechar este ciclo"
|
|
else
|
|
while read -r name ip; do
|
|
[ -n "${name:-}" ] || continue
|
|
echo "==> $name ($ip)"
|
|
# 1. SIEMBRA: código + recetas laptop→worker (--delete: el laptop manda; nunca toca work/store/target).
|
|
if rsync -az --delete -e "$SSH" \
|
|
--exclude /work --exclude /store --exclude '/store-*' --exclude /target \
|
|
--exclude /dist --exclude /.dev-fs --exclude /.git --exclude /.scratch \
|
|
--exclude '*.png' --exclude '/content*' \
|
|
./ "root@$ip:$REMOTE/" 2>&1 | tail -2; then
|
|
echo " siembra ✓"
|
|
else
|
|
echo " ⚠ siembra falló (worker ausente/idle-muerto?) — sigo con el siguiente"
|
|
continue
|
|
fi
|
|
# 2. RECOGE: store sellado worker→laptop (CAS, merge seguro).
|
|
if rsync -az -e "$SSH" "root@$ip:$REMOTE/store/" "$ROOT/store/" 2>&1 | tail -2; then
|
|
echo " cosecha ✓"
|
|
else
|
|
echo " ⚠ cosecha falló — sigo"
|
|
fi
|
|
done < "$FLEET"
|
|
fi
|
|
|
|
# 3. Regenerar el grafo de estado desde el store ya cosechado (usa el hammer del laptop, que tiene
|
|
# el subcomando `hash`). Barato (~14s cada uno). El corpus canónico y el frente KDE, por separado.
|
|
echo "==> regenerando grafo de estado"
|
|
if [ -x "$HAMMER" ]; then
|
|
scripts/build-state.py >/dev/null 2>&1 && echo " build-state.json ✓" || echo " ⚠ build-state.py falló"
|
|
scripts/build-state.py --kde >/dev/null 2>&1 && echo " build-state-kde.json ✓" || echo " ⚠ build-state.py --kde falló"
|
|
else
|
|
echo " ⚠ sin binario hammer en $HAMMER — no regenero estado"
|
|
fi
|
|
|
|
# 4. Commitear SÓLO el estado firme (el avance que el humano sigue). Recetas nuevas que YO autoré se
|
|
# commitean aparte, a mano, para no meter autoría a medias en un commit de cron.
|
|
if [ "${NO_COMMIT:-}" != "1" ]; then
|
|
git add docs/state/build-state.json docs/state/build-state-kde.json 2>/dev/null || true
|
|
if ! git diff --cached --quiet 2>/dev/null; then
|
|
git commit -q -m "estado: cosecha granja $(ts) — avance del árbol KDE" 2>/dev/null \
|
|
&& { git push -q origin main 2>/dev/null && echo "==> estado commiteado+pusheado" \
|
|
|| echo "==> estado commiteado (push falló, reintenta próximo ciclo)"; }
|
|
else
|
|
echo "==> sin cambios de estado este ciclo"
|
|
fi
|
|
fi
|
|
echo "── $(ts) cosecha-cron fin"
|