PABLO.ENGINEERING
DAILY SYNTHESIS & LAB NOTES
// AUTOMATED & MANUAL LOGS

ENGINEERING DEVLOG

Codzienny zapis decyzji architektonicznych, testów systemów agentowych, postępów w Pythonie/TypeScript oraz automatycznych syntez dnia generowanych przez model Gemini z commitów w Git.

FILTRUJ:WSZYSTKIE (59)#daily (41)#engineering (19)#ai-agents (13)#agents (12)#audit (11)#portfolio (11)#fallback (9)#eval (9)#sqlite (8)#automation (7)#openclaw (7)#maintenance (7)#telegram (6)#typescript (6)#aneta (5)#architecture (5)#devops (4)#nextjs (4)#ci-cd (4)#observability (4)#monitoring (3)#watchdog (3)#ux (3)#aoc (3)#gemini-api (3)#alerting (2)#anki (2)#resilience (2)#systemd (2)#devlog (2)#reliability (2)#spaced-repetition (2)#anti-slop (2)#cron (2)#linux (2)#security (2)#kanban (2)#seo (2)#frontend (2)#evaluation (2)#sandbox (1)#git (1)#architektura (1)#automatyzacja (1)#sre (1)#documentation (1)#agent-systems (1)#telegram-bot (1)#ops (1)#self-check (1)#memory-verifier (1)#fallback-chain (1)#error-handling (1)#retry (1)#error-classifier (1)#qa (1)#backup (1)#vps (1)#docker (1)#cleanup (1)#context-compaction (1)#accessibility (1)#llm-integration (1)#skills (1)#prompts-as-code (1)#ai-engineering (1)#prompt-caching (1)#kv-cache (1)#llm-architecture (1)#cost-optimization (1)#garmin-tcx (1)#agent-operations-center (1)#rbac (1)#garmin (1)#tcx (1)#sports-science (1)#peru (1)#mobile-ux (1)#repository-hygiene (1)#workflow (1)#chore (1)#git-hygiene (1)#llm-pipeline (1)#developer-tools (1)#llm-engineering (1)#hardening (1)#bash (1)#llm (1)#prompt-injection (1)#github-actions (1)#pedagogy (1)#eval-suite (1)#i18n (1)#client-components (1)#localstorage (1)#postgresql (1)#prisma (1)#web-push (1)#rodo (1)#playwright (1)#dba (1)#ios (1)#argon2id (1)#rag (1)#evidence-based (1)#zod (1)#event-driven (1)#nodejs (1)
// 3 min

Alerty, które milczą, i granice między agentami

Wypuściłem 11 commitów w agent-brain: wyciszenie fałszywych alertów, twarde granice workspace i narzędzi dla każdego agenta oraz planer sprzedaży w Engineering Lab & DevLog.

#daily#agents#alerting#sandbox#monitoring
// 4 min

Cztery watchery w bezczynności i dwa ciche sygnały awarii

Przepuściłem end-to-end cztery zaplanowane watchery i zebrałem dwa sygnały awarii: padnięty heartbeat cron joba oraz niestabilny odczyt SQLite w gatewayu. Sprawdziłem też, że brak aktywności w repo to prawdziwa cisza, a nie zepsuty zbierak danych.

#daily#agents#aneta#eval#monitoring#sqlite
// 5 min

Martwy slug modelu, cichy failover i jawny limit 8192 tokenów

Naprawiłem cron walidujący config, usunąłem martwy slug modelu z łańcucha fallback i domknąłem pipeline fiszek. Jawny limit 8192 tokenów zastąpił liczbę liczoną ze zgadywanego progu, a logi przestały puchnąć.

#daily#agents#aneta#eval#anki
// 4 min

Brakujący import time, atomowy zapis stanu i watchdog, który rozumie retry

Naprawiłem panel Telegram, który przy każdym odświeżeniu wysyłał nową wiadomość, oraz wyciszyłem fałszywe alarmy watchdoga floty dla tur, które same się wyleczyły przez retry. Zacząłem też analizować niestabilność read-only workera w gatewayu SQLite.

#daily#agents#telegram-bot#watchdog#sqlite
// 4 min

Zatkany tmpfs, backup bez końca i osobny błąd watchdoga

Opróżniłem 4 GB tmpfs z 98% do 6% i przeniosłem katalog tymczasowy skryptu backupu obok jego celu kopii, dzięki czemu kopia kończy się z rc=0. Równolegle zdiagnozowałem crash watchdoga, który miał zupełnie inną przyczynę niż brak miejsca.

#daily#agents#aneta#eval#ops
// 3 min

Dzień nadzoru floty agentów: fałszywy alarm i dwa throttlingi

Utrzymałem flotę agentów w ruchu przez cały dzień: skany wycieków, kontrola pamięci i quiz dzienny przeszły czysto, a dwa krótkie błędy limitu u dostawcy modeli obsłużyłem automatycznie, bez utraty pracy.

#daily#agents#watchdog#eval#reliability
// 3 min

Weryfikator pamięci złapał 1 brakujący zapis na 372

Przeskanowałem 372 rekordy pamięci, znalazłem jeden brakujący zapis i odtworzyłem 2691 znaków w pliku dziennym. Zbadałem też nowy odcisk błędu providera, który wywołał trzy nieudane tury między 17:35 a 18:05 UTC.

#daily#agents#memory-verifier#fallback-chain#alerting#eval
// 3 min

Odzyskanie nocnego przebiegu agenta i naprawa klasyfikatora błędów

Odzyskałem utracony wynik nocnego joba agenta i naprawiłem klasyfikator błędów tak, by błąd providera z malformed tool call trafiał do klasy z retry. Efekt: przejściowy błąd nie kosztuje już całego dnia pracy.

#daily#agents#retry#error-classifier#eval
// 4 min

Backup, który nie działał przez dobę: błąd kolejności argumentów w cronie

Naprawiłem zadanie backupu AOC/Hermes, które przez około 24 godziny w ogóle się nie uruchamiało z powodu złej kolejności argumentów w wrapperze crona. Dodałem stały guard w wrapperze i potwierdziłem ręczny przebieg: exit 0, świeże archiwum 48M, integralność ok.

#daily#agents#backup#cron#monitoring#aneta
// 4 min

Ograniczyłem przyrost logów i odzyskałem 1,8 GB na VPS

Zaudytowałem wszystkie źródła logów w mojej flocie agentów i wdrożyłem politykę retencji: limity dla cronów, watchdogów, kontenerów i journald. Dodałem wrapper logujący oraz przeniosłem stare artefakty z /tmp do wersjonowanego backupu.

#daily#agents#aneta#eval#observability#cleanup
// 3 min

Ślepe monitory kontekstu i zielone logi

Przepiąłem dwa monitory kontekstu na pola, które sessions API faktycznie zwraca, i dodałem strażnika schematu. Progi kompakcji 65% i 85% zaczęły działać, co potwierdziłem na żywej sesji o 06:51 UTC.

#daily#agents#context-compaction#observability#eval
// 3 min

Detektor błędów tury: od cichego logu do alertu i auto-recovery

Prześledziłem błąd providera udający 'LLM request failed' i dodałem trwały detektor błędów tury z alertem oraz auto-recovery odpowiedzi. Cicha awaria stała się głośna i mierzalna.

#daily#agents#observability#watchdog#eval