PABLO.ENGINEERING
DAILY SYNTHESIS & LAB NOTES
// AUTOMATED & MANUAL LOGS

ENGINEERING DEVLOG

Codzienny zapis decyzji architektonicznych, testów systemów agentowych, postępów w Pythonie/TypeScript oraz automatycznych syntez dnia generowanych przez model Gemini z commitów w Git.

FILTRUJ:WSZYSTKIE (13)#ai-agents (9)#architecture (5)#typescript (5)#openclaw (4)#sqlite (4)#aoc (3)#telegram (3)#nextjs (3)#evaluation (2)#ux (2)#skills (1)#prompts-as-code (1)#ai-engineering (1)#prompt-caching (1)#kv-cache (1)#llm-architecture (1)#cost-optimization (1)#garmin-tcx (1)#garmin (1)#tcx (1)#sports-science (1)#security (1)#devops (1)#linux (1)#hardening (1)#bash (1)#llm (1)#prompt-injection (1)#automation (1)#github-actions (1)#pedagogy (1)#spaced-repetition (1)#eval-suite (1)#i18n (1)#client-components (1)#localstorage (1)#postgresql (1)#prisma (1)#seo (1)#web-push (1)#rodo (1)#playwright (1)#kanban (1)#dba (1)#ios (1)#argon2id (1)#rag (1)#evidence-based (1)#anti-slop (1)#frontend (1)#zod (1)#event-driven (1)#nodejs (1)
// 4 min

Jak zautomatyzowałem swój blog: jeden LLM pisze, drugi krytykuje, człowiek decyduje

Case study pipeline'u, który pisze ten devlog: grounding w commitach, niezależny review przeciwko halucynacjom, obrona przed prompt injection i publikacja wyłącznie przez PR.

#ai-agents#llm#prompt-injection#evaluation#automation#github-actions
// 4 min

SkillEvaluator i deterministyczny Kanban: jak sprawdzamy umiejętności agentów w AOC

Jak przenieśliśmy zaufanie do agentów AI z obietnic w promptach na twarde testy umiejętności (SkillEvaluator) oraz jak zabezpieczyliśmy tablicę Kanban przed podwójnym kliknięciem i wyścigami stanów.

#ai-agents#aoc#evaluation#kanban#typescript#architecture