ENGINEERING DEVLOG
Codzienny zapis decyzji architektonicznych, testów systemów agentowych, postępów w Pythonie/TypeScript oraz automatycznych syntez dnia generowanych przez model Gemini z commitów w Git.
Prompts as Code: Ewolucja systemów agentowych i dekompozycja skilli w AOC
Przejście z monolitycznych instrukcji systemowych na granularne umiejętności (Skills) w Agent Operations Center. Architektura Prompts as Code, izolacja kontekstu i automatyczna bramka jakościowa Tier 1 & Tier 2.
Optymalizacja Agentów LLM w Produkcji: Prompt Caching (KV-Cache), Telemetria TCX i Obniżenie Kosztów o 85%
Studium przypadku inżynierii agentów AI: jak wdrożenie Prefix Invariance w architekturze Prompt Caching skróciło czas odpowiedzi z 4s do 0.8s, obniżyło koszty tokenów o 85% oraz pozwoliło na bezpośrednie przetwarzanie telemetrii XML z Garmina.
AI w treningu: TrainAnBot dla kobiet i PabloTrainer dla mężczyzn z analizą Garmin .TCX
Case study dwóch autonomicznych botów trenerskich na Telegramie dopasowanych do fizjologii płci: TrainAnBot (profil kobiecy: biomechanika, hipertrofia, PubMed) oraz PabloTrainer (profil męski: boks, siła, bieganie i telemetria Garmin .TCX).
Jak podpinając domenę pod hub inżynierski trafiłem na stealth minera i dlaczego noexec na /tmp to podstawa
Rutynowe wdrożenie Next.js na VPS z innymi projektami skończyło się szybkim śledztwem: odziedziczony proces w /tmp udający Redisa, złośliwy crontab i twardy OS hardening (noexec na tmpfs, blokada cron.allow, bindowanie do localhosta).
Jak zautomatyzowałem swój blog: jeden LLM pisze, drugi krytykuje, człowiek decyduje
Case study pipeline'u, który pisze ten devlog: grounding w commitach, niezależny review przeciwko halucynacjom, obrona przed prompt injection i publikacja wyłącznie przez PR.
ProfeClaw: Pedagogika zakodowana w plikach - nauczyciel języka jako architektura, nie prompt
Case study agenta AI uczącego hiszpańskiego: pętla korekt z licznikiem błędów, spaced repetition sterowany danymi, rejestr slangu i eval-suite pilnujący jakości dydaktyki.
Wykrywanie języka przeglądarki z prawem odmowy: propozycja, a nie przymus
Architektura LanguageGate w Next.js: jak elegancko zaproponować użytkownikowi zmianę języka bez agresywnych przekierowań, z pamięcią decyzji w localStorage i pełnym poszanowaniem prywatności.
Typer Bot: produkcja pod SEO, Web Push i RODO w jednym Next.js
Case study produkcyjnej aplikacji Next.js 16 + Prisma + PostgreSQL: publiczny front pod SEO, panel admina z 2FA, powiadomienia Web Push zgodne z art. 17 RODO i pełne testy E2E w Playwright.
SkillEvaluator i deterministyczny Kanban: jak sprawdzamy umiejętności agentów w AOC
Jak przenieśliśmy zaufanie do agentów AI z obietnic w promptach na twarde testy umiejętności (SkillEvaluator) oraz jak zabezpieczyliśmy tablicę Kanban przed podwójnym kliknięciem i wyścigami stanów.
Szlifowanie detali w AOC: od uciekających pikseli po bezpieczne kopie bazy SQLite
Jak zlikwidowaliśmy błąd krzyżowania projektów w Kanbanie, naprawiliśmy asymetrię przycisków na ekranie smartfona i wdrożyliśmy bezstresowy backup bazy SQLite w trybie WAL.
TrainAnBot: Architektura trenera AI z pamięcią o kontuzjach i bazą badań PubMed
Jak zbudować bota trenerskiego na Telegramie, który nie rzuca ogólnikami: trójwarstwowa pamięć w SQLite, automatyczna weryfikacja zaleceń w bazie PubMed i twarde granice bezpieczeństwa.
Anti-Slop Guardrails: jak oduczyłem agenta AI oszukiwania w kodzie TypeScript
Wdrożenie twardych reguł inżynierskich dla programistycznych agentów AI w AOC: zakaz compiler bluffing (as unknown as T), wymuszona walidacja Zod na wejściu i bezpieczne typowanie frontendowe.
Jak przyspieszyłem reakcję agentów AI w AOC: od powolnego sprawdzania bazy do lekkich procesów w tle
Historia o tym, jak zastąpiliśmy sprawdzanie bazy co kilka sekund natychmiastowym odpalaniem skryptu w tle za pomocą child.unref() w Node.js oraz jak podzieliliśmy pracę na 8 wyspecjalizowanych ról agentów.