ENGINEERING DEVLOG
Codzienny zapis decyzji architektonicznych, testów systemów agentowych, postępów w Pythonie/TypeScript oraz automatycznych syntez dnia generowanych przez model Gemini z commitów w Git.
Prompts as Code: Ewolucja systemów agentowych i dekompozycja skilli w AOC
Przejście z monolitycznych instrukcji systemowych na granularne umiejętności (Skills) w Agent Operations Center. Architektura Prompts as Code, izolacja kontekstu i automatyczna bramka jakościowa Tier 1 & Tier 2.
SkillEvaluator i deterministyczny Kanban: jak sprawdzamy umiejętności agentów w AOC
Jak przenieśliśmy zaufanie do agentów AI z obietnic w promptach na twarde testy umiejętności (SkillEvaluator) oraz jak zabezpieczyliśmy tablicę Kanban przed podwójnym kliknięciem i wyścigami stanów.
Szlifowanie detali w AOC: od uciekających pikseli po bezpieczne kopie bazy SQLite
Jak zlikwidowaliśmy błąd krzyżowania projektów w Kanbanie, naprawiliśmy asymetrię przycisków na ekranie smartfona i wdrożyliśmy bezstresowy backup bazy SQLite w trybie WAL.
Anti-Slop Guardrails: jak oduczyłem agenta AI oszukiwania w kodzie TypeScript
Wdrożenie twardych reguł inżynierskich dla programistycznych agentów AI w AOC: zakaz compiler bluffing (as unknown as T), wymuszona walidacja Zod na wejściu i bezpieczne typowanie frontendowe.
Jak przyspieszyłem reakcję agentów AI w AOC: od powolnego sprawdzania bazy do lekkich procesów w tle
Historia o tym, jak zastąpiliśmy sprawdzanie bazy co kilka sekund natychmiastowym odpalaniem skryptu w tle za pomocą child.unref() w Node.js oraz jak podzieliliśmy pracę na 8 wyspecjalizowanych ról agentów.