Artykuły
Notatki o architekturze, agentach AI i LLM w produkcji — w seriach i osobnych wpisach.
Najnowsze · 21
- 07 Generator wideo, część 7: jak sprawdzam spójność postaci · Video Generator Dwie postacie, rogalik i eksperymenty w Vini Studio. Jak sprawdzam spójność bohaterów, odtwarzam błędy i zmieniam hipotezę, gdy kolejny test jej przeczy.
- · Ile firmy może pomieścić jeden człowiek? AI pozwala jednej osobie robić coraz więcej. Co wtedy zostanie z dotychczasowych zespołów — i ile decyzji udźwignie sam człowiek?
- 02 CRM na Markdownie, część 2: 27 godzin, 23 commity i katalog porażek · CRM на Markdown Anatomia CRM-a na Markdownie zbudowanego z agentem AI na żywym projekcie — opowiedziana przez porażki, bo to z nich wyrosła każda reguła. Cudza fraza zapisana jako głos właściciela; gotowy komentarz opublikowany pod postem obcej osoby; milczenie użytkownika wyjaśnione produktem, podczas gdy człowiek się przeprowadzał. Trzy rodzaje porażek — dane, proces, interpretacja — z mechanizmem i ceną każdej; cztery decyzje cofnięte w kilka godzin po podjęciu; i główna lekcja całego przedsięwzięcia: reguła bez strażnika nie przeżywa — nawet u tego, kto tę regułę napisał dwa akapity wyżej.
- 01 CRM na Markdownie, część 1: jak stworzyć CRM w jeden wieczór — krok po kroku, z agentem AI, który sam szuka leadów · CRM на Markdown Przewodnik krok po kroku po działającym CRM-ie bez bazy danych, SaaS-a i zależności: instalujesz Claude Cowork albo Claude Code, dodajesz skill md-crm dwiema komendami lub jednym ZIP-em, podłączasz rozszerzenie Chrome — a agent robi triage wyników wyszukiwania LinkedIn, które przewijasz, zakłada karty kontaktów i nie pozwala tablicy kłamać. Rozmawiasz z nim zwykłymi słowami: dodaj kontakt, zapisz jej odpowiedź, co się pali. Ten sam szkielet działa jako ATS do rekrutacji. Na końcu — co agent bierze na siebie, a co zostaje przy człowieku — i kontakt, jeśli chcesz to samo pod swój lejek.
- 11 My Architect, część 11: osiemset commitów, których nie napisałem · My Architect Nie demo, tylko żywy projekt — pipeline wideo, 802 commity w 78 dni, a w nim front, backend, render wideo, pythonowe sidecary i modele od pięciu dostawców; wszystko to trzyma my_architect. W środku: prawdziwe liczby z trackera (650 węzłów, 296 wymagań, 63 RFC), jak wymaganie jest spięte z commitem i testem przez bramkę pokrycia, która wywala build, dlaczego przed kodem rysuję wireframe'y w HTML, co commity naprawdę mierzą w historii „oddaję zadanie na noc i rano jest zrobione” — doba ma dwa garby, a poranne commity są dwa razy większe od dziennych — i dlaczego to wszystko otwiera zespołom drzwi, zamiast je zamykać.
- 06 Od płótna do studia: biblioteka, równoległe uruchamianie i automatyczna oprawa klipów · Video Generator Wcześniej płótno składało pojedynczy klip. Teraz ma nazwę — Vini Studio — i z grafu wyrosło w przestrzeń roboczą, w której klipy da się robić seriami. W środku: dlaczego biblioteka elementów i cache renderu to jeden mechanizm nad tabelą artefaktów; menedżer promptów z szablonami systemowymi i własnymi; węzeł, który ściska poprzedni odcinek do tysiąca tokenów pamięci; równoległe uruchamianie i bug sortowania topologicznego, przez który sceny startowały przed scenarzystą; napisy nie z mojego scenariusza, a z tego, co naprawdę powiedziano w kadrze; system projektowy wygenerowany jednym promptem i render oprawy na Remotion. Plus szczerze o liczbach — dwanaście dolarów za klip i 22% dooglądań.
- 05 Te same postacie w klipach AI: uniwersalne elementy zamiast pierwszej klatki · Video Generator W drugim odcinku "Szeryfa Ziemniaka" postaci przybyło i trik z pierwszą klatką przestał wystarczać — żeby bohaterowie nie rozjeżdżali się między scenami, przestawiłem płótno na referencje, moje "uniwersalne elementy". W środku: dlaczego modele wideo każą wybierać między pierwszą klatką a elementami (i dlaczego Kling to wyjątek), ile kosztuje 8 sekund na Grok, Gemini i Seedance, trik z 480p, tagi ImageRef i znaki szczególne bohaterów. Plus szczery rozbiór bugów szóstej sceny — i gotowy odcinek na końcu.
- 04 Moje węzłowe płótno do wideo: składam cały klip na jednym grafie · Video Generator Pierwsze trzy części rozbierały pipeline na kawałki — LLM dla scenarzysty, model wideo, storyboard. Tutaj pokazuję całe płótno naraz: mój własny edytor węzłowy na litegraph i rdzeniu ComfyUI, gdzie Claude pisze scenariusz, postacie żyją jako wielokrotnego użytku „dusze", a trik „jedna klatka → wideo" trzyma zawiązanie sceny. Plus pierwszy klip, który płótno złożyło samo, i bug „kapuściany kapelusz".
- 10 My Architect, część 10: pamięć repozytorium — graf kodu, któremu nie wolno wierzyć na słowo · My Architect Ciąg dalszy historii recursive-context: cztery wydania w jeden dzień uczą agenta trwałego grafu kodu (Graphify) pod ścisłymi regułami nieufności — bramka świeżości, fakty tylko z żywych plików. Plus kontrolowany test A/B „graf kontra grep" na NestJS: −71% tokenów w klasie „zrozumienie", parytet w pozostałych — i ukryte koszty sub-agentów, przez które naiwne benchmarki kłamią.
- 09 My Architect, część 9: Recursive context — jak nauczyliśmy agenta uczciwie mówić, czego nie przeczytał · My Architect Od artykułu MIT o Recursive Language Models do skilla recursive-context w jeden dzień: dlaczego ogromne okno kontekstowe nie rozwiązuje problemu dużych danych, jak fan-out izolowanych sub-agentów z uczciwym pokryciem zastąpił bibliotekę Pythona i co wyszło dopiero w żywych przebiegach — od baseline'u, który okazał się zbyt dobry, po bug w 14 milisekund.
- 08 My Architect, część 8: Event Storming jako kontrola sekwencji, a nie kolejny diagram · My Architect Diagram-obrazek niczego nie sprawdza. Event Storming sprawdza: każde zdarzenie ma przyczynę, każda komenda skutek. Jak agent przepuszcza tablicę przez deterministyczny analizator sekwencji, domyka mechaniczne luki do zera i zostawia nierozwiązane pytania biznesowe na widoku. Na żywym projekcie Forklift — 5 kontekstów, 17 wyłapanych luk.
- 03 Storyboard przed wideo: widzę cały klip z wyprzedzeniem — i poprawiam scenariusz, póki to tanie · Video Generator Między scenarzystą a modelem wideo w moim pipeline pojawiła się warstwa, która zmieniła wszystko — storyboard. Ołówkowy storyboard pokazuje cały klip, zanim wydam sekundę na wideo: czytam go, wyłapuję płaską kwestię albo zgubioną postać i poprawiam scenariusz, póki kosztuje to grosze, a nie po drogiej generacji wideo. W środku — czterostopniowa ewolucja, moje pełne prompty i bonusowo porównanie czterech modeli, które rysują ten storyboard.
- 02 Grok Imagine 1.5: testuję nowy model wideo — wrażenia i porównanie · Video Generator Wyszedł Grok Imagine 1.5 — świeży model wideo od xAI z natywnym dźwiękiem i lip-synciem. Przepuściłem go przez swój pipeline na specjalnie trudnej scenie i porównałem z Seedance 2.0, Kling v3 i Veo 3.1. W środku — cztery wideo, moje wrażenia z Grokiem i uczciwy rozbiór: gdzie wygrywa, a gdzie nie.
- 01 Jak wybrać LLM do produkcji: ślepa, międzydostawcza ocena · Video Generator Jedno wywołanie LLM wyznacza sufit jakości każdego wideo w moim pipeline — i jest płacone przy każdym. Przetestowałem cztery modele na ślepo, międzydostawczo, na prawdziwym produkcyjnym prompcie. Najnowszy model wygrał wąską metrykę i przegrał ogólnie. Metoda i decyzja „jakość za dolara".
- 07 My Architect, część 7: Obsidian, Claude Code docs i OpenClaw — notatki z pola · My Architect Każdego z nich próbowałem w jednym celu: być produktywnym w realnych projektach z AI. Jaką pracę naprawdę wykonują Obsidian, podejście docs w Claude Code i OpenClaw, gdzie każdy ma sufit i czego mnie to nauczyło o pamięci projektu.
- 06 My Architect, część 6: strona człowieka — WBS, Building Blocks i User Story Map · My Architect Cała seria była o agencie, ta część jest o mnie. Jak architekt używa My Architect ręcznie: WBS na building blocks, User Story Map do priorytetyzacji i dlaczego diagram, który wykonuje agent, bije każdą tablicę.
- 05 My Architect, część 5: dystrybucja skilli i MCP przez marketplace Claude Code · My Architect Serwer MCP, skill i cztery slash commands wymagały kiedyś instalacji według instrukcji. Plugin marketplace Claude Code sprowadza ją do dwóch komend: jak działa manifest, dlaczego skill żyje w publicznym repozytorium i ile kosztuje dyscyplina wersji. Finał serii.
- 04 My Architect, część 4: cykl pracy agenta · My Architect Jak agent prowadzi projekt tygodniami: get_next_task wybiera pracę, dokumentacja jest aktualizowana na bieżąco, odłożone rzeczy stają się węzłami, a /reconcile zestawia plan z realnym kodem.
- 03 My Architect, część 3: model planowania, dzięki któremu agent myśli jak architekt · My Architect Jak My Architect modeluje projekt, żeby agent planował jak architekt: hierarchia węzłów z presetami, cztery typy wymagań dziedziczone w dół drzewa, linter nazw i User Story Map jako tekst. Trzeci wpis serii.
- 02 My Architect, część 2: architektura bez bazy danych · My Architect Pliki to wybór agent-native, baza danych jest tu zbędnym balastem. YAML i Markdown jako storage: atomowy zapis przez rename, mutex projektu po realnym bugu z utratą danych, synchronizacja na żywo przez chokidar i WebSocket.
- 01 My Architect, część 1: pamięć i plan dla agenta AI · My Architect Agent AI zapomina projekt po każdej sesji. Jak My Architect utrzymuje plan, wymagania i decyzje między sesjami: człowiekowi UI, agentowi MCP. Pierwszy wpis z serii siedmiu.
Seria · 01–07
Video Generator
- 01 Jak wybrać LLM do produkcji: ślepa, międzydostawcza ocena Jedno wywołanie LLM wyznacza sufit jakości każdego wideo w moim pipeline — i jest płacone przy każdym. Przetestowałem cztery modele na ślepo, międzydostawczo, na prawdziwym produkcyjnym prompcie. Najnowszy model wygrał wąską metrykę i przegrał ogólnie. Metoda i decyzja „jakość za dolara".
- 02 Grok Imagine 1.5: testuję nowy model wideo — wrażenia i porównanie Wyszedł Grok Imagine 1.5 — świeży model wideo od xAI z natywnym dźwiękiem i lip-synciem. Przepuściłem go przez swój pipeline na specjalnie trudnej scenie i porównałem z Seedance 2.0, Kling v3 i Veo 3.1. W środku — cztery wideo, moje wrażenia z Grokiem i uczciwy rozbiór: gdzie wygrywa, a gdzie nie.
- 03 Storyboard przed wideo: widzę cały klip z wyprzedzeniem — i poprawiam scenariusz, póki to tanie Między scenarzystą a modelem wideo w moim pipeline pojawiła się warstwa, która zmieniła wszystko — storyboard. Ołówkowy storyboard pokazuje cały klip, zanim wydam sekundę na wideo: czytam go, wyłapuję płaską kwestię albo zgubioną postać i poprawiam scenariusz, póki kosztuje to grosze, a nie po drogiej generacji wideo. W środku — czterostopniowa ewolucja, moje pełne prompty i bonusowo porównanie czterech modeli, które rysują ten storyboard.
- 04 Moje węzłowe płótno do wideo: składam cały klip na jednym grafie Pierwsze trzy części rozbierały pipeline na kawałki — LLM dla scenarzysty, model wideo, storyboard. Tutaj pokazuję całe płótno naraz: mój własny edytor węzłowy na litegraph i rdzeniu ComfyUI, gdzie Claude pisze scenariusz, postacie żyją jako wielokrotnego użytku „dusze", a trik „jedna klatka → wideo" trzyma zawiązanie sceny. Plus pierwszy klip, który płótno złożyło samo, i bug „kapuściany kapelusz".
- 05 Te same postacie w klipach AI: uniwersalne elementy zamiast pierwszej klatki W drugim odcinku "Szeryfa Ziemniaka" postaci przybyło i trik z pierwszą klatką przestał wystarczać — żeby bohaterowie nie rozjeżdżali się między scenami, przestawiłem płótno na referencje, moje "uniwersalne elementy". W środku: dlaczego modele wideo każą wybierać między pierwszą klatką a elementami (i dlaczego Kling to wyjątek), ile kosztuje 8 sekund na Grok, Gemini i Seedance, trik z 480p, tagi ImageRef i znaki szczególne bohaterów. Plus szczery rozbiór bugów szóstej sceny — i gotowy odcinek na końcu.
- 06 Od płótna do studia: biblioteka, równoległe uruchamianie i automatyczna oprawa klipów Wcześniej płótno składało pojedynczy klip. Teraz ma nazwę — Vini Studio — i z grafu wyrosło w przestrzeń roboczą, w której klipy da się robić seriami. W środku: dlaczego biblioteka elementów i cache renderu to jeden mechanizm nad tabelą artefaktów; menedżer promptów z szablonami systemowymi i własnymi; węzeł, który ściska poprzedni odcinek do tysiąca tokenów pamięci; równoległe uruchamianie i bug sortowania topologicznego, przez który sceny startowały przed scenarzystą; napisy nie z mojego scenariusza, a z tego, co naprawdę powiedziano w kadrze; system projektowy wygenerowany jednym promptem i render oprawy na Remotion. Plus szczerze o liczbach — dwanaście dolarów za klip i 22% dooglądań.
- 07 Generator wideo, część 7: jak sprawdzam spójność postaci Dwie postacie, rogalik i eksperymenty w Vini Studio. Jak sprawdzam spójność bohaterów, odtwarzam błędy i zmieniam hipotezę, gdy kolejny test jej przeczy.
Seria · 01–02
CRM на Markdown
- 01 CRM na Markdownie, część 1: jak stworzyć CRM w jeden wieczór — krok po kroku, z agentem AI, który sam szuka leadów Przewodnik krok po kroku po działającym CRM-ie bez bazy danych, SaaS-a i zależności: instalujesz Claude Cowork albo Claude Code, dodajesz skill md-crm dwiema komendami lub jednym ZIP-em, podłączasz rozszerzenie Chrome — a agent robi triage wyników wyszukiwania LinkedIn, które przewijasz, zakłada karty kontaktów i nie pozwala tablicy kłamać. Rozmawiasz z nim zwykłymi słowami: dodaj kontakt, zapisz jej odpowiedź, co się pali. Ten sam szkielet działa jako ATS do rekrutacji. Na końcu — co agent bierze na siebie, a co zostaje przy człowieku — i kontakt, jeśli chcesz to samo pod swój lejek.
- 02 CRM na Markdownie, część 2: 27 godzin, 23 commity i katalog porażek Anatomia CRM-a na Markdownie zbudowanego z agentem AI na żywym projekcie — opowiedziana przez porażki, bo to z nich wyrosła każda reguła. Cudza fraza zapisana jako głos właściciela; gotowy komentarz opublikowany pod postem obcej osoby; milczenie użytkownika wyjaśnione produktem, podczas gdy człowiek się przeprowadzał. Trzy rodzaje porażek — dane, proces, interpretacja — z mechanizmem i ceną każdej; cztery decyzje cofnięte w kilka godzin po podjęciu; i główna lekcja całego przedsięwzięcia: reguła bez strażnika nie przeżywa — nawet u tego, kto tę regułę napisał dwa akapity wyżej.
Seria · 01–11
My Architect
- 01 My Architect, część 1: pamięć i plan dla agenta AI Agent AI zapomina projekt po każdej sesji. Jak My Architect utrzymuje plan, wymagania i decyzje między sesjami: człowiekowi UI, agentowi MCP. Pierwszy wpis z serii siedmiu.
- 02 My Architect, część 2: architektura bez bazy danych Pliki to wybór agent-native, baza danych jest tu zbędnym balastem. YAML i Markdown jako storage: atomowy zapis przez rename, mutex projektu po realnym bugu z utratą danych, synchronizacja na żywo przez chokidar i WebSocket.
- 03 My Architect, część 3: model planowania, dzięki któremu agent myśli jak architekt Jak My Architect modeluje projekt, żeby agent planował jak architekt: hierarchia węzłów z presetami, cztery typy wymagań dziedziczone w dół drzewa, linter nazw i User Story Map jako tekst. Trzeci wpis serii.
- 04 My Architect, część 4: cykl pracy agenta Jak agent prowadzi projekt tygodniami: get_next_task wybiera pracę, dokumentacja jest aktualizowana na bieżąco, odłożone rzeczy stają się węzłami, a /reconcile zestawia plan z realnym kodem.
- 05 My Architect, część 5: dystrybucja skilli i MCP przez marketplace Claude Code Serwer MCP, skill i cztery slash commands wymagały kiedyś instalacji według instrukcji. Plugin marketplace Claude Code sprowadza ją do dwóch komend: jak działa manifest, dlaczego skill żyje w publicznym repozytorium i ile kosztuje dyscyplina wersji. Finał serii.
- 06 My Architect, część 6: strona człowieka — WBS, Building Blocks i User Story Map Cała seria była o agencie, ta część jest o mnie. Jak architekt używa My Architect ręcznie: WBS na building blocks, User Story Map do priorytetyzacji i dlaczego diagram, który wykonuje agent, bije każdą tablicę.
- 07 My Architect, część 7: Obsidian, Claude Code docs i OpenClaw — notatki z pola Każdego z nich próbowałem w jednym celu: być produktywnym w realnych projektach z AI. Jaką pracę naprawdę wykonują Obsidian, podejście docs w Claude Code i OpenClaw, gdzie każdy ma sufit i czego mnie to nauczyło o pamięci projektu.
- 08 My Architect, część 8: Event Storming jako kontrola sekwencji, a nie kolejny diagram Diagram-obrazek niczego nie sprawdza. Event Storming sprawdza: każde zdarzenie ma przyczynę, każda komenda skutek. Jak agent przepuszcza tablicę przez deterministyczny analizator sekwencji, domyka mechaniczne luki do zera i zostawia nierozwiązane pytania biznesowe na widoku. Na żywym projekcie Forklift — 5 kontekstów, 17 wyłapanych luk.
- 09 My Architect, część 9: Recursive context — jak nauczyliśmy agenta uczciwie mówić, czego nie przeczytał Od artykułu MIT o Recursive Language Models do skilla recursive-context w jeden dzień: dlaczego ogromne okno kontekstowe nie rozwiązuje problemu dużych danych, jak fan-out izolowanych sub-agentów z uczciwym pokryciem zastąpił bibliotekę Pythona i co wyszło dopiero w żywych przebiegach — od baseline'u, który okazał się zbyt dobry, po bug w 14 milisekund.
- 10 My Architect, część 10: pamięć repozytorium — graf kodu, któremu nie wolno wierzyć na słowo Ciąg dalszy historii recursive-context: cztery wydania w jeden dzień uczą agenta trwałego grafu kodu (Graphify) pod ścisłymi regułami nieufności — bramka świeżości, fakty tylko z żywych plików. Plus kontrolowany test A/B „graf kontra grep" na NestJS: −71% tokenów w klasie „zrozumienie", parytet w pozostałych — i ukryte koszty sub-agentów, przez które naiwne benchmarki kłamią.
- 11 My Architect, część 11: osiemset commitów, których nie napisałem Nie demo, tylko żywy projekt — pipeline wideo, 802 commity w 78 dni, a w nim front, backend, render wideo, pythonowe sidecary i modele od pięciu dostawców; wszystko to trzyma my_architect. W środku: prawdziwe liczby z trackera (650 węzłów, 296 wymagań, 63 RFC), jak wymaganie jest spięte z commitem i testem przez bramkę pokrycia, która wywala build, dlaczego przed kodem rysuję wireframe'y w HTML, co commity naprawdę mierzą w historii „oddaję zadanie na noc i rano jest zrobione” — doba ma dwa garby, a poranne commity są dwa razy większe od dziennych — i dlaczego to wszystko otwiera zespołom drzwi, zamiast je zamykać.