Dostupné
Archiv feedu a projekce po řízeních
Archiv je surový záznam toho, co feed vrátil, uložený tak, jak přišel. Projekce je z něj odvozená a kdykoli znovu postavitelná offline — stejný vztah, jaký bude mít replika a projekce v produkci.
- Archivace
just isir-feed-archive <datum>, obnoveníjust isir-feed-archive-resume- Projekce
just isir-cases-project— offline, bez sítě- Běh z 9. 9. 2026
- 850 dávek, 849 935 událostí od 2026-07-01, 982 požadavků za den
- Výsledná projekce
- 82 839 řízení, 108 775 přihlášek
- Denní strop běhu
- 2500 požadavků, pod publikovanými 3000
Čísla jsou snímek jednoho běhu
849 935 událostí a 82 839 řízení je výsledek archivačního běhu z 9. září 2026 nad obdobím od 1. července 2026. Není to živý součet a s postupem času neroste — kdo chce novější čísla, pustí archivaci znovu.
Archiv obsahuje události, ne dokumenty. Přibližně 62 % událostí nese dokument, což je řádově půl milionu souborů, a při stropu 3000 požadavků denně je jejich stažení otázka měsíců, ne odpoledne. Kdo čte adresář archivu jako „rejstřík“, přeceňuje, co v něm je.
Surové dávky, checkpoint, obnovitelnost
Každá dávka 1000 událostí se ukládá gzipovaná přesně tak, jak ji služba vrátila, s řádkem v indexu: rozsah id, počet, rozsah zveřejnění, počty dokumentů a přihlášek, sha256 a velikost. Přerušený běh pokračuje z checkpointu, nikdy nezačíná znovu.
První běh spadl na 618. dávce na přetržené spojení. Odpovědí byly omezené retry s backoffem, kde každý pokus platí z rozpočtu i z denní evidence a 4xx se neretryuje nikdy — a pak pokračování z checkpointu.
Projekce jako zkouška nanečisto
Projektor čte archiv a zapisuje adresář na každé řízení: case.json s deduplikovanými a seřazenými událostmi, claims/<oddíl>/claim.json na každou přihlášku a index. Je idempotentní podle id události a běží i souběžně s probíhající archivací.
Plná projekce rovnou odhalila návrhovou chybu: puvodce je původce události, ne soud, a v rámci jednoho řízení se mění — klíčování adresářů podle něj řízení rozštěpilo. Adresáře jsou teď spisová značka; migrace složila 82 840 adresářů na 82 839 řízení.
To je přesně ta chyba, kterou by přehrání logu opravilo bez jediného nového požadavku na zdroj. Tady se to potvrdilo na skutečných datech, ještě než replika a projekce v databázi vůbec vznikly.
Kde to v repozitáři žije
scripts/archive_isir_feed.py— archivace, checkpoint, denní evidence požadavků, retry s backoffemscripts/project_isir_cases.py— offline projekce do adresáře na řízení, follow a migrace layoutudata/README.md— rozvržení lokálního úložiště a co archiv obsahuje a co nedocs/development/PROMPT_SEQUENCE_STATE.md— autoritativní stav položek fáze 0 a 1
Souvisí
Živý vzorek reálných přihlášek
DostupnéOsm skutečných přihlášek pohledávek z konkursů i s dokumenty, stažených z živého feedu pod publikovanými limity. PDF a poznámky událostí zůstávají jen lokálně; do repozitáře jde redigovaný manifest s hashi. Z něj se vzorek kdykoli znovu postaví a ověří.
Detail
Replika a checkpoint
PlánovánoAppend-only log akcí, idempotentní zápis podle ID akce a checkpoint posouvaný ve stejné transakci jako zápis. Pád bude znamenat znovunačtení dávky, nikdy její přeskočení.
Detail
Nákladový model
Čtyři ze sedmi vstupů změřené z živého archivu a vzorku (9. 9. 2026): tok dokumentů, struktura po druzích řízení, strany, textová vrstva a podíl doručenek. Rejstřík publikuje zhruba čtyři nové dokumenty na každý povolený požadavek denně — výběr dokumentů je podmínka, ne páka. Ceny OCR a LLM čekají na extrakční stupeň; rozhodnutí o rozsahu stále blokuje.
Detail