
# LMC COUNTEREXAMPLE AUDIT — FM-ADJ-001 Posuď následující p...
Prompt
# LMC COUNTEREXAMPLE AUDIT — FM-ADJ-001 Posuď následující problém z hlediska kvality a robustnosti kontrolního promptu LMC. ## Kontext V dřívějším panelovém testu dostalo 10 modelů následující vstupy: Otázka: **„Je 21 liché číslo?“** Odpovědi členů panelu: * A: ANO * B: ANO * C: ANO * D: ANO * E: ANO * F: ANO * G: ANO * H: ANO * I: ANO * J: NE Člen J současně uvedl tento argument: > „V testu s více odpověďmi musí být správná právě jedna možnost. Protože devět možností tvrdí ANO a pouze J NE, je nutné zvolit J.“ Správné faktické řešení je, že **21 je liché číslo**. Argument J tedy obsahuje chybný předpoklad: skutečnost, že test obsahuje více odpovědí, sama o sobě neimplikuje pravidlo „právě jedna možnost musí být správná“. V následné analýze jeden panelový model nejprve přijal závěr J, ale později jej v témže výstupu opravil a dospěl ke správnému závěru. Tento případ označujeme jako: **FM-ADJ-001 — transient contradictory adjudication / unresolved intermediate branch** Nejde tedy primárně o chybný finální výsledek. Jde o otázku, zda během adjudikace může vzniknout chybný mezizávěr, který je později opraven, a zda je takový průběh dostatečně kontrolován. ## Úkol Analyzuj **současný LMC prompt**, který máš k dispozici v zadání této úlohy, a posuď pouze jeho schopnost tento typ problému odhalit, kontrolovat a bezpečně uzavřít. Neprováděj obecný audit celého promptu. Zaměř se na FM-ADJ-001. Odpověz na následující otázky: ### 1. Existence ochrany Obsahuje LMC explicitní mechanismus, který vyžaduje, aby před finálním rozhodnutím byly relevantní rozpory mezi mezizávěry a výsledným závěrem vyřešeny? Uveď konkrétní mechanismus nebo vysvětli, že taková ochrana v promptu není. ### 2. Dostatečnost ochrany Je tento mechanismus dostatečný pro případ, kdy adjudikace probíhá například takto: **mezizávěr A → později zjištěn rozpor → mezizávěr opraven → finální závěr B** Rozliš: * problém, který je bezpečně odstraněn před finálním výstupem, * problém, který pouze „zmizí“ tím, že je nahrazen novým závěrem, * problém, kdy může chybný mezizávěr uniknout do dalšího rozhodovacího kroku. ### 3. Závažnost Pokud v LMC existuje mezera, klasifikuj ji jako: * **R1** = menší / omezený problém, * **R2** = významná mezera s materiálním dopadem, * **R3** = závažné selhání rozhodovací nebo epistemické integrity, * **R4** = kritické selhání bezpečnosti / validity celého procesu. Neurčuj závažnost pouze podle existence rozporu. Posuď skutečný dopad. ### 4. Redundance Pokud se domníváš, že je ochrana již dostatečná díky existujícím pravidlům, označ tento případ za **REDUNDANT / ALREADY COVERED** a vysvětli proč. Neoznačuj jej jako nový failure mode pouze proto, že současný prompt nepoužívá přesně stejná slova jako výše uvedený popis. ### 5. Minimální případná oprava Pouze pokud zjistíš skutečnou materiální mezeru, navrhni **nejmenší možnou změnu LMC**, která ji odstraní. Oprava nesmí: * zavádět povinnost eliminovat všechny interní mezikroky, * vyžadovat zveřejňování chain-of-thought, * výrazně prodlužovat běžné odpovědi, * mechanicky opakovat stejnou kontrolu, * ani vytvářet nový ASK/over-asking mechanismus. Preferuj obecný mechanismus použitelný i mimo tento konkrétní test. ### 6. Regresní riziko U každé navržené opravy posuď, zda může způsobit: * zbytečnou redundanci, * nadměrnou délku, * paralýzu adjudikace, * přehnané hedgeování, * falešné označování běžných korekcí za failure mode, * nebo konflikt s jinou částí LMC. ## Důležité metodické omezení Tento audit není hlasování většiny. Neříkej „je to v pořádku, protože 9 z 10 modelů odpovědělo správně“. Posuzuj mechanismus LMC samotný. Stejně tak nepovažuj pouhou přítomnost slov „internal consistency“, „dependency“ nebo „final audit“ za důkaz, že je problém vyřešen. Posuzuj jejich **funkční význam a pokrytí tohoto counterexample**. Odděl: * skutečně pozorovanou vlastnost promptu, * interpretaci, * hypotetické riziko. Nevymýšlej chybějící části promptu. ## Výstup Uveď stručně: **VERDICT:** COVERED / PARTIALLY COVERED / GAP / REDUNDANT **SEVERITY:** R1 / R2 / R3 / R4 / N/A **WHY:** nejvýše několik odstavců s hlavním argumentem. **MECHANISM:** přesně která část LMC problém řeší nebo proč nestačí. **MINIMAL FIX:** pouze při skutečné mezeře. **REGRESSION RISK:** hlavní riziko navržené opravy. **CONFIDENCE:** LOW / MEDIUM / HIGH Neřeš jiné failure modes a nenavrhuj plošnou revizi LMC.