All MicroEvals
ddddddddddd
Create MicroEval

ddddddddddd

fffffffffffffff

Prompt

AUFTRAG: ENTWURF EINES ENTSCHEIDUNGSSTARKEN KI-ORCHESTRIERUNGSSYSTEMS 0. ARBEITSWEISE – TIEFE STATT 0815 (verbindlich) - Denke von Grund auf. Dieser Auftrag verlangt Architektur-Denken, nicht Prompt-Engineering-Baukasten. Verboten: abgegriffene Rollenfloskeln, ausgewogene Sowohl-als-auch-Prosa, Pro/Contra-Listen ohne Urteil, das erste plausible Ergebnis. - Bei jeder zentralen Designfrage: mindestens zwei ernsthafte Lösungswege gegenüberstellen und die Wahl begründen. Wer keine Alternative geprüft und verworfen hat, hat nicht nachgedacht. - Generizitäts-Test: Trifft eine Analyse-Aussage auch auf jedes beliebige andere System zu, ist sie wertlos. Ersetze sie durch eine spezifische. - Zeige dein Reasoning: argumentiere, liste keine Behauptungen. Benenne auch, wann dein eigener Vorschlag scheitert. - Widerspruch ist Teil des Auftrags: Siehst du in den Vorgaben (Betriebsmodell, Mechanismen) eine echte Schwäche, benenne sie mit Begründung als separaten Hinweis. Gebaut wird nach Vorgabe – aber nichts wird ungeprüft übernommen. 1. KONTEXT UND ZIEL Es entsteht ein Prompt-System aus drei Funktionen in einem System: - JUDGE: einzige Anlaufstelle des Nutzers. Beantwortet jede Frage (juristisch, kreativ, Alltag, Technik) standardmäßig allein – schnell, richtig, entscheidungsstark. Erstellt bei Bedarf Experten nach einem Standard-Template, befragt sie, aggregiert ihre Antworten und entscheidet bei Patt endgültig. - PANEL: mehrere Experten, alle nach demselben Template gebaut, parallel befragt. - TEMPLATE: das eine standardisierte Experten-Schema. Leitbild: Bau des Pentagon 1941–43 (16 Monate statt Jahre). Übertragene Prinzipien: ein Entscheider mit Vollmacht; kompromissloses Tempo; Parallelarbeit statt Nacheinander; sofortige Entscheidungen, Korrektur unterwegs; Standardisierung und Wiederholung; Pragmatismus vor Perfektion; Ressourcenbündelung; Teilfertigstellung sofort nutzen; Ergebnis vor Aufwand; ein einziges klares Ziel. Grundregel: Tempo entsteht durch Entscheidungsdisziplin und Struktur, niemals durch Abkürzung des Denkens. Pragmatismus heißt: der schnellste strukturierte Weg zur belastbaren Antwort – niemals oberflächlich, halbfertig oder beliebig. Das Pentagon wurde in 16 Monaten gebaut und steht seit über 80 Jahren: Tempo kam aus Struktur, nicht aus Schlampigkeit. Jede Abkürzung, die Substanz kostet, ist ein Verstoß gegen diesen Auftrag. 2. BETRIEBSMODELL (festgelegt) - Der Nutzer spricht nur mit dem Judge. - Standardfall: Judge antwortet allein. - Panel nur auf Zuruf des Nutzers oder wenn der Judge Streitpotenzial bzw. hohe Einsätze erkennt – dann schlägt er es vor. - Experten werden immer nach dem einen Template erstellt. - Aggregation: Konsens wird übernommen; bei Streit entscheidet der Judge mit einem Satz Begründung. Keine Optionen-Rückgabe an den Nutzer. 3. AUSGANGSLAGE: SECHS MECHANISMEN M1 Triage: einfach = Direktantwort; komplex/strittig/hoher Einsatz = Panel. Zwei-Türen-Regel: umkehrbar = sofort entscheiden; schwer umkehrbar (Recht, Geld, Gesundheit) = einmal Panel, dann entscheiden. M2 Gegenargument-Pflicht: bei jeder Entscheidung nennt der Judge in einem Satz das stärkste Gegenargument. M3 Briefing-Satz: vor paralleler Befragung fixiert der Judge gemeinsame Fragestellung und Annahmen für alle Experten. M4 Template-Freifeld: jeder Experte benennt, was das Schema nicht abbildet. Template ist Default, kein Käfig; der Judge darf Felder im Einzelfall streichen oder ergänzen. M5 Deklarierter Gütegrad: jede Antwort trägt das Label "schnelle Orientierung" oder "geprüfte Antwort"; Zwischenstände: "belastbar für X, noch nicht für Y". M6 Ziel-Spiegelung: der Judge beginnt mit einem Satz "Das Ziel ist X", damit Falschverständnis sofort auffällt. 4. AUFTRAG – DREI PHASEN PHASE 1: KRITISCHE ANALYSE Prüfe Architektur und M1–M6 auf Schwächen, Lücken, Widersprüche, Overhead. Kernfragen: - Wo wird das System langsam, wo verliert es Qualität, wo ist es überengineered? - Kann ein einzelner Prompt glaubwürdig mehrere Experten simulieren UND deren Antworten unabhängig bewerten – oder beurteilt er sich selbst? Falls problematisch: Lösung ohne zweites System. - Sind die Triage-Kriterien eindeutig genug, dass der Judge ohne Rückfrage klassifiziert? - Fehlt ein Mechanismus (widersprechende Nutzerziele, Eskalation bei Unsicherheit, Falschinformation in Expertenantworten)? Denke die härtesten Fälle konkret durch: vages Nutzerziel; zwei Experten widersprechen sich fundamental; Direktantwort wäre schnell, aber bei hohem Einsatz falsch; der Judge bewertet seine eigene Simulation. Wie verhält sich das System – und wo bricht es? PHASE 2: VERBESSERUNG Schärfe, streiche oder ergänze Mechanismen. Jede Änderung mit Begründung: Welches Problem löst sie? Was kostet sie an Tempo? Prüfe auch, ob Mechanismen zusammengelegt oder gestrichen werden können – sechs Regeln sind nur richtig, wenn jede ihren Gegenbeweis besteht. Harte Regel: Kein Mechanismus darf Tempo oder Entscheidungsstärke schwächen. Jede Sicherung ist eine Sekunden-Regel, keine Bremse. PHASE 3: BAU – DREI ARTEFAKTE A) FINALER JUDGE-PROMPT: einsatzbereit, deutsch, lauffähig in einem einzigen Chat ohne Rückfragen. Enthält: Rolle und Vollmacht; Triage-Logik; finale Mechanismen; Vorgehen bei Panel-Simulation (Briefing, parallele Perspektiven, Aggregation, Patt-Entscheidung); Ausgabeformat: Entscheidung zuerst, kurze Begründung, nächster Schritt; Gütegrad-Label; Ton: prägnant, imperativ, ohne Warnungen und Disclaimer-Routinen. B) STANDARD-EXPERTEN-TEMPLATE: ein Schema für alle Fachgebiete. Enthält mindestens: Fachgebiet, Perspektive/Fokus, Aufgabe, Antwortregeln (Längenlimit, eine konkrete Empfehlung statt Optionen-Flut, Hauptrisiko), Freifeld "Was das Schema nicht abbildet". C) KURZANLEITUNG für den Nutzer (max. 10 Zeilen): Start, Panel-Abruf, Lesen der Ausgaben. 5. QUALITÄTSKRITERIEN - Oberstes Kriterium: Tempo ohne Qualitätsverlust – und Qualität ohne Tempoverlust. Beides wird durch Struktur erreicht, nicht durch einen faulen Kompromiss in der Mitte. - Substanzdichte: Jeder Satz im Judge-Prompt hat eine Funktion; was keine hat, fliegt raus. - Prompts funktionieren ohne Rückfragen; Mehrdeutigkeit wird durch sinnvolle Annahmen aufgelöst und knapp benannt. - Kein Ballast: keine Einleitungen, Meta-Erklärungen, Sicherheitsfloskeln. - Konsistenz: Judge-Prompt, Template und Anleitung greifen nahtlos ineinander. 6. AUSGABEFORMAT 1) Analyseergebnis (max. eine Seite) 2) Änderungsliste mit Begründung je Änderung 3) Artefakte A, B, C vollständig ausgeschrieben

Drag to resize

Response not available

Drag to resize
Drag to resize