Generáld le a lehető leghosszabb, gyártásra kész, teljesen s...
Prompt
Generáld le a lehető leghosszabb, gyártásra kész, teljesen szintetikus előtanító adathalmazt egy 1 000 000 tokenes kontextusablakkal rendelkező alapnyelvi modell számára Használd fel a rendelkezésre álló 393216 tokenes kimeneti keretet teljes egészében Készíts maximálisan hosszú, információban sűrű tanítási mintákat, lehetőleg a teljes kimeneti korlátot megközelítő kontextusokkal, és oszd be a rendelkezésre álló helyet teljes tudásstruktúrák, magyarázatok, kapcsolatok, levezetések, eljárások és többlépéses feladatok számára Representáld a földi emberi tudás teljes testét egy egységes, kereszthivatkozott tudáskorpuszban, amely lefedi az összes alábbi kategóriát és azok alkategóriáit: ebben a körben: Formális tudományok: aritmetika számelmélet algebra absztrakt algebra lineáris algebra geometria analitikus geometria topológia kalkulus valós analízis komplex analízis differenciálegyenletek numerikus analízis diszkrét matematika kombinatorika gráfelmélet halmazelmélet kategóriaelmélet rendezéselmélet modellelmélet bizonyításelmélet számíthatóságelmélet információelmélet formális nyelvek automataelmélet optimalizálás operációkutatás játékelmélet döntéselmélet valószínűségszámítás matematikai statisztika dinamikus rendszerek irányításelmélet Minden kategóriához generálj definíciókat, alapfogalmakat, haladó fogalmakat, terminológiát, kapcsolatokat, oksági mechanizmusokat, eljárásokat, kvantitatív reprezentációkat, formális szabályokat, kidolgozott levezetéseket, példákat, ellenpéldákat, szélsőséges eseteket, történeti fejlődést, versengő értelmezéseket, keresztdomain kapcsolatokat, strukturált adatokat, valamint olyan feladatokat, amelyek a beépített anyag visszakeresését és következtetését igénylik Representáld a korpuszt teljes JSONL rekordokként, amelyek tartalmazzák a manifesztet, doménmetadatokat, tudásegységeket, forrásdokumentumokat, strukturált táblákat, formális szabályokat, kódartefaktumokat, egyenleteket, eseménynaplókat, függőségi linkeket, feladatokat, pontos válaszokat, levezetéseket, ellenfaktumokat, verifikációs ellenőrzéseket, invariáns ellenőrzéseket és antishortcut elemzéseket Használj hosszú távú függőségeket úgy, hogy a későbbi feladatok olyan információkat igényeljenek, amelyeket ugyanabban a generált kontextusban több ezer tokennel korábban vezettél be Használj többféle válaszformátumot, beleértve a strukturált objektumokat, tömböket, táblázatokat, osztályozásokat, szimbolikus kifejezéseket, bizonyításokat, végrehajtási nyomokat, ütemterveket, gráfútvonalakat, állapotpillanatképeket, normalizált sémákat és keresztdomain szintéziseket Generálj minden tartalmat helyben a fenti követelmények alapján, végezz teljes belső konzisztencia- és sémaellenőrzést, maximalizáld a kontextushosszt és a tudáslefedettséget, és csak a végleges JSONL adathalmazt bocsásd ki, a teljes 393216 tokenes kimeneti kapacitást felhasználva