Cinque pezzi lavorano insieme: un corpus di inglese comune curato, un insieme di modelli grammaticali di frasi, una coppia di banche dati di nomi internazionali e dello Sri Lanka, una banca di spunti originali per la scrittura e un piccolo generatore di numeri pseudo-casuali deterministico che li collega tutti. Ogni passaggio è una funzione pura — niente chiamate di rete, niente memorizzazione locale, niente analisi sul testo generato stesso.
- Corpus di parole. Circa 553 token di inglese comune estratti dall'intersezione tra Oxford 3000 e la General Service List (West, 1953; liste di successori moderne di ELT). Tutto minuscolo, niente nomi propri, niente parolacce. La modalità parola sceglie n token in modo uniforme e casuale e applica il caso lettera scelto tra minuscolo, Title o UPPER.
- Costruzione delle frasi. Le frasi sono costruite da 18 modelli grammaticali di inglese con segnaposto riempiti da sotto-banche di 121 nomi concreti, 113 verbi al presente, 49 aggettivi e 33 avverbi. Circa il 14% dei modelli con punto finale ha il terminatore scambiato con un ? o ! per aggiungere ritmo. I paragrafi collegano 36 frasi e si uniscono con uno spazio singolo; più paragrafi sono collegati con esattamente una riga vuota (\n\n).
- Nomina. Lo strumento include due corpora di nomi, una banca internazionale (91 nomi di battesimo)