protocol
tokenizer_language_protocolï
Language provider protocol for tokenization and sentence splitting using canonical character-code lists.
Availability:
logtalk_load(tokenization(loader))Author: Paulo Moura
Version: 1:0:0
Date: 2026-09-05
Compilation flags:
staticDependencies:
(none)
Remarks:
(none)
Inherited public predicates:
(none)
Public predicatesï
tokenize_codes/3ï
Tokenizes a character-code list using validated, merged facade options.
Compilation flags:
staticTemplate:
tokenize_codes(Codes,Tokens,Options)Mode and number of proofs:
tokenize_codes(+list(character_code),-list(list(character_code)),+list(compound)) - onesplit_sentence_codes/3ï
Splits a character-code list into sentence character-code lists using validated, merged facade options.
Compilation flags:
staticTemplate:
split_sentence_codes(Codes,Sentences,Options)Mode and number of proofs:
split_sentence_codes(+list(character_code),-list(list(character_code)),+list(compound)) - oneProtected predicatesï
(none)
Private predicatesï
(none)
Operatorsï
(none)