Commit b248f4a3c for llama.cpp

commit b248f4a3c1631b45e8924cb00442517f7a9dc77a
Author: Sigbjørn Skjæret <sigbjorn.skjaeret@huggingface.co>
Date:   Fri Sep 25 13:59:47 2026 +0200

    gguf-py : ByteLevel processing defaults bos/eos to False (#29422)

diff --git a/gguf-py/gguf/vocab.py b/gguf-py/gguf/vocab.py
index b5eaa71dd..31036bbe5 100644
--- a/gguf-py/gguf/vocab.py
+++ b/gguf-py/gguf/vocab.py
@@ -234,7 +234,11 @@ class SpecialVocab:
                 tokenizer_config['eos_token'] = special_eos = special_sep
             if post_processor := tokenizer.get('post_processor'):
                 for processor in post_processor.get('processors', [post_processor]):
-                    if processor.get('type') == 'RobertaProcessing':
+                    processor_type = processor.get('type')
+                    if processor_type == 'ByteLevel':
+                        self.add_special_token.setdefault('bos', False)
+                        self.add_special_token.setdefault('eos', False)
+                    elif processor_type == 'RobertaProcessing':
                         self.add_special_token['bos'] = True
                         self.add_special_token['eos'] = True
                         self.add_special_token['sep'] = True
@@ -247,7 +251,7 @@ class SpecialVocab:
                         continue
                     # Crude parsing of TemplateProcessing to determine if BOS/SEP/EOS should be added
                     # Only works with simple templates, **will** get it wrong on unusual sequences
-                    if processor.get('type') == 'TemplateProcessing':
+                    elif processor_type == 'TemplateProcessing':
                         tmpl_single = processor.get('single', [])
                         tmpl_pair = processor.get('pair', [])
                         special_first = None
@@ -339,7 +343,7 @@ class SpecialVocab:
                 if typ not in self.add_special_token:
                     self.add_special_token[typ] = add_entry
                 elif self.add_special_token[typ] != add_entry:
-                    logger.warning(f'Mismatch between tokenizer_config add_{typ}_token({add_entry}) and TemplateProcessing<{typ}>({self.add_special_token[typ]}) - opting for the latter')
+                    logger.warning(f'Mismatch between tokenizer_config add_{typ}_token({add_entry}) and tokenizer post_processor<{typ}>({self.add_special_token[typ]}) - opting for the latter')
             entry = tokenizer_config.get(f'{typ}_token')
             if isinstance(entry, str):
                 tc_content = entry