解决‘BaichuanTokenizer‘ object has no attribute ‘sp_model‘,无需重装transformers和torch
·
如https://github.com/baichuan-inc/Baichuan2/issues/204
中所说:
修改下 tokenization_baichuan.py ,把 super() 修改到最后执行
self.vocab_file = vocab_file
self.add_bos_token = add_bos_token
self.add_eos_token = add_eos_token
self.sp_model = spm.SentencePieceProcessor(**self.sp_model_kwargs)
self.sp_model.Load(vocab_file)
super().__init__(
bos_token=bos_token,
eos_token=eos_token,
unk_token=unk_token,
pad_token=pad_token,
add_bos_token=add_bos_token,
add_eos_token=add_eos_token,
sp_model_kwargs=self.sp_model_kwargs,
clean_up_tokenization_spaces=clean_up_tokenization_spaces,
**kwargs,
)
# self.vocab_file = vocab_file
# self.add_bos_token = add_bos_token
# self.add_eos_token = add_eos_token
# self.sp_model = spm.SentencePieceProcessor(**self.sp_model_kwargs)
# self.sp_model.Load(vocab_file)
注意需要把模型文件download到本地后修改模型文件中的tokenization_baichuan.py
AtomGit 是由开放原子开源基金会联合 CSDN 等生态伙伴共同推出的新一代开源与人工智能协作平台。平台坚持“开放、中立、公益”的理念,把代码托管、模型共享、数据集托管、智能体开发体验和算力服务整合在一起,为开发者提供从开发、训练到部署的一站式体验。
更多推荐



所有评论(0)