refactor(dump_sft_file.py, utils.py): 优化内存占用
This commit is contained in:
+2
-2
@@ -13,8 +13,8 @@ def get_processor(tokenizer: BpeTokenizer):
|
||||
|
||||
tokens = prefix_ids + suffix_ids
|
||||
tokens = torch.tensor(tokens, dtype=torch.int32)
|
||||
masks = torch.zeros_like(tokens)
|
||||
masks[:len(prefix_ids)] = 1
|
||||
masks = torch.zeros_like(tokens, dtype=torch.bool)
|
||||
masks[:len(prefix_ids)] = True
|
||||
|
||||
return {"sequence": tokens, "mask": masks}
|
||||
|
||||
|
||||
Reference in New Issue
Block a user