mirror of
https://github.com/skindhu/Build-A-Large-Language-Model-CN.git
synced 2026-07-25 05:10:24 +08:00
@@ -295,7 +295,10 @@ ids = tokenizer.encode(text)
|
||||
print(ids)
|
||||
```
|
||||
|
||||
上面的代码打印出以下token ID(`这里原始英文书籍中没有输出打印结果,读者可以自己运行代码查看结果`):
|
||||
上面的代码打印出以下token ID:
|
||||
```
|
||||
[1, 56, 2, 850, 988, 602, 533, 746, 5, 1126, 596, 5, 1, 67, 7, 38, 851, 1108, 754, 793, 7]
|
||||
```
|
||||
|
||||
接下来,让我们看看能否通过 decode 方法将这些token ID 转换回文本:
|
||||
|
||||
|
||||
Reference in New Issue
Block a user