mirror of
https://github.com/skindhu/Build-A-Large-Language-Model-CN.git
synced 2026-07-27 22:30:25 +08:00
@@ -466,7 +466,7 @@ print(tokenizer.decode(tokenizer.encode(text)))
|
|||||||
>
|
>
|
||||||
> + 句子1(掩码矩阵):`[1, 1, 1, 1, 0]`
|
> + 句子1(掩码矩阵):`[1, 1, 1, 1, 0]`
|
||||||
> + 句子2(掩码矩阵):`[1, 1, 1, 1, 0]`
|
> + 句子2(掩码矩阵):`[1, 1, 1, 1, 0]`
|
||||||
> + 句子3(掩码矩阵):`[1, 1, 1, 0, 0]`
|
> + 句子3(掩码矩阵):`[1, 1, 1, 1, 0]`
|
||||||
>
|
>
|
||||||
> 在这个掩码矩阵中,`1` 表示模型会关注的 token,`0` 表示模型会忽略的填充 token。通过这种掩码矩阵,模型知道在计算和训练时哪些 token 是有效内容,哪些 token 是填充部分,无需关注。
|
> 在这个掩码矩阵中,`1` 表示模型会关注的 token,`0` 表示模型会忽略的填充 token。通过这种掩码矩阵,模型知道在计算和训练时哪些 token 是有效内容,哪些 token 是填充部分,无需关注。
|
||||||
|
|
||||||
|
|||||||
Reference in New Issue
Block a user