答案: :C.权重的存储位宽 解析::量化是把参数由 FP16 等高精度表示压缩为 INT8 等低位宽表示,主要减少的是权重存储空间与带宽占用。
答案: :D.54×54×96
1、量化(Quantization)技术中,将 FP16 转为 INT8 主要压缩了:
{{ select(1) }}
2、对于输入为224×224×3的图像,使用一个卷积层,包含 96 个11×11的卷积核,步长为 4,无填充(padding = 0),那么输出特征图的大小和深度分别是? {{ select(2) }}
3、在原始 Transformer 的多头注意力机制中,多个头间的输出是如何结合的?
{{ select(3) }}
4、关于 Transformer 中的多头注意力(Multi-Head Attention)的表述,哪一项是正确的?
{{ select(4) }}
5、以下关于凸函数的说法,正确的是:
{{ select(5) }}
Scan the QR code below with WeChat to sign in
First-time scan will create your account automatically
请使用微信扫描下方二维码完成注册