答案+解析
1
答案:B
H(x)=xmod13 后,只有 24 与 11 落在同一条链,其余键各占一条链。成功查找时,链头探查 1 次、链上第二个探查 2 次,总探查 7×1+2=9,平均长度为 9/8。无冲突会得到 1.0;8/7、3/2 都对不上这组链长。
1、零件编号 {24,32,35,40,43,8,12,11} 要放入哈希柜,散列函数为 H(x)=xmod13,冲突用拉链法。等概率条件下,查找成功的平均查找长度是?
{{ select(1) }}
- 78
- 89
- 23
- 1.0
2、库房抽检一组标称重量为 10.01 的包装件,最近 30 个班次的班均重量是否与标称值有显著差异。单样本 t 检验的原假设为 θ=10.01,备择假设为 θ=10.01。软件输出:t=0.47014,df=29,p=0.6418,95% 置信区间 [9.959933,10.032464],样本均值 10.0142。质检组可以得到什么结论?
{{ select(2) }}
- p 值大于 0.05,应拒绝原假设并认为班均重量与标称值不同
- p 值小于 0.05,该批班均重量与标称值无显著差异
- p 值大于 0.05,该批班均重量与标称值无显著差异
- 置信区间包含 10.01,因此应判定存在显著差异
3、法规长文检索要用稀疏注意力压计算。下列说法错误的是?
{{ select(3) }}
- BigBird 用稀疏注意力降低全连接开销,从而更好地处理长序列
- Longformer 的滑动窗口注意力在单层内就能建模任意远的全局依赖
- 稀疏注意力常见做法是局部窗口再配少量全局结点
- 稀疏注意力通过限制每个位置关注的结点数,来降低长序列上的二次开销
4、把键序列 (8,10,9,12,15,20) 散列进一张下标从 0 开始的一维表。散列函数为 H(x)=(2x)mod6,冲突用线性探测再散列,装填因子为 0.6。等概率条件下,查找成功的平均查找长度是?
{{ select(4) }}
- 7/6
- 2
- 11/6
- 1.5
5、分拣线用两级缓存栈:栈 U 容量为 2,栈 V 容量为 1。四个包裹 P,Q,R,S 只能从 U 入栈;U 必须在栈满后才能把栈顶转入 V(已无后续入栈时,剩余元件也可转入 V)。V 一满就立刻出栈。最终出栈顺序是?
{{ select(5) }}
- PQRS
- QPSR
- QRSP
- SRQP
6、关于大模型预训练目标,下列说法错误的是?
{{ select(6) }}
- T5 把多种任务统一成文本到文本,并用编码器-解码器结构来做
- GPT 采用自回归目标,用当前 token 去预测它前面的那一个 token
- 多模态预训练里常用对比学习来拉近跨模态表示
- BERT 的掩码语言模型会把一部分 token 随机替换成 MASK
7、分拣口抽了 9 件样品,真实档位依次为 X,X,X,X,Y,Y,Y,Z,Z,模型预测为 X,X,Y,Z,Y,Y,Z,Y,Z。这次预测的 macro-F1 约为?
{{ select(7) }}
- 0.5670
- 0.5460
- 0.5560
- 0.5720
8、一棵镜像对称二叉树的根结点为 K。左子树先序遍历(不含根)为 MNPQRS,右子树中序遍历(不含根)为 QSRPMN。该树的后序遍历序列是?
{{ select(8) }}
- MNPQRSSRQPNMK
- NSRQPMNSRQPMK
- NSRQPMSRQPNMK
- SRQPNMNSRQPMK
9、巡检时序用 LSTM 单元处理传感器读数,单元结构如下图。该结构用了两种激活函数,它们的作用分别是?

{{ select(9) }}
- 两种激活函数都只把隐状态裁到 [−1,1],与门控无关
- Sigmoid 控制信息流的方向,tanh 用来缓解饱和带来的梯度消失
- Sigmoid 产生 0∼1 的值作为门控,tanh 在输出和状态上变换数据
- Sigmoid 用来缓解饱和带来的梯度消失,tanh 控制信息流的方向
10、货架巡检要做视觉预训练,希望模型学到货位图像的语义而不是只记像素纹理。下列哪项预训练任务更有助于语义抽象?
{{ select(10) }}