#P5317. 第1题-选择题
-
Tried: 5
Accepted: 2
Difficulty: 5
所属公司 :
阿里
时间 :2026年8月29日-阿里巴巴
第1题-选择题
1.单选题
1、冷链仓用 1 下标树状数组维护 16 个货位的库存。lowbit(i) 表示 i 二进制里最低位 1 对应的数值;结点 F[i] 覆盖原数组区间 [i−lowbit(i)+1, i]。现要算前缀和 S(13),并把第 5 个货位库存增加 δ。下列关于索引路径和覆盖区间的说法,正确的是? {{ select(1) }}
- 计算 S(13) 的路径为 13→12→8→0,结点 F[12] 覆盖 [9,12];更新第 5 个货位的路径为 5→9→13→16。
- 计算 S(13) 的路径为 13→12→8→0,结点 F[12] 覆盖 [12,16];更新第 5 个货位的路径为 5→6→8→16。
- 计算 S(13) 的路径为 13→12→8→0,结点 F[12] 覆盖 [9,12];更新第 5 个货位的路径为 5→6→8→16。
- 计算 S(13) 的路径为 13→5→1→0,结点 F[5] 覆盖 [5,5];更新第 5 个货位的路径为 5→6→8→16。
2、档案室检索台有两类问询。甲类占 60%,输入 8192 token、输出 64 token,Prefill 为 400ms,Decode 为每 token 8ms;乙类占 40%,输入 512 token、输出 512 token,Prefill 为 40ms,Decode 为每 token 8ms。只能选一个优化方案:方案 F 把 Prefill 加速 2 倍、Decode 不变;方案 G 把 Decode 降为每 token 6ms,但每个请求增加 100ms 适配开销;方案 H 把甲类 Prefill 降为 260ms、Decode 降为每 token 7ms,乙类不变。忽略排队和并行重叠,以请求占比加权的平均端到端时延为目标。哪项正确? {{ select(2) }}
- H 最优,平均约 1769ms
- F 与 H 并列最优,平均均约 2076ms
- F 最优,平均约 2074ms
- G 最优,平均约 1815ms
3、工位温度传感器得到一维读数 v=[0,0,0,6,10,10,10]。对其做 c=2 的 K-means,初始中心为 0 和 10;距离相同时分给数值较小的中心。完成一次“分配—更新”后继续迭代到稳定。稳定后的两个中心及簇内平方和是哪一项? {{ select(3) }}
- 中心为 1 和 9,簇内平方和为 12
- 中心为 0 和 10,簇内平方和为 12
- 中心为 0 和 9,簇内平方和为 18
- 中心为 0 和 9,簇内平方和为 12
4、退货审核有“自动放行”“自动拦截”和“转人工复核”三种动作。自动放行时,假阳性损失为 4;自动拦截时,假阴性损失为 9;正确自动分类损失为 0。人工复核总能给出正确类别,但每次固定损失为 1。设模型后验为 q=P(Z=1∣u),系统按条件期望损失最小选择动作;风险相等时优先转人工复核。系统在什么条件下应自动放行? {{ select(4) }}
- 134<q<0.75
- q≥0.75
- q>0.75
- q>91
5、零件缺陷分类模型输出得分 s=2,1,−1。训练时使用标签平滑 δ=0.1,正确类目标概率为 1−δ,其余两个类别各为 δ/2。真实类别为第 1 类。以下哪项最接近该样本的交叉熵损失? {{ select(5) }}
- 0.85
- 1.05
- 0.55
- 0.35
6、8 份打印任务必须保持原顺序,并被切成不超过 3 个连续批次。各任务耗时依次为 [7,2,5,10,8,4,6,9]。一个批次的代价为其中任务耗时之和,目标是最小化各批次的最大代价。若用“给定上限 B 时从左到右贪心装批次”作为二分判定,最优的 B 是多少? {{ select(6) }}
- 21
- 18
- 19
- 20
7、场馆导览用 Decoder-only 模型并采用 RoPE,训练最大长度为 8K。三种 32K 外推配置的离线结果如下:方案 α:短文本损失增幅 0.01,三个长距离桶准确率 84%、72%、58%,P95 时延增幅 2%;方案 β:短文本损失增幅 0.04,三个长距离桶准确率 80%、77%、74%,P95 时延增幅 7%;方案 γ:短文本损失增幅 0.02,三个长距离桶准确率 83%、76%、70%,P95 时延增幅 8%。上线硬约束为:短文本损失增幅不超过 0.05、任一距离桶准确率不低于 70%、P95 时延增幅不超过 8%。可行方案中优先选择最末距离桶准确率更高者。以下决策正确的是? {{ select(7) }}
- 选择 γ,因为它通过硬约束,且短文本损失增幅低于 β
- 选择 β,因为它通过硬约束,且末距离桶准确率在可行方案中最高
- 选择 α,因为它的短文本损失和时延增幅最小
- 选择 γ,因为它的时延增幅顶满约束,说明外推更充分
8、Top-2 MoE 层包含 8 个专科坐席,每张工单路由到得分最高的两个坐席。每个坐席容量为批内工单数的 0.25;超出容量的指派被丢弃。一张工单只要至少被一个坐席接收,就可继续处理。现有 8 张工单:w1,w2,w3,w4 的 Top-2 均为 (S1,S2);w5,w6 的 Top-2 均为 (S1,S3);w7,w8 的 Top-2 均为 (S2,S3)。坐席按路由分数接收指派:S1:w1>w2>w5>w6>w3>w4;S2:w3>w4>w7>w8>w1>w2;S3:w5>w6>w7>w8。不进行二次重路由。以下哪项正确? {{ select(8) }}
- 每个坐席容量为 2,共 8 张工单继续处理
- 每个坐席容量为 4,共 8 张工单继续处理
- 每个坐席容量为 2,共 5 张工单继续处理
- 每个坐席容量为 2,共 6 张工单继续处理
2.多选题
9、货位称重网络含两个连续线性层,中间没有激活函数、归一化或其他非线性操作:
uv=Ax+c=Bu+d以下判断正确的有哪些?(错选不得分,少选得 1/3 分) {{ multiselect(9) }}
- 两层可合并为 v=(BA)x+(Bc+d)
- 中间加入 ReLU 后,只要隐藏维足够大,仍可在全部输入域按原矩阵乘积收成同一仿射映射
- 扩大中间隐藏维度仍只得到仿射映射,不会自行产生非线性表达能力
- 中间加入 ReLU 后,整体通常成为分段线性映射
10、用决策树估计果园产量时,训练误差很低而验证误差明显较高。以下处理或判断合理的有哪些?(错选不得分,少选得 1/3 分) {{ multiselect(10) }}
- 把同一棵过拟合树的预测值重复加权平均,即可得到与随机森林相当的方差下降
- 增大叶结点所需的最小样本数,限制由少量样本形成的细碎分支
- 限制最大深度通常会降低模型复杂度,但训练误差可能升高或保持不变
- 使用独立验证数据选择剪枝强度,比较不同复杂度候选树的泛化表现