#P5204. 第1题-选择题
-
Tried: 67
Accepted: 7
Difficulty: 5
所属公司 :
百度
时间 :2026年7月30日
第1题-选择题
答案+解析
1.单选题
1
答案:C
键相同仍保持原相对次序,正是稳定排序。A 说的是外部排序,B 说的是原地排序,D 说的是分治过程,都不是“同键保序”。
1.单选题
1、一批工单按优先级字段排序后,优先级相同的工单仍须保持进入队列时的先后关系。下列性质最贴近该要求的是? {{ select(1) }}
- 排序过程主要在内外存之间分批交换数据
- 排序尽量少申请额外工作空间
- 关键字相同的元素在排序后相对次序不变
- 先把序列拆成子问题再合并结果
2、一棵非空二叉树一共有 29 个结点,其中度为 1 的结点有 6 个。按二叉树结点度数关系,度为 2 的结点数是? {{ select(2) }}
- 8
- 14
- 11
- 15
3、某文件权限串为 -rw-r-----。当前用户属于该文件所属组,但不是文件所有者。该用户通常具备什么权限?
{{ select(3) }}
- 可读可写
- 仅可读
- 无任何权限
- 可执行但不可读
4、支付回调可能因网络抖动被对端重复投递。为避免同一业务事件被处理两次,服务端最关键的设计是? {{ select(4) }}
- 把接口改成明文传输以缩短握手时间
- 在响应里附带更细的排障日志,交给调用方自行判断
- 要求调用方把超时设得更短,让失败更快暴露
- 按事件唯一编号做幂等校验,重复请求直接返回已处理结果
5、给定若干任务的开始时刻与结束时刻,希望选出数量最多且互不重叠的任务。下列贪心策略通常正确,并可用交换论证说明的是? {{ select(5) }}
- 每次选开始时刻最早的可执行任务
- 每次选与其它任务重叠次数最多的任务
- 每次选结束时刻最早的可执行任务
- 每次选持续时间最长的可执行任务
6、日志文件 app.log 中每行只有一个三位 HTTP 状态码。要统计状态码 500 出现的行数,下列命令更符合目标的是?
{{ select(6) }}
grep -v '500' app.log | wc -cwc -l app.log | grep '500'grep '500' app.log | wc -lcat app.log > grep '500' | wc
7、后端根据用户请求让大模型调用“查询订单”工具。关于函数调用的执行边界,下列说法较合理的是? {{ select(7) }}
- 模型生成结构化结果后直接写业务库,不再经过后端执行层
- 模型只输出调用请求,由后端校验参数并真正执行工具
- 后端只检查参数格式,用户身份和资源权限等到工具返回后再判断
- 工具接口只写自然语言用途,参数约束交给模型按上下文临时补齐
8、工单摘要由生成式模型起草,要求摘要中不得出现原始工单没有的信息。更合适的提示约束是? {{ select(8) }}
- 提高采样随机性,让模型给出更多候选表述
- 把摘要长度写得更长,以便容纳推测细节
- 要求模型主动补全背景原因,使摘要看起来更完整
- 只依据原始工单内容归纳,缺失信息标为未提供
9、按顺序执行:push(4)、push(7)、pop、push(2)、push(9)、pop、pop。若底层是栈,三次 pop 得到的元素依次是?
{{ select(9) }}
- 4、7、2
- 7、9、2
- 9、2、7
- 7、2、9
10、某耗时任务被拆成多个线程,在同一进程内并行。关于这些线程与进程资源关系,较合理的说法是? {{ select(10) }}
- 同进程线程共享同一地址空间,但各自有栈和调度上下文
- 线程切换时会重建进程页表,因此开销通常高于进程切换
- 线程拥有独立地址空间,彼此传对象必须经过内核网络栈
- 共享同一份内存后便不再需要同步
11、事务 T1 第一次读到某行余额为 100。事务 T2 随后提交,把该余额改为 120。T1 在同一事务内再次读取同一行得到 120。该现象更贴近哪类问题? {{ select(11) }}
- 脏读:读到了其它事务尚未提交的数据
- 幻读:满足条件的行集合发生了增减
- 死锁:事务之间形成循环等待
- 不可重复读:同一行在一次事务内两次读取结果不同
12、某关系表上有联合索引 (account_id, state, created_at)。下列查询条件最符合该索引最左前缀用法的是?
{{ select(12) }}
WHERE state = 1 ORDER BY account_idWHERE created_at > '2026-01-01'WHERE account_id = 1001 AND state = 1WHERE state = 1 AND created_at > '2026-01-01'
13、某进程执行一条访存指令时发生可恢复缺页。内核更新页表并装入目标页后,若处理器支持精确异常,用户态执行流通常如何恢复? {{ select(13) }}
- 重启整个进程,从入口函数重新执行
- 从异常处理程序入口接着跑原来的用户逻辑
- 跳过这条访存指令,从下一条指令继续
- 回到触发缺页的那条访存指令,由它重新执行
14、制度问答采用检索增强生成,但回答会引用已废止条款。检索日志显示靠前片段相似度不低,其中却混有旧版本。更能直接缓解该问题的是? {{ select(14) }}
- 在召回和重排阶段按版本、生效时间与来源过滤,再把命中片段注入上下文
- 提高生成温度,让模型用更丰富表述把多版制度揉在一起
- 继续扩大召回条数,新旧版本都交给模型自行取舍
- 缩短最终答案长度,减少过期引用被写出来的机会
15、风控更关心“被判高风险的请求里,确实高风险的比例”。验证集上模型 M1 的 TP=80、FP=20、FN=40,模型 M2 的 TP=70、FP=10、FN=50。更合理的取舍是? {{ select(15) }}
- 选 M1:精确率为 80/(80+20),召回率为 80/(80+40)
- 选 M2:召回率为 70/(70+50),高于 M1 的召回率
- 选 M2:精确率为 70/(70+10),高于 M1 的精确率
- 选 M1:FP=20、FN=40,误拦更少且覆盖更高
2.多选题
16、关于传输层可靠传输在后端服务通信中的机制,下列说法正确的有哪些? {{ multiselect(16) }}
- 通过序号和确认机制,按字节流确认数据接收进度
- 会保留应用层消息边界,使每次
read都对应一次send - 依靠应用层字段校验来恢复丢失报文的内容
- 在部分报文丢失时,可用重传补发尚未确认的数据
17、建设语言模型客服时,为降低幻觉和越权工具调用风险,下列设计较合理的有哪些? {{ multiselect(17) }}
- 对工具调用参数做白名单校验和权限校验,再由后端执行
- 资料不足时允许模型按常识补全具体制度条文,以提高完整度
- 弱化检索片段的来源与版本记录,把事实校验主要交给模型最终回答
- 对低置信度或资料冲突的请求转入人工复核,或直接返回无法判断
18、多个线程会同时更新共享计数器和任务队列。下列做法有助于降低并发错误风险的有哪些? {{ multiselect(18) }}
- 用互斥锁保护共享计数器的读改写临界区
- 在临界区里执行长时间网络请求,以减少锁释放次数
- 把只读配置发布为不可变对象,减少共享状态被改写
- 把共享队列的入队和出队纳入同一套同步协议
19、推荐服务上线新模型前,需要评估离线效果和线上风险。下列做法较合理的有哪些? {{ multiselect(19) }}
- 用独立验证集评估效果,避免只看训练集表现
- 上线前保留灰度或对照实验,观察真实用户反馈
- 若训练集准确率已经很高,就可以省略线上监控和回滚预案
- 关注与业务目标一致的指标,而不是只看训练损失
20、订单表常用查询为 WHERE account_id = ? AND state = ? ORDER BY created_at DESC LIMIT 20。关于索引执行代价,正确的有哪些?
{{ multiselect(20) }}
- 覆盖索引能否少回表,还取决于
SELECT列是否都在索引中 - 联合索引
(account_id, state, created_at)有机会同时支持过滤和排序 - 若只有单列索引
state,低选择性状态列的过滤效果可能较弱 - 把
created_at放在联合索引首列,仍能稳定利用account_id与state的等值过滤前缀