给定一组矢量算子,要求合理部署这些算子到矩阵计算单元和向量计算单元上,以充分利用计算资源,使得整体执行时间最短。整体执行时间定义为矩阵计算单元总执行时间和向量计算单元总执行时间的最大值。
数据范围n<=1e4考虑暴力,因为向量单元必须连续,所以考虑直接枚举区间,将(i,j)这一段区间纳入向量单元其他的纳入矩阵区间,取二者的最大值再与ans取min即可
深度学习算法由一个个计算单元组成,这些计算单元被称为算子。能够完成矢量运算的算子称为矢量算子。在一个 NPU 中,矩阵计算单元和向量计算单元都可以执行矢量算子,并且这两类单元可以独立并行工作。它们的计算效率不同:若某个矢量算子在矩阵计算单元上的执行时间为 N,则该算子在向量计算单元上的执行时间为 6N,即向量计算单元处理同一算子的耗时是矩阵计算单元的 6 倍。
现在有 n 个矢量算子,按给定顺序编号为 1 到 n。设第 i 个算子在矩阵计算单元上的执行时间为 nums[i]。每个算子必须被部署到矩阵计算单元或向量计算单元中的某一个上,不能同时在两个单元上执行。
为了简化部署模型,还要求所有部署到向量计算单元上的算子在原顺序中必须构成一个连续区间。
计算在这种条件下,所有算子执行完成的最小的总执行时间。
Scan the QR code below with WeChat to sign in
First-time scan will create your account automatically
请使用微信扫描下方二维码完成注册