10.1[A]2267,磐久UMX【上下文128K,KVCache部分]

2267

超时原因

对于原来DFS超时的计算,首先是要考虑总的步数,是m+n-2,然后就是从中选择m-1个要向下走的步数是分配在哪里的,那么剩下的自然就是向右走的分布

这本质上和缩维也一样的

记忆化的复杂度

所为将其记忆化,就是用数组来记录每个格子此时的状态,并直接给出这个格子是否能达到要求,这样每个格子都只需要处理一次

然后一共有m*n个格子

状态维度可缩维到只有一维,即到达(x,y)的格子上时,此时的左括号数量

左括号的数量极端情况下是m+n左右,即从起点到终点,一路上都是左括号

那么数组的总大小,或者说状态空间的总大小,就是m*n*(m+n)

新剪枝

这里是否可以再实现一个剪枝?即如果最终要合法,那左右括号数量必须一致,那么左括号数量必然不能不超过路径总长度的一半,所以在dfs时,如果一旦发现左括号数量超过了一半,那不必继续向下DFS,这条路径必然是false的

对于memo的第三维,是表示到x,y时的左括号数量,那是否不需要开到totalen+1,而是只开到其一半?因为不会超过一半

路径长度问题

为什么总路径长度是m+n-1,不该是m+n-2吗?在长上是走m-1,在宽上走n-1,加起来就是m+n-2?

int&的语法

int& res=memoxylnum的写法,语法是什么?

动态规划

问题转化

磐久UMX:UALink+下一代AliSCM,GPU直连的PCM内存池

上下文128K

"在单卡80GB HBM的情况下,上下文拉到128K就捉襟见肘,KV Cache动辄数百GB,即使高端XPU的HBM能装下,性价比也不划算。"上下文为128K是什么概念?我对大模型推理过程完全没什么概念

大模型推理过程

KV Cache

相关推荐
朝朝辞暮i1 小时前
C++ 第 14 课:引用 &
开发语言·c++·算法
Joe_Wang51 小时前
【从0到1学习JVM · 21】既不浪费空间又没有碎片,标记整理算法到底慢在哪
jvm·学习·算法·垃圾回收·标记整理算法
让学习成为一种生活方式1 小时前
PlantCellChat--单细胞与空间转录组数据预测植物细胞间通讯的R包--The Plant Journal
算法
C++ 老炮儿的技术栈2 小时前
有符号变量与无符号变量的区别
服务器·开发语言·前端·数据结构·c++·算法·c
梦帮科技2 小时前
多任务权重流形融合:SLERP 球形线性插值、DARE 稀疏剪枝与多专家模型融合落地
人工智能·深度学习·算法·机器学习·tensorflow·聚类·剪枝
Tisfy2 小时前
LeetCode 0020.有效的括号:栈匹配
算法·leetcode·字符串·题解·括号匹配
测试学习test2 小时前
SPI读取W25Q64硬件驱动(HAL库)
数据库·stm32·嵌入式硬件·算法
迅猛龙办公室2 小时前
Python实现斐波那契数列
算法
淡海水2 小时前
02-01-原理篇-Mark-Sweep与变种算法
算法·unity·c#·游戏引擎·.net·gc