猫眼影戏
猫眼影戏
宗作林
手机审查
猫眼影戏记者 汤金华 报道Q8X2R7L1T4J5M9B6W3
随着 LLM 向 1M 上下文演进,KV cache(键值缓存)已成为制约推理效劳效率的焦点瓶颈。自回归天生的特征使得模子必需存储历史 token 的 key-value 状态(即 KV cache)以阻止重复盘算,但 KV cache 的显存占用随着上下文长度的增添而膨胀,带来显著的内存瓶颈。
已往两年,关于 KV cache 的优化事情爆炸式增添,包括调理、迁徙、压缩等战略层出不穷。然而,现有综述主要聚焦于 LLM 推理或效劳的整体效率,大多仅将 KV cache 作为其中一个子?樽骷蛞致。
近期,来自墨尔本大学和华中科技大学的研究者们宣布了一篇深度综述,从MLSys 的头脑出发,用一套新颖的「时间 - 空间 - 结构」系统行为视角对 KV cache 优化要领举行了系统性梳理与深入剖析,并将相关资源整理成了一连维护的 Awesome 资源库,利便研究者与从业职员快速定位与落地。
论文地点: https://doi.org/10.36227/techrxiv.176046306.66521015/v3项目地点: https://github.com/jjiantong/Awesome-KV-Cache-Optimization
什么是「 sKis」?
为了提供更聚焦的视角和明确,作者们首先在综述中界说了sKis的界线:在推理效劳阶段,以 KV cache 为焦点优化工具,在不依赖模子重训或结构修改的条件下,提升吞吐、延迟等焦点系统指标。
从「系统行为」看 KV Cache
聚焦于 sKis,该综述立异性地提出以系统行为的视角来组织 KV cache 优化手艺:不是按详细流程、框架、算法来划分,而是按优化战略在系统中爆发的时间、空间、结构三个维度的行为来划分,从而更容易对齐工程实现与组合战略。
执行与调理(时间维度):KV 什么时间被会见和盘算?该分类关注执行历程与调理。例如设计以 KV 为中心的调理战略,接纳流水线来掩饰延迟,或者凭证差别硬件的特征适配操作等。安排与迁徙(空间维度):KV 放在那里、怎样迁徙?该分类关注数据的存储。例如在 GPU、CPU、SSD 组成的存储层级中怎样使热门 KV 留在 GPU 显存中,或者在漫衍式或异构的盘算装备中设计迁徙战略等。体现与留存(结构维度):KV 长什么样?该分类关注数据体现。这是现在最拥挤的赛道,包括量化、驱逐等论文麋集的子领域,旨在直接镌汰 KV cache 的物理体积。
基于上述三个维度,该综述将现有事情归纳为 7 个二级种别,详细包括:以 KV 为中心的调理(KVS)、流水线与重叠(OVLP)、硬件感知的执行(HAE)、跨内存层级的 KV 编排(MHO)、跨盘算装备的 KV 编排(CDO)、KV cache 压缩(KVCC)、KV cache 留存治理(KVRM)。
该论文不但详细梳理了每个维度下的差别类型和手艺要领,还为每一类提炼了要害要点、局限与权衡,给出了可落地的适用指导。
深度洞察与开放挑战
这篇综述最有价值的部分之一,在于作者们对百余篇论文举行了全局交织剖析,从而归纳了7 大概害视察,并引发了6 大开放挑战。
首先,作者们对文献举行了跨行为共现剖析,以展现差别维度的 KV 行为之间的内在联系和协同模式;别的,作者们深入剖析了KV 行为和优化目的的作用关系,并统计了文献中对相关优化指标的现实关注情形。
基于以上两类交织剖析,作者们展现了目今领域的7 大概害视察,例如什么组合是最常见的协同模式?结构维度(如量化)虽然论文最多,为什么往往沦为系统中的「孤岛」?
基于要害视察,作者们进一步提炼了6 大开放挑战,例如在追求效率的同时,我们虽然常;峁刈⒌蕉云渲柿康挠跋,可是否往往忽视了可信度(trustworthiness)的隐形崩塌?该综述中对每一个视察和挑战都给出了详细的剖析和思绪,期待能引发社区向着越发高效与可信的 LLM 效劳系统的一连探索!
资源分享:Awesome-KV-Cache-Optimization 资源库
为了利便社区追踪这一飞速生长的领域的最新希望,论文作者同步维护了一个 Awesome 气概的资源库,收录并一连更新 sKis 领域的最新论文和代码实现。希望这个资源库能让你少走弯路!
地点:https://github.com/jjiantong/Awesome-KV-Cache-Optimization
若是你正在做 LLM Infra、模子压缩或者高性能盘算等相关偏向,接待在 GitHub 上 star 支持,或者来客栈一起补全与更新!
??时势1:亚洲福利在线视频导航
??01月22日,潘功胜:各方应合作推动国际货币基金组织份额改革,
同砚们,昨天也许你还只是一个无忧无虑、稚气未脱的无邪少年,是一朵含苞的花蕾。今天,你已经成为了一位英姿勃发的青年,是一朵盛开的鲜花,正处于人生中最绚烂的花季。进入高中,跨进永中的大门,是你们斗争追求的又一新的起点,是你们扬帆远行的又一新的征程。在这里,参天的古木、蓊郁的花卉,给你舒爽的空气;先生的点拔指引、朗朗的书声,给你知识的浸染;嘹亮的歌声、漂亮的字画,给你艺术的熏陶;春风化雨般的真情关爱,冬日暖阳般的真诚相助,你的心定不会冷寂;兄弟姐妹般的真切友谊、温情各人庭的和气温馨,你的身影绝不会孑立。刚走进高中校园的你们像一颗萌动的种子,一只振翅欲飞的雏鹰,而这里,就是你们播种希望的肥美土地,就是你们展翅高飞的辽阔天空,是你们大学梦圆的圣地!来吧,同砚们,这里有慈如怙恃的先生,这里有亲如兄弟的同砚。这里是欢喜的各人庭,这里是知识的竞技场。来吧,同砚们,在这里放飞你的梦想,在这里收获你新的希望。
,免费人成视频在线观看播放网站。??01月22日,习言道|习近平这样谈青年担当,
这可能是鲲鹏留下的佳酿,岂是凡物,它所饮的酒大都是神浆,喝一口就延寿几多年,可增添修为。
?第二百一十二章 渎神,亚洲 XXX3d白丝,xx视频,亚洲国产综合在线观看调教。??时势2:极品白丝 白皙91
??01月22日,加强研究性修缮 推动预防性保护(深阅读),
(六)开展主题活动,增强员工教育治理。组织开展员工治理主题年活动,切实刷新和增强员工治理。各银行业金融机构要将员工教育培训作为案防事情的主要内容,系统、周全开展员工岗位规范和营业流程教育,明晰违规操作应肩负的责任;开展职业品德教育,作育员工忠实守信的职业操守;加大合规文化建设力度,增强各级治理职员合规意识,营造“合规从高层做起、合规人人有责、合规创立价值”的合规气氛。
,污的网站,99九色视频在线观看,天天色视频综合网。??01月22日,上海闵行港澳沙龙、香港上海闵行联谊会换届,
捍卫小草,给饱受蹂躏的草儿一块平安地,给饱受烈日的小草一地雨水。让鸟儿的歌声为小草作伴,让鱼儿的龙门之舞为小草喝彩!
,www.773c.cn免费网站入口申请退款,真实强㢨视频偷拍,国产精品视频专区你懂的。??时势3:老熟女性爱视频
??01月22日,“神州北极”:38支代表队比拼特色“漠河菜”,
金色霞光盛烈,那张狼皮快速鼓胀了起来,栩栩如生,宛如另一头在世的神狼,连牙齿都有,冷光闪灼。
,老乱女中文字幕熟女熟妇,在线免费一区,欧美乱大交XXXXX99。??01月22日,浙江宁波打造退役军人“周末大讲堂” 助力终身教育,
“人族原本就生涯不易,在这残酷的大荒中挣扎过活,怎么还会降下这种祸根?!”
,黄页网址大全免费,1024看片你懂的日韩人妻,纳西妲裸乳被爆 白浆小说。??时势4:日本拉屎网站
??01月22日,越剧史诗《胆剑千秋》:回眸文脉传承的“精神丰碑”,
④ 部分装备陈腐,使用年限过长,装备能力尚需增强。
,激情无码视频,一级簧片高清免费,66J8美女。??01月22日,贵州汇川:护林员陈正华“以林为家”坚守林场25年,
在这里我要向各人提几点要求:
,真实稀有小马拉大车视频,内射巨乳,久久精品熟妇av。责编:尚莹莹
审核:单昕
责编:内森
Copyright (C) 2001- dzwww.com. All Rights Reserved
新闻信息效劳允许证 - 音像制品出书允许证 - 广播电视节目制作谋划允许证 - 网络视听允许证 - 网络文化谋划允许证
山东省互联网传媒集团主理 联系电话:0531-85193202 违法不良信息举报电话:0531-85196540
Copyright (C) 2001- Dzwww 鲁ICP备09023866号-1