缓存优化必备:掌握冷热分离和重排序的优化技巧

AI权益加码!Claude Code、Cursor等20+工具免费用! 购周边限时加赠Coding Plan Lite,畅享主流AI工具!学习进阶更高效! 阅读详情

作者:麦客奥德彪

在当今高并发、大数据的时代,系统性能优化是非常重要的。而缓存优化作为提高系统性能的一种有效手段,被广泛应用于各种场景中。其中,冷热端分离和重排序是常见的两种缓存优化方式。本篇博客将详细介绍这两种优化方式的原理、实现和应用场景,希望能为您的系统性能优化提供帮助。

缓存优化是提高系统性能的一种有效手段,其中冷热端分离和重排序是常见的两种优化方式。

缓存优化

1.冷热端分离

缓存的命中率受多种因素影响,其中最重要的因素之一是缓存的大小。在实际应用中,经常会遇到数据集非常大的情况,如果将全部数据都放入缓存,那么缓存的命中率就会很低,从而影响系统的性能。此时可以考虑采用冷热端分离的策略。

所谓冷热端分离,就是将数据集分为两个部分:冷数据和热数据。冷数据指的是访问频率低的数据,可以不用放入缓存中,而热数据指的是访问频率高的数据,应该优先放入缓存中。通过冷热端分离,可以有效地提高缓存的命中率,从而提升系统的性能。

2.重排序

在实际应用中,数据访问的顺序往往并不是随机的,而是有一定的规律。如果按照这种规律来访问数据,可以有效地提高缓存的命中率。因此,可以采用重排序的策略来优化缓存。

所谓重排序,就是将数据按照一定的规则重新排序,使得访问频率高的数据排在前面,访问频率低的数据排在后面。这样,在访问数据时就可以先访问排在前面的数据,从而提高缓存的命中率。

需要注意的是,重排序的策略需要根据具体的数据集来确定,不同的数据集可能需要不同的重排序策略。同时,重排序可能会增加一定的计算量,需要在性能和命中率之间做出平衡。

举个例子

Android 中使用冷热端分离和重排序策略提高图片加载缓存命中率的例子

class ImageLoader(private val context: Context) {
    private val memoryCache: LruCache<String, Bitmap>
    private val diskCache: DiskLruCache

    init {
        // 计算可用的最大内存
        val maxMemory = (Runtime.getRuntime().maxMemory() / 1024).toInt()
        // 取可用内存的 1/8 作为缓存大小
        val cacheSize = maxMemory / 8
        memoryCache = object : LruCache<String, Bitmap>(cacheSize) {
            override fun sizeOf(key: String, value: Bitmap): Int {
                // 计算 Bitmap 的大小,单位是 KB
                return value.byteCount / 1024
            }
        }
        // 获取磁盘缓存路径
        val cacheDir = context.externalCacheDir?.path ?: context.cacheDir.path
        val diskCacheDir = File(cacheDir + File.separator + "image_cache")
        if (!diskCacheDir.exists()) {
            diskCacheDir.mkdirs()
        }
        diskCache = DiskLruCache.open(diskCacheDir, 1, 1, 10 * 1024 * 1024)
    }

    //
    fun displayImage(url: String, imageView: ImageView) {
        val bitmap = memoryCache.get(url)
        if (bitmap != null) {
            imageView.setImageBitmap(bitmap)
            return
        }
        loadFromDiskCache(url, imageView)
        loadFromNetwork(url, imageView)
    }

    private fun loadFromDiskCache(url: String, imageView: ImageView) {
        var bitmap: Bitmap? = null
        try {
            val snapshot = diskCache.get(url)
            if (snapshot != null) {
                val inputStream = snapshot.getInputStream(0)
                val fileDescriptor = (inputStream as FileInputStream).fd
                bitmap = BitmapFactory.decodeFileDescriptor(fileDescriptor)
                if (bitmap != null) {
                    memoryCache.put(url, bitmap)
                    imageView.setImageBitmap(bitmap)
                }
            }
        } catch (e: IOException) {
            e.printStackTrace()
        }
    }

    private fun loadFromNetwork(url: String, imageView: ImageView) {
        // 发送网络请求获取图片数据
        // ...

        // 解码图片数据并显示
        val bitmap = decodeBitmapFromData(imageData, reqWidth, reqHeight)
        if (bitmap != null) {
            memoryCache.put(url, bitmap)
            try {
                val editor = diskCache.edit(url)
                if (editor != null) {
                    val outputStream = editor.newOutputStream(0)
                    bitmap.compress(Bitmap.CompressFormat.PNG, 100, outputStream)
                    editor.commit()
                }
            } catch (e: IOException) {
                e.printStackTrace()
            }
            imageView.setImageBitmap(bitmap)
        }
    }

    private fun decodeBitmapFromData(data: ByteArray, reqWidth: Int, reqHeight: Int): Bitmap? {
        // 解码图片数据并返回 Bitmap 对象
        // ...
    }
}

ImageLoader 类封装了图片加载的逻辑。它通过 LruCache 和 DiskLruCache 实现了冷热端分离的策略,将访问频率高的图片放入 LruCache 中,而将不常用的图片放入 DiskLruCache 中。在加载图片时,先从 LruCache 中查找图片是否已经缓存,如果已经缓存则直接显示,否则从 DiskLruCache 中查找,如果也没有找到图片,则通过网络请求获取图片并缓存到 LruCache 和 DiskLruCache 中,最后显示在 ImageView 中。

在这个例子中,重排序的实现主要体现在加载图片的顺序上,先从 LruCache 中查找缓存,然后再从 DiskLruCache 中查找缓存,最后才进行网络请求获取图片数据。这样的顺序可以最大限度地提高缓存命中率,减少网络请求的次数,同时也能够缩短图片加载的时间。

冷热端分离的实现则体现在将不常用的图片放入 DiskLruCache 中。因为 DiskLruCache 的读写速度相对较慢,所以将不常用的图片放入其中可以避免 LruCache 的缓存被占满,导致缓存淘汰频繁的问题。这样能够保证常用的图片能够始终缓存在 LruCache 中,提高缓存命中率。

其他应用场景和已用场景

1.RecyclerView 中的 ViewHolder 缓存:在 RecyclerView 中,ViewHolder 是用来复用 item 视图的。通过将频繁访问的 View 缓存起来,可以大大提高 RecyclerView 的滑动性能,特别是在数据集较大的情况下。(多布局或者评论列表类型的)
2.数据库查询:在数据库查询时,可以根据数据的使用频率将热数据和冷数据分离,并对热数据进行缓存,从而提高查询性能。
3.JIT(Just-In-Time)编译器:在 Android 中,JIT 编译器将字节码编译成本地代码,以提高应用的执行速度。重排序可以优化 JIT 编译器的代码生成过程,提高编译速度和执行速度。
4.UI 界面渲染:在 UI 界面渲染时,可以使用冷热分离的方式将常用的布局和组件缓存起来,避免每次重新渲染,从而提高界面的响应速度和性能。
5.动态加载类:在应用中使用反射动态加载类时,可以通过重排序优化类加载的过程,提高应用的响应速度。
6.预加载资源:在应用启动时,可以使用冷热分离的方式预加载一些常用的资源,避免等到需要使用时再加载,从而提高应用的启动速度和性能。
7.网络请求:在网络请求时,可以使用冷热分离的方式将常用的数据缓存起来,避免重复请求,从而提高应用的响应速度和性能。

其实玩儿的还是那个思想

总结

玩儿东西还是要弄明白这个东西的成立基础是什么,或者负面因素有哪些。比如:

  1. 需要有足够的数据支持冷热分离和重排序,否则这些优化可能不会带来明显的性能提升,甚至可能会造成额外的开销。
  2. 冷热分离和重排序的实现需要考虑数据的生命周期,避免数据被错误地缓存或销毁。
  3. 冷热分离和重排序可能会导致数据的展示顺序不符合用户的期望,需要进行适当的处理,以保证数据的展示效果。
  4. 在实现时需要考虑多线程安全问题,避免因并发访问导致的数据错乱或其他异常情况。
  5. 在使用冷热分离和重排序时需要进行充分的测试和性能分析,以确保这些优化技术能够达到预期的性能提升效果,并且不会引入新的问题和风险。
关于redis的冷热数据分离 一、概述 当前KV数据库从存储介质可以分为两种模式,一种是以内存为主持久化为辅,如memcache(无持久化)、redis等;一种是以持久化为主内存为辅,如ssdb(基于leveldb/rocksdb存储引擎)。这两种模式代表了两种不同的选择策略哲学,适应不同的业务场景。简单地说,以内存为主的模式侧重高性能,信奉“内存是新的硬盘”的哲学;以持久化为主的模式则侧重大容量,兼顾性能。   对于 阅读详情

相关推荐

AI编排实战:MuleSoft+LangChain构建企业级AI智能调度桥

AI编排(AI Orchestration)是企业在多源异构系统与大语言模型之间实现可信协同的关键范式,其核心在于解耦数据集成、安全治理与AI推理——不再由代码硬编码业务逻辑,而是让LLM基于实时聚合的结构化与非结构化数据动态生成可执行洞察。它融合了企业级集成平台的权限管控、混合部署与容错能力,以及LangChain等AI框架的RAG检索、多步推理与上下文记忆能力,从而支撑销售智能、客户挽留、HR风险预警等高价值场景。本文以Sales Intelligence Assistant为蓝本,详解MuleSoft

cuiji1279的博客 393

缓存优化必备掌握冷热分离重排序优化技巧

玩儿东西还是要弄明白这个东西的成立基础是什么,或者负面因素有哪些。需要有足够的数据支持冷热分离重排序,否则这些优化可能不会带来明显的性能提升,甚至可能会造成额外的开销。冷热分离重排序的实现需要考虑数据的生命周期,避免数据被错误地缓存或销毁。冷热分离重排序可能会导致数据的展示顺序不符合用户的期望,需要进行适当的处理,以保证数据的展示效果。在实现时需要考虑多线程安全问题,避免因并发访问导致的数据错乱或其他异常情况。

图你怀中安稳的博客 549

PostgreSQL原生向量搜索:pgvector实战指南与性能调优

向量搜索是支撑RAG、语义推荐、智能客服等AI应用的核心能力,其本质是将非结构化语义信息转化为可计算的高维向量,并基于余弦相似度、L2距离等数学原理实现高效近似最近邻检索。技术价值在于打破结构化与非结构化数据的壁垒,实现低延迟、强一致、免运维的混合查询。典型应用场景包括PostgreSQL中直接增强商品搜索、用户评论情感聚类、文档语义召回等。pgvector作为深度嵌入PostgreSQL的开源扩展,让向量能力成为数据库一等公民,无需双写、不新增组件,真正实现‘用SQL做语义搜索’。

weixin_34168880的博客 522

(六)大白话MySQL是如何基于冷热数据分离的方案,来优化LRU算法?

MySQL是如何基于冷热数据分离的方案,来优化LRU算法

zht245648124的博客 2219

什么是数据库的 “缓存池” ?(万字长文)

1、Buffer Pool 概述Buffer Pool 是什么?从字面上看是缓存池的意思,没错,它其实也就是缓存池的意思。它是 MySQL 当中至关重要的一个组件,可以这么说,MySQL...

程序员小灰的博客 1821

缓存优化必备:掌握冷热分离重排序优化技巧_缓存冷热数据如何进行处理

数据指的是访问频率低的数据,可以不用放入缓存中,而热数据指的是访问频率高的数据,应该优先放入缓存中。在实际应用中,经常会遇到数据集非常大的情况,如果将全部数据都放入缓存,那么缓存的命中率就会很低,从而影响系统的性能。所谓重排序,就是将数据按照一定的规则重新排序,使得访问频率高的数据排在前面,访问频率低的数据排在后面。这样,在访问数据时就可以先访问排在前面的数据,从而提高缓存的命中率。需要注意的是,重排序的策略需要根据具体的数据集来确定,不同的数据集可能需要不同的重排序策略。// 计算可用的最大内存。

2401_84167072的博客 651

缓存优化必备:掌握冷热分离重排序优化技巧_缓存冷热数据如何进行处理(4)

玩儿东西还是要弄明白这个东西的成立基础是什么,或者负面因素有哪些。网上学习资料一大堆,但如果学到的知识不成体系,遇到问题时只是浅尝辄止,不再深入研究,那么很难做到真正的技术提升。需要这份系统化的资料的朋友,可以添加V获取:vip204888 (备注鸿蒙)一个人可以走的很快,但一群人才能走的更远!不论你是正从事IT行业的老鸟或是对IT行业感兴趣的新人,都欢迎加入我们的的圈子(技术交流、学习资源、职场吐槽、大厂内推、面试辅导),让我们一起学习成长!一个人可以走的很快,但一群人才能走的更远!

2401_84167072的博客 534

从向量存储到检索引擎:Milvus在RAG系统中的工程化实践

向量数据库是现代AI应用中的核心基础设施,它通过将非结构化数据(如文本、图像)转化为高维向量,并利用近似最近邻搜索(ANN)算法实现高效的语义检索。其技术原理基于嵌入模型将语义信息编码为向量空间中的点,相似性通过距离度量(如余弦相似度、欧氏距离)计算。这一技术为大规模语义搜索、推荐系统检索增强生成(RAG)提供了基础支撑。在工程实践中,向量数据库的价值在于构建可扩展、低延迟的语义检索管道,其应用场景广泛覆盖智能问答、内容推荐知识库搜索。本文以电子书语义检索系统为例,深入探讨如何将Milvus向量数据库从

weixin_34357887的博客 402

小白程序员必备:从0到1掌握AI Agent后端开发(含学习路线+面试考点)

现在AI应用开发的岗位,已经从“概念炒作期”进入了“落地实干期”,企业不再为“懂点大模型概念”的人买单,更愿意高薪招“能真正把AI落地成业务系统”的工程师。对于我们普通后端开发来说,这是好事——门槛提高了,浑水摸鱼的人少了,真正沉下心学的人,才能吃到这波红利。2026年技术圈的分化愈发明显:降薪裁员潮持续蔓延,传统开发、测试等岗位大批缩水,不少从业者陷入职业焦虑;与之形成鲜明对比的是,AI大模型相关岗位迎来疯狂扩招,薪资逆势飙升150%,大厂更是直接开出70-100W。

大模型研究中心 302

RAG上下文充分性:如何确保LLM获得完整信息拼图

在检索增强生成(RAG)系统中,‘上下文充分性’是决定答案准确性的核心前提——它指交付给大语言模型的文本是否在语义、逻辑与事实层面覆盖生成所需全部关键信息,而非简单追求检索数量或token长度。其本质是信息完整性问题,涉及实体覆盖、比较关系、时效对齐与隐含前提等多维要求。技术价值在于显著降低幻觉率、提升用户一次问答满足率,并支撑金融、医疗、政务等高可靠性场景落地。典型应用包括医保政策问答、法律条款解释、产品技术对比等需严谨论证的领域。本文聚焦RAG中常被忽视却致命的上下文充分性保障机制,结合信息单元建模与S

weixin_34343000的博客 378

RAG 项目全流程落地完整知识点总结

邱邱的博客 337

Java高并发系统 + 安全监控 完整知识体系

本文系统梳理了Java高并发开发的全方位知识体系,涵盖单机并发基础、分布式架构、系统安全、监控体系故障治理等核心模块。主要内容包括: 单机并发基础 CPU多级缓存与内存模型 JMM内存模型与happens-before原则 锁机制与CAS原子操作 并发容器与线程池原理 JVM调优与性能优化 分布式高并发架构 分布式锁与一致性算法 缓存体系与典型问题解决方案 消息队列的削峰填谷 负载均衡与分库分表 微服务通信与流量控制 生产级解决方案 高并发业务安全防护 全链路监控体系搭建 典型故障排查与治理 应急预案与性

专注 Java 后端开发,分享基础语法、JVM、并发、Spring 全家桶、微服务、分布式、性能优化等实战干货。坚持输出高质量技术笔记,用简单语言讲清复杂原理,助力每一位 Java 开发者稳步进阶。 541

AI Agent与ChatBot核心差异及开发实战指南

AI Agent作为新一代智能系统,与传统的ChatBot存在本质区别。其核心在于构建感知-思考-行动的完整闭环,通过大模型驱动实现自主决策与工具调用。关键技术包括记忆系统设计(短期/工作/长期三层架构)、规划能力实现(CoT/ToT等算法)以及可靠的工具调用机制(Function Calling/ReAct/MCP)。这些技术使Agent能处理复杂任务如自动化运维、智能客服等场景。开发过程中需特别注意模型选型(如GLM-4适合中文工具调用)、工程化落地(可靠性保障、安全防护)以及成本控制(缓存策略、并行优

weixin_30596735的博客 414

第八篇 模拟面试套卷

考前模拟演练专用,检验学习成果,精准匹配初中高级三个职级的面试难度与考察重点。建议完整学完前七篇后闭卷作答,对照评分标准自查薄弱点,针对性补漏。评分说明:每套卷满分100分,60分合格,80分以上具备对应职级的面试竞争力。

weixin_45526015的博客 286

Java面试进阶:60K星开源项目如何把八股文变成源码级理解

技术面试考察的不仅是知识储备,更是对底层原理的融会贯通。在Java学习路径中,并发编程、JVM调优、Spring源码常被视为“八股文”重灾区,但单纯背诵结论无法应对面试官的层层追问。本文基于一个60K星开源项目,解析其如何以“问题→源码验证→推导过程→追问方向”的链路重构知识体系,将零散考点转化为可推导的思维模型。从Java基础集合到分布式系统设计,项目通过源码定位、坑点解释与追问预测,帮助开发者理解原理本质。无论是准备中高级岗位面试,还是为工作数年的工程师查漏补缺,这套方法论都能让“背题”真正转化为“懂原

weixin_30444105的博客 320

Claude Code AI记忆系统开发实战指南

AI记忆系统是构建持续学习型对话系统的核心技术,通过结构化存储用户交互数据实现上下文感知。其核心原理结合了向量数据库的语义检索能力关系型数据库的事务特性,在PostgreSQL+pgvector的技术栈中,向量索引(ivfflat)余弦相似度计算实现了高效记忆检索。这种混合架构相比纯向量数据库方案可降低40%查询延迟,在个性化推荐、智能客服等场景展现显著优势。Claude Code框架通过短期/中期/长期三级记忆体系,配合Python SDKVS Code开发工具链,为开发者提供了完整的AI记忆系统实

weixin_34208283的博客 371
上一篇: Android 车载开发岗位面试习题整理~
下一篇: 图形系统:简简单单学习WindowManagerService的启动流程
OpenHarmony_小贾
博客等级 码龄4年 1万+粉丝 1181原创
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值