logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

从「穿透」到「击穿」:亿级缓存空值标记差点把Redis集群打穿

部分情节为虚构演绎,仅供参考说实话,我所在的团队做的是电商商品详情页的缓存系统。商品ID从1到几个亿,其中大量ID对应的商品根本不存在——下架的、删除的、从未创建过的。每次请求查缓存miss了就去查数据库,数据库查不到就返回空。这些"查不到"的结果如果不缓存,同一个不存在的商品ID被反复请求,就会全部打到数据库上——这就是经典的缓存穿透。我们的方案是给每个商品ID维护一个布尔标记:这个ID是否在缓

#python#开发语言#性能优化 +2
从「曝光」到「爆光」:推荐系统上亿曝光标记差点把内存撑爆

部分情节为虚构演绎,仅供参考」说实话,我们团队做的是电商推荐系统,核心链路里有一个环节叫「曝光去重」——说白了,就是记录每个用户已经看过哪些商品,避免同一件商品反复出现在用户面前。每天上亿次曝光请求,每个用户对应几十万商品池,每个商品都要打一个布尔标记:这个商品用户看过没有?听着挺简单对吧?不就是一堆 True 和 False 嘛,能有多难?但你猜怎么着?现实啪啪打脸!我本来想用最省内存的方式存这

#python#开发语言#性能优化 +2
Python内存优化实战教程:布尔数组从1MB到100KB,从新手到高手

还有IntHybridArray存超大整数、FloatHybridArray存浮点数,同样省内存—## 最后Python内存优化不是一蹴而就的,从新手用list浪费内存,到自动切换密集稀疏存储,中间差的不只是一个库,更是对数据结构的理解。因为Python里的bool是完整对象,每个值都有对象头,大量存的时候浪费非常严重。今天这篇从新手到高手,一步步带你优化布尔数组存储,从最开始的1MB,一步步优化

#python#开发语言#numpy +2
2026Python内存优化实战:布尔数组从1MB到100KB,从新手到高手

本文介绍了Python中存储大量布尔值的内存优化方案。从新手常用的list(占内存大)到numpy数组(省87%内存),再到稀疏数组和自动切换密集/稀疏模式的高阶优化,最终推荐使用开箱即用的BoolHybridArray库,可节省90%内存同时保持list的操作体验。该库支持位运算、二维数组、高性能队列等功能,在100万布尔值场景下仅占100KB内存,访问速度与list相当。适用于特征工程、布隆过

#python#缓存#开发语言 +3
BoolHybridArray 高效布尔混合数组实战效果展示Python布隆过滤器替代方案:亿级数据去重的位图混合存储实践

摘要:bool-hybrid-array 是一种智能混合存储的布尔数组工具,针对大规模稀疏数据(如用户状态、权限位图)实现极致内存优化。其核心特性包括: 动态切换存储模式:根据数据稀疏性自动选择位压缩(稀疏)或连续存储(密集),内存占用可降低90%以上; 高效位运算:支持百万级数据的与/或/非操作,利用SIMD指令加速; 多维扩展:提供二维矩阵和超大整数存储支持,解决标准类型的溢出问题; 实时监控

#python#性能优化#开发语言 +2
当「布尔数组」变成「布尔炸弹」:一个会自己换挡的 Python 库,救了我在 618 的命

回顾整篇文章,我们的探索路径其实是一条清晰的「踩坑—破局—验证—选型」链路:fill:#333;important;important;fill:none;color:#333;color:#333;important;fill:none;fill:#333;height:1em;纯集合运算密集定长数值位压缩存储稀疏+动态+数组语义电商大促:1 亿布尔标记list[bool]:800MB+ 爆内存

#python#开发语言#性能优化 +4
到底了