logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

速度与激情:Android Python + CameraX 零拷贝实时推理指南

原因:硬件为了优化读写,往往不在每一行结尾立刻换行,而是填充一些空字节(Padding),使得每一行的字节数是 16 或 64 的倍数。或者,在 Python 里直接修改传入的 Buffer(In-place modification),Java 端直接用这个 Buffer 创建 Bitmap 显示(虽然 Bitmap 创建会有一次拷贝,但比双向拷贝要好)。后果:仅仅是“搬运”数据就消耗了 20m

#unity
PHP 8.2 vs PHP 8.3 对比:新功能、性能提升和迁移技巧

不管是让开发更爽的 #[Override] 属性和 json_validate() 函数,还是底层的性能优化,这个版本确实值得升级。PHP 8.3 新增的 #[\Override] 属性能在编译时就发现这种错误,不用等到运行时才发现问题。PHP 8.3 虽然不是什么翻天覆地的大版本,但确实是个很智能的进化。老规矩,升级前一定要测试充分 — 不过如果你还在用 8.2 或更老的版本,8.3 绝对是个很

#unity
Python 装饰器

print(f"[日志] 实例 {self} 调用方法 {func.__name__},参数:{args},关键字参数:{kwargs}")简言之:调用时先执行外层装饰器的 “前置逻辑”,再执行内层装饰器的 “前置逻辑”,然后是原始函数,最后按相反顺序执行各装饰器的 “后置逻辑”。即:先执行下方的装饰器,再执行上方的装饰器,最终得到的 target 是最外层装饰器(decorator_a)返回的

#人工智能
Chats .. 发布:全面支持最新的 gpt- 模型等

KV Cache 是 Transformer 自回归推理的关键优化技术,通过缓存历史键值对将重复计算转化为内存查表,显著降低推理延迟。分页管理:借鉴操作系统的虚拟内存思想,vLLM 等框架将 KV Cache 切分为固定大小的块(如 16 个 token),动态分配物理显存,显著提升显存利用率和批处理吞吐。卸载与重算:对超长上下文,可将早期 token 的 KV 缓存卸载至 CPU 内存,或在访问

到底了