
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
文章摘要:本文测试了DuckDB的Excel数据读取功能,比较了官方excel插件和社区sheetreader插件的兼容性。测试使用多种Excel文件(包括生成的带日期/小数格式的数据和基准测试文件),结果显示官方插件能读取所有文件,而社区插件仅支持部分文件。性能测试因数据兼容性问题未能完成。结论指出Excel文件格式复杂,数据类型多样,实现完全兼容具有挑战性。测试中使用了Python(panda
PostgreSQL的numeric类型因满足精确十进制存储和受控舍入需求而流行。SQL标准将其列为精确数值类型,法律(如欧盟条例、HMRC)要求金额计算无隐式舍入且明确半值规则,金融交换格式(ISO 20022、FIX)也强制十进制编码。支付系统更以整数加货币属性表示金额。尽管numeric运算较慢,但其行为合规性使其成为金融应用的事实标准。
chDB Durable 使嵌入式 chDB 数据库可在进程重启、迁移等场景恢复,通过对象存储保存检查点与语句 WAL,并定义 V1 协议实现跨语言绑定一致性。它支持单写入者、租约隔离与 CAS 提交,确保持久化边界与故障安全。V1 提供完整备份和 WAL 重放,暂不支持增量检查点或多写者。Python 已发布,Node.js、Go、Rust 推进中。
本文介绍了在配备12核AMD Ryzen处理器的便携式笔记本电脑上测试DuckDB数据库性能的实验。研究人员使用3,000-10,000规模的TPC-H基准数据集(对应3-10TB数据量),结果显示该3,000欧元配置的笔记本能以近2GB/s速度加载CSV文件,并能完整运行TPC-H查询。实验发现适当的冷却间隔可提升32%性能,且在电池供电下仍能完成SF3,000测试。最终结论表明,现代笔记本已具
DuckDB团队发布了官方Docker镜像(hfmuehleisen/duckdb),用户成功拉取并运行该80MB大小的精简镜像。该镜像仅包含DuckDB可执行文件,不包含bash/sh等shell工具,直接运行/duckdb进入交互模式。用户通过docker run创建后台容器并挂载本地目录,但发现无法执行system命令和常规shell操作。镜像分析显示其配置极简,专为轻量级DuckDB运行环
摘要:PostgreSQL 18.0发布后,作者尝试在Linux容器中运行该版本。通过docker pull获取镜像后,首次运行因未设置密码而失败。随后参考网上教程添加环境变量和数据卷参数,又因目录不存在和网络模式冲突报错。最终通过创建数据目录并调整参数成功启动容器,验证了PostgreSQL 18.0的正常运行。整个过程展示了容器化部署PostgreSQL的常见问题及解决方法。(149字)
本文记录了在编译QuackML项目时遇到的问题及解决过程。首先使用DuckDB 1.3版本编译时出现头文件缺失错误,后改为与项目发布时间匹配的DuckDB 0.10.3版本。接着遇到RE2库相关错误,需要单独编译RE2库,但CMake命令不兼容。通过修改构建配置后成功编译RE2库。最后在包含头文件时发现系统预装RE2与自编译RE2的路径冲突,需调整包含路径。整个过程展示了版本兼容性和依赖库管理的重
摘要:pg_duckdb插件显著提升PostgreSQL查询性能 测试显示,pg_mooncake服务端自动加载的pg_duckdb插件能显著提升PostgreSQL查询效率。在1000万行数据的聚合查询测试中,启用pg_duckdb后执行时间从910ms降至483ms,性能提升近50%。执行计划显示查询已转由DuckDB引擎处理。此外,该插件还支持直接读取Parquet文件,虽然需要使用特殊语法
本文演示了使用DuckDB和mlpack插件处理经典鸢尾花数据集(Iris Dataset)的完整流程。通过加载httpfs和mlpack插件,读取包含150个样本的鸢尾花特征数据(X)和标签数据(Y),设置训练参数(Z)后,调用mlpack_adaboost_train函数训练模型(M)。训练结果显示分类准确率达99.3%,仅1个样本误分类。随后使用训练好的模型对新数据(N)进行预测,成功输出预
本文介绍了一个ClickHouse数独求解SQL的优化过程,主要包括:1) 将递归CTE改为非递归形式;2) 修改整除符号为Floor函数;3) 重写位移运算符为bitShiftLeft;4) 为子查询添加别名;5) 替换位运算符为bitAnd函数。优化后SQL在2.56秒内处理479万行数据,成功求解数独并输出结果"932567841157824963...",内存峰值使用2







