logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

跨境IT应用(4):用爬虫把产品关键词排名存进数据库,让运营随时回溯

后来,公司业务规模扩张,产品数量在一年内从800多增长到数千个,还增加了4个售卖渠道,每个产品有1至10个核心关键词,虽然有“多个产品共用同一个核心关键词”的情况,但关键词总数还是来到了5w+。运营部同事叫苦,即便增加了一倍的人手,还是没法按时下班,总是需要占用休息时间对数据进行整理,加班只给调休,有些同事的调休积攒了超过200多个小时,因为工作太忙,根本没时间用。

#爬虫
python dataset笔记(Dataset类)

Dataset类是Hugging Face datasets库中的核心类,用于高效加载、处理和存储大规模数据集。它提供类似pandas的易用接口,同时支持内存映射和流式加载,特别适合处理超大规模数据。

#python#自然语言处理
python报错:SyntaxError: Non-UTF-8 code starting with ‘\xe8‘ in file解决方法

python报错:SyntaxError: Non-UTF-8 code starting with '\xe8' in file提示编码不能正确解码。在文件开头位置声明编码格式即可解决。

#python
Sort-Merge Join【排序连接算法】详解(python代码实现,以FULL JOIN为例)

Sort-Merge Join 是一种稳定可靠的连接算法,特别适合大数据集连接、连接键有索引或已预排序、需要对结果排序的场景

#数据结构#算法
跨境电商SQL Server报表生成优化:索引一改,600秒变75秒

跨境电商SQL Server报表生成优化:索引一改,600秒变75秒

#数据库
跨境电商开发者的ETL选型实战:低代码工具Kettle

作为一名跨境电商公司的IT人员,我面临着一个典型的数据处理困境。公司运营着多个跨境电商平台,每天需要处理大量订单、产品排名、销售数据。这些数据分散存储在SQL server的各个表中,其中最大的表包含了近5亿条数据记录。

文章图片
#etl#低代码#数据仓库
自研跨境电商ERP:Flask + Layui + SlickGrid 技术选型可行性分析

技术选型没有标准答案,适合自己的才是最好的。而这套方案,至少值得你试一下。

#flask#layui#python
安装python时Install launcher for all users灰色无法选中解决方法

解决办法:可能是上一次卸载python没卸载干净,在控制面板中卸载,把Python Launcher卸载掉。卸载完后,就可以正常安装了。

#python
安装python时Install launcher for all users灰色无法选中解决方法

解决办法:可能是上一次卸载python没卸载干净,在控制面板中卸载,把Python Launcher卸载掉。卸载完后,就可以正常安装了。

#python
python获取chrome里的cookies

这段代码只能在Windows系统运行。

#python#chrome
    共 13 条
  • 1
  • 2
  • 请选择