logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

将python项目部署在一台服务器上

我的是物理服务器:这是将服务器硬件直接放置在您自己的数据中心或机房的传统方法。这种方法需要更多的设备和维护工作,但提供更高的灵活性和控制权。使用Docker,可以将Python程序及其依赖项打包成一个镜像,并在服务器上运行该镜像。优点:Docker部署Python程序,可以提供更好的可移植性和可扩展性、可以在不同的服务器和环境中轻松地运行相同的镜像。优点:服务器less技术部署Python程序,可

文章图片
#python#服务器#开发语言
医疗数仓业务数据采集与同步

业务数据是数据仓库的重要数据来源,我们需要每日定时从业务数据库中抽取数据,传输到数据仓库中,之后再对数据进行分析统计。为保证统计结果的正确性,需要保证数据仓库中的数据与业务数据库是同步的,离线数仓的计算周期通常为天,所以数据同步周期也通常为天,即每天同步一次即可。数据的同步策略有全量同步和增量同步。全量同步,就是每天都将业务数据库中的全部数据同步一份到数据仓库,这是保证两侧数据同步的最简单的方式。

文章图片
#数据仓库#etl工程师#大数据 +2
表格预训练2022_TransTab学习跨表的可转换表格转换器

表格数据(或表格)是机器学习(ML)中使用最广泛的数据格式。然而,ML模型通常假设表结构在训练和测试中保持固定。在ML建模之前,需要进行大量的数据清理,以合并具有不同列的不同表。这种预处理通常会导致显著的数据浪费(例如,移除不匹配的柱和样品)。如何从具有部分重叠列的多个表中学习ML模型?如何随着时间的推移随着更多列变得可用而增量地更新ML模型?我们可以在多个不同的表上利用模型预训练吗?如何训练一个

文章图片
#人工智能
python京东爬虫

#json数据格式问题,可能是请求过于频繁,网站没有返回正常的数据#每天早上起床时可以运行,到下午后就一直报错。import requestsimport jsonimport csvfor page_num in range(49):new_url = f'https://club.jd.com/comment/productPageComments.action?productId=10023

#python#爬虫#chrome
虚拟机系统在登录界面循环往复,登录不进去问题

•/etc/profile —— 此文件为系统的每个用户设置环境信息,当用户第一次登录时,该文件被执行.并从/etc/profile.d目录的配置文件中搜集shell的设置;联想到修改/etc/environment文件时确实对PATH进行过操作,所以解决问题的最简单的方法就是让/etc/environment恢复到修改之前的状态。因此要编辑/etc/environment要使用的命令应该这样写:

文章图片
#linux
配置MySQL

1)将安装包和JDBC驱动上传到/opt/software,共计6个。2)如果是虚拟机按照如下步骤执行。

文章图片
#mysql#adb#android
虚拟机系统在登录界面循环往复,登录不进去问题

•/etc/profile —— 此文件为系统的每个用户设置环境信息,当用户第一次登录时,该文件被执行.并从/etc/profile.d目录的配置文件中搜集shell的设置;联想到修改/etc/environment文件时确实对PATH进行过操作,所以解决问题的最简单的方法就是让/etc/environment恢复到修改之前的状态。因此要编辑/etc/environment要使用的命令应该这样写:

文章图片
#linux
到底了