logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

pandas 使用apply同时处理两列数据

df = pd.DataFrame ({'a' : np.random.randn(6),'b' : ['foo', 'bar'] * 3,'c' : np.random.randn(6)})def my_test(a, b):return a + bdf['Value'] = df.apply(lambda row: my...

#python#机器学习#数据挖掘
docker下启动jupyter,并跑spark的方法

非 正 常 环 境操作方法:1、下载并解压spark内容2、以挂载的卷作为中转将spark文件复制到目标目录3、 import os os.environ["SPARK_HOME"] = "/usr/lib/spark" (换成上面的目标目录)运行jupyter时执行一下上面的语句就行了。不过似乎在jupyter设置一次就行。关了也能用。...

sklearn.metrics import average_precision_score研究

众所周知,average_precision_score计算的是PR曲线下的面积,然而import numpy as npfrom sklearn.metrics import average_precision_scorey_true = np.array([0, 0, 1, 1,1,1])y_scores = np.array([0, 0.5, 0.4, 1,1,1])print (avera

#sklearn#python#机器学习
word2013,分成两栏后文字顺序混乱的问题

    word2013默认的分栏,在一个自然段跨越一页时,会把跨越的那一部分分成两半,而我们希望它们继续在左边待着,怎么办呢?博主找了很久,终于在百度知道的一个被折叠的答案里找到了方法。    这个问题是word默认的分栏符的锅。只要将其删去即可。以word2013为例,在“开始”中,找到如下的圆圈中的东西,点击之,显示隐藏的符号,而后 而后在不想分栏的位置删除如下的这种“分栏符...

w10 安装maven,配置好环境变量后提示mvn无此命令的个人解决方法

方法1:参考https://blog.csdn.net/u014079773/article/details/49718207方法2:从百度知道上看的,可以使用管理员身份运行CMD

腾讯云centOS上运行jupyter,无法自动保存且提示forbidden的解决方法。

(虽然我的没有2)代码无法运行,In[ ]空白,运行后直接跳转到下一行,右上角显示error这样的错误)虽然说我的python是3.10,对应的jupyter版本也比较高。装上去说不兼容,但最终还是解决了问题。绕了一圈,尝试了包括改文件夹权限、重新安装jupyter等方法, 最后误打误撞的用。总的来说,就是强行安装 pyzmq==19.0.2。

文章图片
#jupyter#ide#python
pip安装,对于git+https://github.com/*.git较慢的情况

在某些环境下,使用git+https://github.com/*.git的时候,下载速度很慢。经常卡住。怎么办呢?可以直接在浏览器里打开 git 的地址,然后 Code——downLoad Zip,得到zip文件并解压。然后再在setup.py的目录下运行:python setup.py buildpython setup.py install即可。...

#git
为pyspark DataFrame增加一列

场景是为现有的dataFrame新增一列数据,这些数据与原有数据无关。其功能类似于pandas的join。参考python - PySpark - Adding a Column from a list of values - Stack Overflowfrom pyspark.sql import SparkSessionimport numpy as npimport pandas as p

#spark#big data#数据挖掘
Ubuntu环境下,基于python3.6,无需安装ffmpeg库,安装pyav

​这个东西不是必须的,但跑某个demo需要,所以还是记录一下。用这种方法不需要先安装一个ffmpeg。一、pyav是ffmpeg的python封装。所以需要安装依赖https://pyav.org/docs/develop/overview/installation.html#ubuntu-18-04-lts# General dependenciessudo apt-get install -y

#linux#ubuntu#运维
IDEA+Maven配置spark的pom.xml以及踩的一个坑

EmptyDataError不是python里的,所以不能直接except EmptyDataError:应使用:

    共 22 条
  • 1
  • 2
  • 3
  • 请选择