logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

处理twibot-22数据踩过的坑:两个数据集id形式不对应

最后发现users的数据集里,id内容是'u'+账号,也就是说,是个str;而tweet数据集里的author_id内容只有账号,即int,这就导致了二者完全配不上。这里要注意的是users数据我预先处理成了list形式,首行是标签,所以在for循环按行改id的时候,是从第‘1’行开始的,因为第‘0’行是标签。最后提前处理了下users的id数据,把所有的u删去,再转成Int型,终于可以用了。最近

#python#github
vscode突然连不上远程服务器

vscode连接远程服务器遇到的问题

文章图片
#vscode#github#ide
vscode不想每次运行代码都重新加载数据怎么办

最近在尝试做机器人账号检测工作,用到了twibot-22数据这数据实在是太大了!本人又代码小白,写代码经常报错,每次遇到bug运行断掉,然后重新运行又要等好久加载数据。于是一边等数据加载,一边灵光一现,有没有什么办法可以加载一次数据后面不用反复加载了呢。

文章图片
#vscode#编辑器
vscode不想每次运行代码都重新加载数据怎么办

最近在尝试做机器人账号检测工作,用到了twibot-22数据这数据实在是太大了!本人又代码小白,写代码经常报错,每次遇到bug运行断掉,然后重新运行又要等好久加载数据。于是一边等数据加载,一边灵光一现,有没有什么办法可以加载一次数据后面不用反复加载了呢。

文章图片
#vscode#编辑器
处理twibot-22数据踩过的坑:两个数据集id形式不对应

最后发现users的数据集里,id内容是'u'+账号,也就是说,是个str;而tweet数据集里的author_id内容只有账号,即int,这就导致了二者完全配不上。这里要注意的是users数据我预先处理成了list形式,首行是标签,所以在for循环按行改id的时候,是从第‘1’行开始的,因为第‘0’行是标签。最后提前处理了下users的id数据,把所有的u删去,再转成Int型,终于可以用了。最近

#python#github
ImportError: cannot import name ‘AdamW‘ from ‘transformers‘

错误通常是由于 transformers 库版本过旧或导入路径变化引起。

#前端#javascript#数据库
ImportError: cannot import name ‘Seq2SeqEncoder‘ from ‘fastNLP.modules‘

也有方法提到将fastNLP升级或降级到0.5.5稳定版本,然而笔者试过还是不行。将fastNLP卸载,重新安装跟transformer适配的版本,即0.7.0。笔者是以上版本好使了。

#python
调用BERT模型时报错 Numpy is not available

这里要注意的是,我用的vscode的.ipynb,原文件怎么改还是报错,但是新建一个文件,调用原来的库就能用,同样的库在原文件就报错,不知道什么问题,但至少能用。为了确保安装的numpy版本是对的,我直接把原来的numpy也卸载了。注意pip和conda都卸一遍,避免版本错误。然而升级时显示有以上报错,大致是因为安装的numba库的限制。于是尝试升级Numpy至最新版本,发现有以下报错。经过检测,

#bert#人工智能#深度学习 +1
到底了