logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

一图+一句话理解机器学习算法之线性判别分析(Linear Discriminant Analysis, LDA)

线性判别分析(LDA)将数据点进行投影,使得同类数据投影空间尽可能相近,异类数据在投影空间尽可能远,是常用的降维和分类手段,如下图所示:

#机器学习
一图+一句话理解机器学习算法之支持向量回归(Support Vector Regression, SVR)

支持向量回归(SVR)传统回归方法当且仅当回归f(x)完全等于y时才认为预测正确,如线性回归中常用(f(x)−y)2(f(x)−y)2(f(x)-y)^2来计算其损失。而支持向量回归则认为只要f(x)与y偏离程度不要太大,既可以认为预测正确,不用计算损失,具体的,就是设置阈值αα\alpha,只计算|f(x)−y|>α|f(x)−y|>α|f(x)-y|>\alp

LSTM的加速算法:QRNN和SRU

LSTM介绍及加速原理LSTM的公式可以表示如下所示,其中分别表示输入门,输出门,遗忘门。对LSTM还不熟悉的同学可以先阅读:理解LSTM网络或者直接阅读Christopher Olah 的原博文:Understanding LSTM Networks从上述公式中,我们先来分析公式中各个部分的计算复杂度,记和的大小为,则大小也是,W的大小为:矩阵乘法【即式中标红部分】:次乘法表...

#自然语言处理
基于卷积注意力神经网络的命名实体识别(CAN-NER)

CAN-NER: Convolutional Attention Network for Chinese Named Entity Recognition(NAACL-HLT 2019)

文章图片
开源词典收集

新华字典基于GitHub项目中的词库+成语,构成30W词典https://github.com/pwxcoo/chinese-xinhua搜狗词库搜狗统计得到的15W高频词,并标注常用词性https://www.sogou.com/labs/resource/w.php清华词库【多领域词库】IT词库、财经词库、成语词库、地名词库、历史名人词库、诗词词库、医学词库、饮食词库、法律词库、汽车词库、动物

#自然语言处理
层次Softmax相关论文整理

Softmax函数是逻辑函数的一种推广,广泛应用于神经网络的多分类问题中,然而其计算复杂度与类别大小呈线性关系,在应用于语言模型、机器翻译时会带来高额的计算量,故而不少研究尝试寻找其高效的近似方法,层次Softmax便是其中一种常用的方法,本小节中将介绍层次Softmax中的一些代表模型。1992年,Brown等人在论文《Class-based n-gram models of natural..

分词数据集

分词数据集1. SIGHAN 2005数据集数据集简介:SIGHAN 2005数据集国际中文自动分词评测(简称SIGHAN评测)整合多个机构的分词数据集构成。该数据集由中国微软研究所、北京大学、香港城市大学、台湾中央研究院联合发布,用以进行中文分词模型的训练与评测。其中 AS 和 CityU 为繁体中文数据集,PKU 和 MSR 为简体中文数据集。数据集详情:名称规模创建日期单位论文下载评测MSR

#自然语言处理
到底了