
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
NLP、大语言模型LLM、思维链、CoT

1、背景验证码自动识别在模拟登陆上使用的较为广泛,一直有耳闻好多人在使用机器学习来识别验证码,最近因为刚好接触这方面的知识,所以特定研究了一番。发现网上已有很多基于machine learning的验证码识别,本文主要参考几位大牛的研究成果,集合自己的需求,进行改进、学习。2、基本工具开发环境:python 3.5 + pycharm模块:...
NLP语言模型、大模型LLM、In-Context Learning(ICL)

通常,在训练有监督的机器学习模型的时候,会将数据划分为训练集、验证集合测试集,划分比例一般为0.6:0.2:0.2。对原始数据进行三个集合的划分,是为了能够选出效果(可以理解为准确率)最好的、泛化能力最佳的模型。训练集(Training set)作用是用来拟合模型,通过设置分类器的参数,训练分类模型。后续结合验证集作用时,会选出同一参数的不同取值,拟合出多个分类器。验证集(Cross Valida
一、需要安装的环境① JDK。本人安装的是1.8版本,安装过程略,网上可搜索anzhuang教程。② MAVEN。本人安装的是3.3.3。③ IDEA。版本是2016.3以后的版本。二、创建基于scala语言的spark项目①创建新项目(FILE -> NEW -> PROJECT)②左边栏选择Maven,点击红圈内容,Next
FAQ智能问答系统。实现FAQ的问题-模板匹配功能。部署轻量级的Web服务应用。

NLP语言模型、大模型LLM、In-Context Learning(ICL)

通用NER框架
介绍了微软Deepspeed大模型训练并行框架

基本信息基于Pytorch的文本分类框架。同时支持中英文的数据集的文本分类任务。项目地址:text_classifier_pytorch支持的模型非预训练类模型:FastTextTextCNNTextRNNTextRCNNTransformer预训练类模型BertAlbertRobertaDistilbertElectraXLNet支持的训练方式支持中英文语料训练支持中英文的文本分类任务。支持多种







