logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

深度学习文字识别

Blog:https://blog.csdn.net/implok/article/details/95041472步骤:文字识别是AI的一个重要应用场景,文字识别过程一般由图像输入、预处理、文本检测、文本识别、结果输出等环节组成。分类:文字识别可根据待识别的文字特点采用不同的识别方法,一般分为定长文字、不定长文字两大类别。定长文字(例如手写数字识别、验证码),由...

#人工智能#python#git
传统与深度学习图像分割算法

Blog:https://blog.csdn.net/qq314000558/article/details/816326931998年以来,人工神经网络识别技术已经引起了广泛的关注,并且应用于图像分割。基于神经网络的分割方法的基本思想是通过训练多层感知机来得到线性决策函数,然后用决策函数对像素进行分类来达到分割的目的。这种方法需要大量的训练数据。神经网络存在巨量的连接,容易引入空间...

#人工智能#前端#后端
Keras深度学习

一、Keras中的不同优化器测试梯度下降(Gradient Descent,GD),含有单一变量w的一般成本函数C(w):梯度下降可以看作是一名要从山上到山谷的背包客,山上表示成函数C,山谷表示成最小值Cmin,背包客的起点为w0。 背包客慢慢移动,对每一步r,梯度就是最大增量的方向。从数学上讲,该方向就是在步r到达的点wr上求得的偏导数。 因此,通过走相反的方向,背包客可以...

#人工智能#json#后端
使用Python基于百度等OCR API的文字识别

百度OCRBaidu OCR API:一定额度免费,目前是每日500次Python SDK文档:https://cloud.baidu.com/doc/OCR/OCR-Python-SDK.html安装使用1)首先注册一个百度云BCE账号登录官网https://cloud.baidu.com/ --> 右上角‘管理控制台’ --> 产品服务 --> ...

#python#人工智能
计算机视觉领域研究问题

一、图像分类图像分类主要是基于图像的内容对图像进行标记,通常会有一组固定的标签,通过模型预测出最适合图像的标签。比赛:ImageNet挑战赛(约有1400万张图像,超过20000个图像标签)模型:AlexNet、GoogLeNet、VGGNet、ResNet二、图像说明计算机视觉+自然语言处理,例如,为图像生成一个最适合图像的标题图像说明是基本图像检测...

#人工智能
深度学习文字识别

Blog:https://blog.csdn.net/implok/article/details/95041472步骤:文字识别是AI的一个重要应用场景,文字识别过程一般由图像输入、预处理、文本检测、文本识别、结果输出等环节组成。分类:文字识别可根据待识别的文字特点采用不同的识别方法,一般分为定长文字、不定长文字两大类别。定长文字(例如手写数字识别、验证码),由...

#人工智能#python#git
Hadoop单机模式/伪分布式模式/完全分布式模式

一、Hadoop的三种运行模式(启动模式)一.单机(非分布式)模式  这种模式在一台单机上运行,没有分布式文件系统,而是直接读写本地操作系统的文件系统。默认情况下,Hadoop即处于该模式,用于开发和调式。不对配置文件进行修改。使用本地文件系统,而不是分布式文件系统。Hadoop不会启动NameNode、DataNode、JobTracker、TaskTrac...

#大数据#java#运维
基于VS搭建OpenCV环境

OpenCVOpenCV的全称是Open Source Computer Vision Library,是一个跨平台的计算机视觉库。OpenCV是由英特尔公司发起并参与开发,以BSD许可证授权发行,可以在商业和研究领域中免费使用。OpenCV可用于开发实时的图像处理、计算机视觉以及模式识别程序。该程序库也可以使用英特尔公司的IPP进行加速处理。OpenCV用C++语言编写,它的主要接...

#人工智能#c##ruby
到底了