logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

DeepSeek-OCR解读

相比于传统的OCR技术,DeepSeek OCR 因为融入了先进的深度学习AI,所以它:更聪明:识别准确率更高,尤其对复杂版面和手写体(在一定清晰度下)效果更好。更强大:能处理各种“刁难”的场景,比如文字倾斜、光线不均等。更全能:通常支持多种语言混合识别,表格识别等复杂任务。总而言之,DeepSeek OCR 就是一个能帮你把“死”图片里的文字“救活”,变成“活”的电子文本的AI神器!

#人工智能
多模态大模型应用

海光 K100-AI 64G(DTK25.04,国产DCU环境):国产化信创适配验证。框架:Transformers、LLaMA-Factory、Pytorch。、显存占用适中、推理速度均衡、CUDA/国产海光双适配;CUDA11.8兼容,海光适配需定制依赖。细节纹理识别优于2B,证件纹理区分度高。CUDA11.8/海光K100全支持。CUDA11.8/海光K100全支持。局限:算力资源消耗高,并

#深度学习
将图像分割mask转换为目标检测框bbox

cv2.threshold()cv2.connectedComponentsWithStats()https://zhuanlan.zhihu.com/p/59486758num_labels, labels, stats, centroids = cv2.connectedComponentsWithStats(image, connectivity=8, ltype=None)参数介绍如下:i

#python
图像分割mask转换为目标检测框bbox

stats:每一个标记的统计信息,是一个5列的矩阵,每一行对应每个连通区域的外接矩形的x、y、width、height和面积,示例如下: 0 0 720 720 291805。labels :对原始图中的每一个像素都打上标签,背景为0,连通域打上1,2,3。的标签,同一个连通域的像素打上同样的标签。image:也就是输入图像,必须是二值图,即8位单通道图像。labels:图像上每一像素的标记,用数

#目标检测#计算机视觉
OpenClaw简介

OpenClaw本身不是一个像ChatGPT那样只会聊天的AI大脑,而是一个能赋予AI“手脚”的执行引擎,让AI从“只会说”变成“会干活”。OpenClaw就像一个,你可以通过,或者直接在它的网页界面上,像给同事发消息一样给它。它接收到指令后,就能在你的电脑或服务器上自动执行一系列复杂操作,比如整理文件、操作浏览器、处理邮件、编写代码等。因为它使用一只作为标志,所以很多爱好者把使用它的过程形象地称

#算法
microsoft visual c++ build tools

因为visual studio的安装包太大,所以在不需要开发的情况下,可以选择使用microsoft visual c++ build tools安装c++编译器,这个工具会小很多。安装使用Visual C++ 编译器的 standalone(独立)版,而不需要安装庞大的Visual Studio。可以使用Microsoft C++ 生成/构建工具(Build Tools)来安装Visual C+

#microsoft#c++#windows
立体视觉的内容简介

立体视觉(也称双目视觉)主要研究的两个相机的成像几何问题,研究内容主要包括:立体标定(Stereo Calibration)、立体校正(Stereo Rectification)和立体匹配(Stereo Matching)。目前,立体标定主要研究的已经比较完善,而立体匹配是立体视觉最核心的研究问题。匹配图像对是OpenCV自带校正好的图像对标准测试平台提供的标准图像对:MiddleBuryKITT

#算法#自动驾驶
ffmpeg 音频处理

视频抽取音频ffmpeg -threads 16 -i xxx.mp4 xxx.wav (能提取5.1声道,采用这个!!!)或ffmpeg -threads 16 -i xxx.mp4 xxx.wav -acodec aac -vn -ac 2 -ar 48000 -ab 128000 xxx.aac (有压缩,默认提取2声道)提取aac音频:ffmpeg -i 3.mp4 -c:a copy 3

#音视频#语音识别#人工智能
图像分割入门

图像分割 传统方法https://zhuanlan.zhihu.com/p/30732385语义分割论文-DeepLab系列http://hellodfan.com/2018/01/22/%E8%AF%AD%E4%B9%89%E5%88%86%E5%89%B2%E8%AE%BA%E6%96%87-DeepLab%E7%B3%BB%E5%88%97/FCN可以接受任意尺寸的输入图像,采用反卷积层对最

#计算机视觉#深度学习#cnn
ubuntu系统更换源

ubuntu系统更换源     更换源的方法非常简单:修改/etc/apt/sources.list文件即可2.1:进入/etc/apt/cd /etc/apt2.2:修改sources.list文件sudo vi sources.list (要有管理员权限)2.3:可以在修改前先对 sources.list文件进行备份sudo cp sou

    共 25 条
  • 1
  • 2
  • 3
  • 请选择