logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

snipping-tool-master: PyQT跨平台截图及图像识别工具

本文还有配套的精品资源,点击获取简介:本项目是一个基于Python和PyQT库开发的截图工具,它可能具有与Windows系统自带截图工具类似的界面和功能,但增加了图像识别技术。这种技术能够识别截图中的文本信息,尤其适用于工业化环境,如自动化测试、故障排查、生产监控等。项目使用了PyQT进行GUI开发,通过QGraphicsView和QPainter模块实现截图功能,并可能...

人体骨骼关键点检测对比:MediaPipe Pose vs OpenPose

本文介绍了基于星图GPU平台自动化部署AI人体骨骼关键点检测镜像的实践方法,支持MediaPipe Pose与OpenPose等主流框架的快速配置。该镜像可广泛应用于动作捕捉、健身指导和姿态分析等场景,助力开发者高效开展模型微调与AI应用开发,实现低延迟、高精度的人体姿态识别。

梦幻动漫魔法工坊实战:用LoRA微调打造专属画风,让你的动漫更独特

本文介绍了如何在星图GPU平台上自动化部署“梦幻动漫魔法工坊 ✨”镜像,快速搭建AI动漫创作环境。该工具集成了LoRA微调技术,用户无需复杂配置即可生成个性化动漫图像,轻松应用于角色设计、社交媒体配图等二次元内容创作场景。

AI智能棋盘部署TF-Luna实现激光雷达扫描

本文介绍如何利用TF-Luna激光雷达模块实现AI智能棋盘的非接触式落子检测,涵盖系统架构、扫描控制、数据处理及工程优化方法,提出一种低成本、高可靠性的感知方案。

Qwen3-0.6B-FP8模型微调入门:使用自定义数据提升特定任务性能

本文介绍了如何在星图GPU平台上自动化部署Qwen3-0.6B-FP8(内置模型版)v1.0镜像,并利用该镜像进行模型微调。通过LoRA等轻量级技术,用户可使用自定义数据(如客服对话数据)对模型进行训练,从而快速提升其在特定任务(如智能客服问答)上的专业性能和回复准确性。

MATLAB车牌定位与识别完整项目指南

图像预处理是计算机视觉和数字图像处理中的一个基础步骤,其目的是改善图像数据的质量和特征,以利于后续分析。图像预处理的意义在于减少噪声,增强重要特征,以及准备数据输入到后续的处理模块中。在车牌定位问题中,图像预处理尤为关键。由于车牌图像通常来自复杂的实际应用场景,如不同光照条件、不同角度、以及可能存在的遮挡等因素,这都要求我们在提取车牌信息前进行有效的预处理。预处理通过滤除噪声、调整对比度等方法提高

DAMOYOLO-S应用场景:智能制造中PCB板元器件缺失/错位检测探索

本文介绍了如何在星图GPU平台上自动化部署DAMOYOLO-高性能通用检测模型-S镜像,并将其应用于智能制造场景。该方案能够高效、精准地完成PCB板元器件缺失或错位等缺陷的自动化视觉检测,显著提升电子制造产线的质检效率与质量。

#目标检测#智能制造
手写文字识别效果一般,建议换专用模型

本文介绍了如何在星图GPU平台上自动化部署cv_resnet18_ocr-detection OCR文字检测模型 构建by科哥镜像,实现印刷体文字检测功能。通过该平台可快速搭建OCR环境,典型应用于合同、发票等文档图像中的文本区域识别,提升信息提取效率。

OFA视觉问答模型作品分享:10组真实图片+问题+答案的高质量VQA输出集

本文介绍了如何在星图GPU平台上自动化部署OFA视觉问答(VQA)模型镜像,实现AI看图问答功能。该平台简化了部署流程,用户可快速体验模型能力,例如上传一张商品图片并提问“What is the main color of the product?”,模型能准确识别并回答“black”,适用于智能相册管理、教育辅助等场景。

Fun-ASR语音识别系统实时流式识别:麦克风录音转文字教程

本文介绍了如何在星图GPU平台上一键自动化部署由科哥构建的“Fun-ASR钉钉联合通义推出的语音识别大模型语音识别系统”镜像。该镜像提供了开箱即用的WebUI界面,用户无需复杂配置即可快速搭建环境,并利用其核心的实时流式识别功能,轻松实现麦克风录音实时转文字,高效应用于会议记录、语音笔记等场景。

#语音识别
    共 752 条
  • 1
  • 2
  • 3
  • 76
  • 请选择