登录社区云,与社区用户共同成长
邀请您加入社区
人工智能大模型(如通义千问、DeepSeek、智谱GLM、Kimi等)不仅能网页对话,还能通过 API 集成到自己的应用。调用 API 的前提是获取专属的,它相当于身份凭证,用于验证权限和计量用量。本指南教你获取、配置和使用 API Key,零基础也能上手。
AI 生成的配图左上角带着平台水印标签,直接放进技术博客太难看。本文记录了不装 PS、在浏览器里去水印的完整过程:先讲清 inpaint 图像修复的三类原理(扩散式修复、块匹配纹理合成、深度学习修复),再用两张真实带水印的图实测本地快速扩散与服务端智能修复两种模式,附涂抹细节、额度限制和一次服务端报错的踩坑记录。
江浙沪地区2026年将举办多场EI/Scopus检索国际学术会议,覆盖人工智能、电子信息、生物医药等热门领域。本文整理 2026 杭州、南京、上海、苏州江浙沪地区 EI&Scopus 国际学术会议清单,覆盖工科、交叉学科多个研究方向,汇总征稿动态,助力硕博生、高校教师论文投稿、线下参会,满足毕业、职称晋升、成果展示等科研需求。
收录检索:EI Compendex, Scopus,IEEE Xplore。第四届算法、图像处理与机器视觉国际学术会议(AIPMV 2026)点击官网 即可参会/投稿/了解会议详情。大会时间:2026年9月18-20日。截稿时间: 2026年9月4日。会议地点:中国-江苏-南京。审稿录用:投稿后7个工作日。并行和分布式算法与数据结构。图像和视频感知和质量模型。图像存储、检索和身份验证。计算机图形学
本文详细介绍了如何使用Python和NumPy实现图像缩放中的双线性插值算法,解决最近邻插值带来的锯齿和模糊问题。通过核心算法解析、坐标映射技巧和完整代码示例,帮助开发者掌握高质量图像缩放技术,并对比了不同插值方法的性能与适用场景。
本文通过Python和OpenCV详细演示了遥感成像原理的代码实践,包括摄影成像和扫描成像的模拟。从中心投影变形到推扫式、摆扫式扫描,逐步构建完整的遥感模拟系统,帮助读者直观理解遥感技术核心概念,并提供了性能优化和实际应用案例。
本文详细介绍了如何使用Python中的OpenCV和NumPy库为图像添加泊松噪声,包括基础实现、高级参数调优技巧以及效果评估方法。泊松噪声在医学影像和低光摄影中尤为重要,文章通过完整代码示例和参数详解,帮助开发者掌握这一关键技术。
本文详细介绍了如何使用Python和OpenCV进行图像色彩校正(CCM),从CCM矩阵原理到实际代码实现,包括伽马校正和自动白平衡技术。通过实战案例,帮助开发者掌握专业级色彩校正方法,提升图像处理质量,适用于电商、摄影等需要精准色彩还原的场景。
本文通过Python Pillow库实战,详细讲解如何构建社交媒体图片批量处理工作流。涵盖智能裁剪、并行处理、滤镜应用及自适应水印等核心技巧,并提供完整代码,帮助内容运营者将繁琐的图片处理工作自动化,大幅提升效率。
Python图像处理入门:Pillow+Numpy实现拼接与混合 本文介绍了使用Python的Pillow和Numpy库进行图像处理的基础知识,特别聚焦于图像拼接和混合技术。主要内容包括: 图像本质理解:彩色图片是(H,W,C)三维矩阵,数据类型为uint8(0-255) 格式转换: PIL Image与Numpy数组互转 RGB与BGR通道顺序转换 uint8与float32数据类型转换 图像拼
本文通过OpenCV实战,详细解析了霍夫变换在直线检测中的应用。文章提供了完整的Python代码示例,并重点讲解了`cv2.HoughLinesP`等关键函数的参数调优技巧,如阈值、最小线段长度等,帮助开发者快速实现从图像中精准提取几何特征。
本文介绍了如何在星图GPU平台上自动化部署“🍄 SUPER COLORIZER: 奇幻上色大冒险”镜像,并利用其AI能力实现批量图片上色。该镜像的核心应用场景是快速、高效地为大量黑白线稿或设计草图进行自动化色彩填充与风格化处理,显著提升美术创作和设计工作的效率。
本文介绍了一种基于傅里叶变换和Numpy的Python图像边缘检测方法。通过将图像转换到频率域,利用高通滤波器(如理想、高斯、巴特沃斯滤波器)分离并保留代表边缘的高频信号,再经逆变换得到边缘轮廓。该方法从频域视角深入剖析了边缘的本质,并提供了完整的代码实现与优化技巧。
本文详细介绍了如何使用Python和OpenCV实现分段线性变换技术,将模糊图片快速转换为高清图像。通过核心原理讲解、实战代码示例和三大典型应用场景分析,帮助读者掌握灰度变换和图像增强的关键技术,特别适合处理低对比度、模糊或高动态范围的图像。
本文详细介绍了如何使用Python的imgvision库实现sRGB到Lab色彩空间的高精度转换,特别解析了D50/D65光源设置对色彩表现的影响。通过实战代码演示和光源参数对比,帮助开发者解决设计印刷中的色偏问题,提升色彩管理效率。
本文深入解析Python+OpenCV实现Alpha融合的五种模式,包括Over、In/Out、Atop/Xor等,提供完整代码示例和避坑指南。通过实战案例展示alpha compositing技术在图像处理中的应用,帮助开发者掌握透明效果、图层叠加等核心技能,提升游戏开发、UI设计等场景的视觉效果。
欢迎继续Python机器视觉的学习之旅!在前5章中,我们已经掌握了Python基础、NumPy数组操作和Matplotlib可视化技能。现在,让我们正式进入OpenCV的世界,学习图像处理的核心技术。本章内容将带你从零开始掌握OpenCV的基础操作,为后续项目打下坚实基础。重点:OpenCV-Python是OpenCV的Python接口,安装非常简单。安装后验证:6.2 图像的读取、显示与保存这是
本文提供了一套基于卡尔曼滤波的Python图像目标跟踪实战方案。通过详细的工程化实现、参数调优技巧及多目标跟踪集成方法,帮助开发者构建高鲁棒性的跟踪系统,有效应对目标遮挡、检测抖动等挑战,并附有完整可运行的代码示例。
恭喜你完成了OpenCV基础部分的学习!现在你已经掌握了图像处理、特征提取和轮廓分析等核心技能。以及。相机标定是机器视觉中的基础但至关重要的步骤。现实中的相机镜头会引入畸变,而标定的目的就是获取相机内部参数和畸变系数,从而校正图像,并为三维重建打下基础。
本文详细介绍了如何使用Gabor滤波器进行图像增强的实战方法。通过剖析Gabor滤波器作为纹理感知利器的原理,提供从零构建Gabor核、进行多尺度多方向卷积的完整Python代码,并深入讲解参数调优技巧,帮助开发者快速掌握这一强大的图像处理工具,实现纹理分析和特征增强。
本文详细介绍了如何使用Python为ComfyUI开发自定义图像处理节点,重点实现OpenCV滤镜功能并进行性能优化。通过手把手教程,开发者可以学习到从环境搭建、核心算法封装到GPU加速等关键技术,最终构建高效的图像处理工作流。内容涵盖自定义节点开发、OpenCV滤镜实现及ComfyUI集成等实用技巧。
本文深入探讨了使用Python和OpenCV进行图像亮度与对比度调整的工程化实践。从基础的线性变换原理出发,详细解析了`cv2.convertScaleAbs`函数,并提供了从朴素循环到高效向量化、再到自动参数调整与局部增强的完整代码实现,帮助开发者超越简单的三行代码,掌握实际项目中的核心算法与应用技巧。
本文通过5个Python+OpenCV实战项目,帮助初学者轻松入门计算机视觉。从基础图像操作到智能滤镜生成、人脸检测、文档矫正、运动检测和全景拼接,每个项目都配有详细代码和实用技巧,适合想要快速掌握CV技术的开发者。
本文深入探讨了图像复原的核心技术,通过Python实战演示了从图像退化模型到经典复原算法的完整流程。重点解析了逆滤波的直观思路及其噪声放大问题,并详细介绍了维纳滤波如何通过引入统计先验实现更优的复原效果。文章提供了大气湍流、运动模糊和高斯模糊等退化模型的代码实现,并对比了不同方法的优劣,为计算机视觉开发者提供了从理论到实践的清晰指南。
如果你是显示视频,一般填1,就是等1毫秒,继续往下走。后来2000年发布了第一个正式版本,之后不断更新,支持了Python、Java、C++各种编程语言,现在最新的版本已经到4.x了,不仅支持传统的图像处理,还能和深度学习结合,调用训练好的深度学习模型做目标检测、图像分割,功能越来越强大。我们今天从介绍OpenCV,到环境搭建,再到跑通第一个完整的图片读写示例,已经把入门的第一步迈出去了,接下来就
本文深入解析Alpha融合技术在数字图像处理中的五种模式(Over、In、Out、Atop、Xor),通过Python和OpenCV提供完整代码实现。从基础概念到实战应用,帮助开发者掌握图像合成的核心技术,提升UI设计、特效制作等场景的工作效率。
本文详细指导在Win10系统下,如何将轻量级编辑器VSCode与强大的计算机视觉库OpenCV相结合,搭建高效的开发环境。内容涵盖从VSCode安装、MinGW编译器配置、CMake工具使用,到OpenCV源码编译及VSCode项目配置的全过程,并通过一个读取显示图片的实战案例,验证环境配置成功,帮助初学者快速入门图像处理开发。
本文探讨了GPT-4多模态能力在数学建模竞赛中的创新应用,特别是在图像数据处理方面的实战技巧。通过热力图数据提取、手写公式转录和可视化增强三大场景的详细解析,展示了如何利用AI技术提升竞赛效率与质量。文章还提供了精度控制方法论和高阶应用蓝图,帮助参赛团队在2024年赛事中取得优势。
本文深入探讨了DeepSeek在多模态领域的现状与未来,重点分析了其在图像与音频处理方面的局限性及实用变通方案。虽然目前DeepSeek的核心能力仍集中在文本处理,但通过结合OCR工具、图像识别API等外部技术,用户仍能实现高效的多模态工作流程。文章还展望了未来DeepSeek可能实现的技术突破及其在教育、医疗等领域的应用潜力。
本文详细介绍了如何使用JavaScript实现Gemini图片水印的精准擦除,无需依赖Photoshop等专业软件。通过解析Alpha混合算法,提供完整的代码实现,包括水印检测、Alpha通道提取及核心去水印算法,帮助开发者快速掌握前端图像处理技术。
摘要:本文介绍了一款基于Go语言开发的跨平台图片压缩工具PixRoon。由于旧工具不兼容M系列芯片,作者采用Wails框架(Go+Vue3)实现了核心功能,利用Go协程实现高效并发处理。工具支持PNG/JPG/WebP等格式的批量压缩,提供质量调节(10-100)、多格式输出(WebP/JPG/PNG)、自定义尺寸缩放(支持等比)等功能,具备拖拽添加、实时进度显示、主题切换等特性。项目已开源在码云
本文介绍了如何在星图GPU平台上自动化部署Qwen-Image-Edit-2511镜像,实现通过自然语言指令快速编辑图片的功能。该工具特别适合电商产品图优化、社交媒体配图调整等场景,用户无需专业设计技能即可获得惊艳的编辑效果,大幅提升工作效率。
本文介绍了如何在星图GPU平台上自动化部署Llama-3.2V-11B-cot镜像,并详解其Token限制及应对策略。该视觉语言模型能将图片转换为视觉Token进行处理,通过智能降采样、关键区域裁剪等方法,可在有限Token预算内高效解析高分辨率图像,适用于图表解读、场景理解等视觉问答场景。
文章摘要本文介绍了一套完整的AI舞蹈视频生成流程,通过GPT-Image-2生成16宫格分镜图,再利用满血版Seedance2.0生成丝滑竖屏视频。16宫格分镜图解决了单图生成视频时的动作断裂、动态细节失控和镜头混乱三大痛点,通过提供动作剧本和动态锚点,确保动作连贯、细节精准、视角统一。文章详细分享了从获取API Key到生成分镜图和视频的完整操作流程,包括Python脚本和提示词模板,帮助新手轻
摘要: 作者基于对终端版Claude Code的使用痛点,利用Codex CLI开发了一款8000行代码的Electron桌面客户端。该工具保留了CLI核心功能,新增了会话管理、可视化工具调用、Markdown预览和多项目切换等特性。开发过程采用"Vibe Coding"模式,完全通过自然语言与AI协作完成,包括架构设计、代码生成和问题修复。应用设计遵循本地优先、键盘驱动原则,提供Agent和Ch
本文深入探讨了深度学习在单图超分辨率(SISR)技术中的核心演进与应用实践。从SRCNN到Transformer架构,详细解析了残差学习、注意力机制等关键技术突破,并分享了医疗影像、遥感图像等垂直领域的落地挑战与解决方案。文章还展望了NeRF等前沿技术在超分领域的应用前景,为从业者提供全面的技术参考。
图像处理与机器视觉
【SPIE出版、EI检索稳定】2026年计算机视觉、图形学与人工智能国际学术会议(CVGAI 2026)
第二届大数据与智慧医学国际学术会议(BDIMed2026)将于2026年6月26-28日在重庆召开。会议由重庆中医药学院和上海交通大学联合主办,聚焦智能医疗与健康技术领域。会议论文集将由ACM出版并提交EI、Scopus检索,同时开设EI期刊专刊征稿。征稿主题涵盖数字健康技术、医学影像分析、智能医疗设备等五大方向,包括医疗大数据分析、远程医疗、可穿戴设备等前沿领域。投稿论文将经过严格审稿流程,录用