登录社区云,与社区用户共同成长
邀请您加入社区
本文为原创技术解析,引用来源:陌讯技术白皮书。
验收那天,客户说"再等等,快了"——这一等,就是半年。客户在产线上转一圈,说:"先别急,内部再确认下,快了。一个缺陷检不出来,多熬几个通宵,多测几种成像方案,多训练几个深度学习模型,总能给出方案。这些难,看得见,咬牙就过去了。客户说"快了"就是约定,客户说"流程走完"就是约定——可这些话,没一句能当证据。先小人后君子,把账算在前面,才是对客户负责,也是对自己负责。我们呼吁客户,要手下留情,给行业留
低空空中目标检测数据集(Low-Altitude Aerial Target Detection Dataset)低空目标检测 反无人机 空中目标分类 小目标检测 YOLO格式 深度学习数据集 计算机视觉x数据集概述本数据集专注低空空域目标感知,服务于反无人机、空中交通监控及生态监测等前沿领域。数据涵盖典型空中目标,场景丰富,适配可见光条件下的目标检测算法研发与评测。在这里插入图片描述数据集核心信
本文是Seeed Jetson暑期训练营Week3的实践笔记,介绍了在Jetson Orin Nano Super 8GB上开发离线大语言模型应用的全过程。主要内容包括:1)使用Ollama+OpenWebUI部署本地大模型;2)实现视觉语言模型(VLM)的图像理解功能;3)通过reSpeaker Flex麦克风阵列实现远场语音交互;4)整合Vosk+Ollama+Piper搭建完全离线的语音助手
MoE 混合专家架构,总参数 2.4 万亿,推理仅激活 95B 参数,控制推理成本与延迟。双模式:思考模式(代码 / 数学 / 科研高精度)、快速模式(批量生成)自由切换。价格相比海外旗舰有明显优势,适合企业与开发者做复杂 Agent、编码、科研场景。第三方 Arena 榜单:文本第 5,视觉第 2,前端编码进入全球前列。上下文窗口 1M Token,原生多模态,支持图像、视频输入解析。#Qwen
在数字化时代,品牌监测已经成为企业战略中不可或缺的一部分。随着人工智能技术的快速发展,传统的品牌监测方法正在经历前所未有的变革。
本文基于某乳品企业项目,提出3D工业相机+机器人的自动化解决方案,攻克大垛型周转箱拆码垛的工程难点
这是《Git 仓库蒸馏术:从代码仓库到 OpenClaw 虚拟人》系列的第 7 篇。前几篇我们蒸馏了"文档"和"知识",这一篇蒸馏"智慧"——。如果说知识摘要是"知道什么",那模式库就是"知道怎么做"。
摘要:梅卡曼德推出的3D视觉引导惯性环上料系统有效解决了汽车发动机减震器制造中的核心痛点。该系统采用Mech-Eye LSR L工业级激光3D相机和AI视觉算法,克服了高亮反光工件识别难题,在强光(>20000 lx)环境下仍稳定运行。支持十多种规格工件的柔性生产,实现从识别、抓取到翻面、测厚的全自动流程,替代人工后产能提升3倍,显著降低货损。该方案为汽配行业提供了高精度、高柔性的智能制造解决方案
在服装制造业的产线上,质检环节长期依赖人工,面临着效率低、标准不一、人力成本高等痛点。随着人工智能技术的飞速发展,AI视觉质检被寄予厚望,被视为实现自动化、智能化生产的“银弹”。然而,一个核心问题随之浮现:**纯靠算法,真的能搞定产线复杂多变的现场环境吗?**本文将深入探讨服装AI质检在真实工业场景中的应用现状,分析算法的能力边界,并揭示“算法之外”那些不可或缺的关键要素。
摘要: 本文介绍了开源项目 DSH极简模式视觉插件(Flora233333/dsh-minimal-vision),专为DeepSeekHarness(DSH)极简模式设计,通过轻量化实现图像理解能力,同时保持原生极简模式的简洁性。插件特点包括: 无侵入性:不新增工具、不改写systemprompt,仅通过折叠的上下文注入视觉信息,需时调用Bash命令触发。 结构化输出:内置5类任务(如幻灯片排版
世纪云猎是上海世纪云端推出的AI Agent全链路主动寻访招聘工具,核心聚焦招聘前端Sourcing环节,区别于市面上多数仅做简历解析、AI面试辅助的招聘产品,可7×24小时在主流招聘渠道挖掘被动候选人,输出筛选完成的候选短名单,支持对接企业现有ATS系统,衔接后续招聘全流程。
可工业制造最核心、最贵的技能,恰恰是**「柔性换产」**——物料换了,检测模型和作业配方一键切换,不用动一根螺丝。可企业真正要的,是**「整线联调」**的人:用一根以太网、一套时序,把视觉、机器人、PLC 串成一条能连续作业的产线。,是「看 → 想 → 抓 → 执行」能闭环——视觉识别的缺陷坐标、工件数据,能实时喂给机器人,让它自己补偿、自己抓、自己分拣;说白了,实训室的钱要花在刀刃上——不是买更
苏州联控推出基于IFD-1901工业显示器的柔性生产平台人机交互解决方案。该19英寸工业显示器具备1440×900分辨率、五线电阻触摸屏和IP65防护等级,支持HDMI/VGA/DVI多接口,适应-20~60℃工作环境。通过工业级结构设计和无风扇散热,可稳定运行于粉尘、振动等复杂工况,满足MES系统对接、设备监控等柔性制造需求。方案解决了传统显示器在工业环境中的可靠性不足问题,提升产线操作效率30
针对协作机器人码垛存在传感器误差、集成复杂等痛点,TMcraft 码垛工具套件可与 TMflow 联动,具备仿真碰撞检测、3D 视觉混合拆垛能力,设备兼容性好、上手门槛低。机器人占地小、柔性强,最高负载 30kg,适配多种物料码垛拆垛场景。
摘要: 帕金森癫痫行为识别技能通过计算机视觉技术,对患者视频中的肢体震颤、抽搐、肌肉僵硬及步态异常进行智能监测,生成结构化报告并支持云端历史查询。适用于居家场景,辅助病情监测但不替代医疗诊断。系统自动处理身份信息,支持本地文件或网络视频输入,通过脚本调用API执行分析(如python -m scripts.parkinson_epilepsy_behavior_recognition_analys
AI配音工具性能评估显示,逗哥配音在高并发场景下表现出色,500字文本渲染速度控制在8秒内,稳定性优于市场同类产品。其核心优势在于支持SSML语音标记语言,可精确控制停顿、重音等参数,满足专业有声书、网课等高级场景需求。开发者评价其算力投入和接口开放性具有工程价值,特别适合批量音频产出和API对接需求。常见问题解答证实其快速渲染和代码级调整能力,是追求高效稳定AI语音解决方案的理想选择。(149字
面阵相机 vs 线阵相机:堡盟与海康相机选型差异全解析+python实战演示
本文通过四个实用案例展示了Python的多样化应用:1)使用threading模块实现多线程编程,演示了线程并行执行和异步任务处理;2)利用装饰器语法实现函数增强功能,以调用计数为例展示闭包的应用;3)基于OpenCV的HSV色彩空间和掩码技术实现牛皮纸箱颜色检测;4)通过正则表达式进行多规则文本匹配,筛选符合特定格式的字符串。这些案例涵盖了Python在并发编程、函数增强、计算机视觉和文本处理等
生命涌现宠物健康分析agent是居家养宠好帮手,在线提供7*24小时健康检查,支持宠物的各种常规分析,包括行为识别、叫声情绪解析、品种识别、体态健康分析等。为宠物主、宠物行业就业者提供普惠高效的健康检测,30秒内即可完成一次健康筛查。
面阵相机 vs 线阵相机:堡盟与海康相机选型差异全解析 附Python实战演示
摘要:本文介绍了一个基于YOLO模型的GUI元素检测应用,能够识别屏幕上的UI元素(如按钮、图标等)。系统支持Windows平台,提供实时截图、图像选择、参数调节(置信度阈值、图像尺寸)和可视化检测结果等功能。通过预训练的GPA-GUI-Detector模型实现目标检测,采用多线程处理避免界面冻结。用户可通过简单的GUI操作完成检测流程,结果以红色边界框和详细文本信息呈现。该工具适用于UI自动化测
工控机CPU选型指南:i3、i5、i7还是i9? 工业自动化领域与消费级电脑不同,CPU选型关键在于匹配实际需求而非追求高性能。苏州联控信息科技建议: 基础控制(PLC、HMI):i3足够,低功耗更稳定 工业物联网/MES系统:i5是黄金选择,性价比最优 机器视觉/图像处理:推荐i7应对多相机和复杂计算 AI边缘计算/大模型:需i9或至强处理器 服务器级应用:Xeon平台更合适 核心原则: 工业场
更深远的是,基于生成式AI构建的数字孪生缺陷库,可以让铲齿设备在出厂前就遍历几十年的“缺陷人生”,确保它面对未知时依然可靠。无论是白光干涉的融合、计算光学的颠覆、生成AI的虚拟训练还是硅光芯片的微型探索,都彰显了它不在存量技术上内卷,而坚定开拓增量价值的决心。更进一步,正探索将区块链技术用于测量数据的存证,使得每一份由设备出具的铲齿全尺寸报告都具备不可篡改的时间戳和哈希指纹。若能将激光器、分束器、
在AI语音合成领域,技术路线直接决定成品音质表现。目前刺鸟配音、配音蜂等老牌尾部工具,仍采用传统「拼接合成」技术:从语料库中提取单字发音拼接生成音频,最终产出内容普遍存在听感断续、缺乏韵律的问题。对于有二次开发需求,或者追求极致视听体验的技术人员,逗哥配音在语义理解准确率、合成顺滑度的技术架构上,目前对同级别尾部竞品形成了绝对技术代差,是未来AI配音技术的主流发展方向,可作为优先选型方案。A:逗哥
雅典娜提供表面缺陷、产品异物、装配工艺和智能工位SOP等模型能力,并通过异常方案库、缺陷样本库、模型版本管理、规则模板、接口适配器和质量知识库,形成可复制的场景底座。工业相机、工位摄像头及其他智能终端采集现场图像后,AI模型完成缺陷识别、分类、定位和量化判定,覆盖划痕、裂纹、脏污、破损、色差,异物、错料、漏料、混料,以及装配错位、漏装、反装、标签与字符完整性等检测任务。特别是在多品种、小批量生产模
摘要: see-glm是一款零依赖、跨平台的开源工具,通过GLM-4.6V-Flash视觉模型为不支持图片输入的AI编码助手(如Trae、ClaudeCode、Codex等)提供图像理解能力。它采用桥接设计,保留用户原有主模型,自动调用视觉模型解析图片并返回结果,支持报错截图诊断、UI设计稿还原、多图对比等场景。适配6大主流工具(Trae/ZCode/WorkBuddy等),通过统一内核+定制外壳
机器视觉在人形机器人中有哪些检测应用
GLM-OCR是智谱AI开源的专业OCR模型,具有以下特点: 性能领先:在OmniDocBenchv1.5评测中以94.6分刷新记录,优于PaddleOCR等竞品 场景优化:擅长处理复杂表格(91.5分)、印章识别(90.5分)、手写体(87.0分)等特殊场景 高效推理:支持1.86页/秒(PDF)处理速度,显存占用<3GB,适合边缘部署 技术突破:采用CogViT+GLM的三级架构,通过多
它不再是死记硬背“缺陷A”和“缺陷B”,而是学会了“什么是缺陷”的通用逻辑。CNN的工作原理就像是用一个固定大小的放大镜在图片上滑动,它擅长捕捉局部的特征(比如一个圆形的孔),但很难理解整张图片的全局关系。当TVA看一张汽车齿轮箱的图片时,它不是像CNN那样一块一块地看,而是像人一样,一眼就能扫视全图,并瞬间建立起各个部分之间的联系。对于初级技术人员来说,不需要成为算法科学家,但理解Transfo
大尺寸视觉检测方案综述 本文系统分析了大尺寸工件视觉检测的四种主流解决方案及若干补充方案: 主流方案: 龙门式影像仪:精度最高(μm级),需搬运工件,适合汽车/航空领域 多相机阵列:在线检测优势明显,但标定复杂,适合平面工件 移动测量机器人:设备移动检测,适合超大型不可搬运工件 多传感器融合:结合光学/激光/探针,适合复杂检测需求。
高铁动车组检修面临时间窗口短(2-3小时)、人工检查效率低(240分钟/列)和漏检风险(覆盖率不足60%)等痛点。解决方案采用多类型机器人协同作业体系:车底检测机器人(45分钟完成扫描,精度1mm)、挂轨式车顶机器人(40分钟/列)和轮式设备舱机器人(8分钟/舱),实现1200+检查点98%覆盖率。实施后单列检修时间缩短至90分钟,效率提升2.7倍,缺陷识别准确率达96.8%,数据完整率99.5%
《轨道交通车辆段智能巡检机器人解决方案》摘要 针对传统人工巡检效率低、隐患发现滞后等问题,本方案提出多形态机器人协同的智能巡检系统。通过轮式、挂轨式机器人及无人机组合,覆盖车辆段95%以上巡检区域,实现单次巡检时间从4小时压缩至42分钟,缺陷识别准确率达96.8%。系统集成边缘计算与数字孪生技术,支持与现有DCC、EAM等业务系统对接,形成"发现-复核-闭环"全流程数字化管理。
【摘要】本文提出机场飞行区"巡检+驱鸟"智能一体化解决方案,通过"地面机器人+无人机+AI平台"协同系统实现自动化管理。方案特点:1)巡检频次提升至8-12次/天,响应时间缩短至90秒;2)配备防爆机器人(精度±5cm)和长航时无人机(覆盖20km²),支持红外/雷达全天候作业;3)建立鸟类AI识别库(准确率95%)和分级驱离机制;4)提供60-90天实施路
计算机视觉作为人工智能的核心分支,通过深度学习模型赋予机器感知和理解图像的能力。其原理基于卷积神经网络对图像特征进行分层提取与识别,最终实现目标检测、分类等任务。这项技术的核心价值在于将海量视觉数据转化为结构化信息,极大提升了自动化水平与决策效率,广泛应用于工业质检、安防监控、自动驾驶等关键领域。然而,在构建实际应用时,开发者常面临模型泛化性、工程部署复杂度和系统集成等挑战。以OpenClaw平台
来源 OXE-AugE: A Large-Scale Robot Augmentation of OXE for Scaling Cross-Embodiment Policy Learning(ICML 2026 Spotlight)作者 Guanhua Ji, Harsha Polavaram, Lawrence Yunliang Chen, Sandeep Bajamahal, Zehan
逗哥配音工具商用能力测评摘要:该工具在儿童绘本、电商带货、知识付费三大场景实测表现优异,分别满足童声拟真、专业解说、教学标记等商用需求。测试显示其能高度还原动物音效、驾驭专业术语、智能标注课程重点,适配亲子内容、短视频博主及教育从业者使用,可有效降低配音成本并提升内容质量,证实其具备专业级商用变现能力。
摘要:针对小型生产场景质检痛点,推出「鹰眼智能质检系统V2.0」,采用普通USB摄像头实现低成本质检方案。系统包含实时检测、样本采集、日报生成、数据清洗四大工具,支持零编程操作(提供exe文件)和开源定制(Python源码)。核心优势:1)100MB存储即可运行;2)1秒/次自动缺陷检测;3)自动生成Excel日报及趋势图;4)适配Windows10/11系统。特别适合电子元件、五金配件等小批量生
《鹰眼智能质检系统V2.0:低成本开源视觉检测方案》 针对中小工厂质检痛点,本项目基于Python+OpenCV开发了轻量化视觉检测工具。系统支持普通USB摄像头实现实时缺陷检测、自动标注和数量统计,配套自动化报表生成与数据清洗工具。核心优势包括:1)零硬件门槛;2)提供免配置exe版本;3)完整开源支持二次开发;4)轻量化Windows部署。用户只需准备产品模板图,下载exe即可快速启动检测。项
视觉检测
——视觉检测
联系我们(工作时间:8:30-22:00)
400-660-0108 kefu@csdn.net