
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
本文分享一个工业螺栓计数的真实项目,从传统机器视觉(形状匹配→模板匹配→分水岭分割)到深度学习检测的完整技术演进。作者详细拆解了图像反转、二值化、距离变换、分水岭算法、粒子分析等传统方案的全流程,对比了深度学习方法在精度和开发效率上的巨大优势。对理解传统视觉与深度学习的技术代差有直接参考价值。

《为什么"聪明"的工程师做不好项目?》探讨了技术人才在项目中的思维局限问题。文章指出,许多技术专家虽然专业能力强,却常陷入"一维思考"陷阱——只从自身专业角度解决问题,而忽视其他维度。作者结合工业视觉领域十年经验,将思考能力分为五个维度:单一专业视角、多角度认知、跨领域整合、模式识别和时间维度考量。真正的项目高手需要突破专业身份认同的束缚,主动跨越认知边界,

一个教室,四五十个学生,地上躺着4个假人模特。检测模型全报了,系统一直误报有人躺着。回去加了假人照片做负样本训练,换个新款假人照样误检。试了多模态大模型能分,但四五十个人全送大模型推理,根本跑不动。这篇聊聊为什么检测模型分不了假人,以及为什么大小模型级联这个思路能工作。

这一篇跟前面的踩坑实录不太一样。前面聊的都是技术问题,这篇聊的是"接不接项目"的判断。但我觉得这个更重要。因为一个错误判断的成本,远比一个技术bug高。接了一个不该接的项目,你会亏钱、亏时间、亏口碑。不接一个该接的项目,最多少赚一笔。知道自己不能做什么,比知道自己能做什么更值钱。如果你也在做类似的事情,希望这份清单能帮你少接几个坑。

这篇文章跟之前的踩坑实录不太一样。之前聊的更多是具体的技术问题,这篇聊的是思考框架。但我觉得这个框架比任何一个具体技术都重要。技术选错了,换一个就行。但框架错了,你会一直在错的方向上努力,越努力越亏。第一性原理五步法帮我做减法,最优错误率帮我判断上限。先用最优错误率判断这个项目能不能做、做到什么程度再用五步法判断应该做什么、不做什么、怎么做更快做工业视觉这行,最值钱的不是你会多少算法,而是你知道拿

搞工业现场的兄弟们,基础设施这件事,怎么说呢,真的值得认真对待。不是说你一定要搞多复杂的方案,关键是意识到位——知道哪些环节可能出问题,提前准备好备选方案。像文章开头那个西班牙事件,如果你在CI/CD里配置了多个镜像源(比如官方Hub + 阿里云镜像 + 自己的私有仓库),至少其中一个挂了你还有别的选择。别等到半夜三点被电话叫醒,才想起来这件事。*本文所有代码均为示意,核心思路可复现,具体参数需根

最近同时推进几个项目,有人问我累不累。说实话,有时候也累。但如果每天研究的是自己喜欢的东西,累和消耗是不一样的。希望几年以后回头看,我还能保持现在这种对工业AI的好奇心。赚钱很重要。但能一直觉得这件事好玩,更重要。

我见过不少工厂老板,花二三十万上了AI视觉系统。验收那天准确率98%,一个月后设备吃灰,最后又把质检员请了回来。不是技术不行,而是一开始就不该上。先说结论。你的工厂适不适合上AI视觉系统,判断其实很简单——:先别上,把钱花在更紧迫的地方。:继续往下看。:值得认真评估,但别急着采购设备,先把后面几个坑看完。

实验室里的方案,到了工厂现场就会变形。状态机在Demo里跑得很漂亮,上了产线就发现并行操作处理不了。YOLO在测试集上精度很高,到了现场就发现两个相似动作分不开。一个摄像头拍多个工位省了几百块钱,结果调试成本多花了好几天。这些坑,模型再强也绕不过去。因为它不是算法问题,是工程问题。别在实验室里追求完美方案。先用最简单的架构跑通流程(状态机+单工位+物理隔离),到了现场碰壁了,再根据你的具体痛点选择

第一,工具一体化不可逆。Ultralytics和Roboflow都在建一站式平台。但工业场景的多样性决定了没有一家能覆盖所有需求,组合拳仍将是主流。第二,开源已经够强了。10年前做视觉检测,HALCON几乎是唯一选择。现在开源方案(OpenCV + YOLO + SAM + ONNX)在AI检测场景已经追平甚至超越商业软件。独立开发者和小团队的机会窗口从未这么大。第三,真正的壁垒不在工具,在数据+







