logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

实战教程:从 0 到 1 手搓 DINO-X 定制模板,实现长尾场景精准检测和数据标注

史上最全 DINO-X 定制模板教程,手把手教你如何从 0 到 1 训练出专属定制模板,测试、调用并把 DINO-X 定制模板应用到 T-Rex Label 智能标注工具,实现长尾场景和罕见目标的全自动数据标注。

文章图片
#人工智能#计算机视觉#目标检测
ScanNet200 新纪录!张磊团队发布 SegDINO3D:用 2D 模型能力大幅提升 3D 实例分割性能

由视启未来创始人兼 CEO、IDEA 研究院计算机视觉与机器人研究中心(CVR)讲席科学家张磊领衔的团队,研发并推出高性能 3D 实例分割框架 SegDINO3D。针对 3D 实例分割任务的精度与训练效率痛点,该框架开创性地迁移成熟 2D 检测模型的核心能力,通过图像级与物体级双层级 2D 特征融合的创新方法,在大幅提升 3D 实例分割检测精度的同时,显著加快了模型训练收敛速度。

文章图片
#3d#计算机视觉#人工智能 +1
【DINO Talk】视启未来创始人张磊:打造具有超强物体级理解能力的视觉大模型,为空间智能提供核心支撑

揭秘 DINO-X 的成长历程,探讨 DINO-X 视觉大模型的发展脉络,以及企业在空间智能与具身智能领域的未来布局与深度思考。

文章图片
#计算机视觉#人工智能#机器人 +1
探访 DINO 家族 Part 2:开集目标检测模型 Grounding DINO 首次登场

Grounding DINO 推动了开集目标检测的重大进步,它将基于 Transformer 的DINO检测架构与基础预训练(Grounded Pre-Training)技术的优势相结合。这种融合使模型能够通过自然语言输入检测任意指定的物体,无论是简单的类别名称还是复杂的指代表达。本文将带领读者,了解 DINO 家族首个开集目标检测模型 Grounding DINO。

文章图片
#目标检测#人工智能#计算机视觉 +4
探访 DINO 家族 Part 3:最强开集目标检测模型 DINO-X 诞生

DINO-X代表了开放世界目标检测和理解的重大进步。通过将多种感知任务统一到单个模型中并支持灵活的提示机制,它为全面的图像分析提供了一个多功能框架。该模型处理长尾分布的能力以及在罕见物体类别上的强大性能,解决了先前方法的重要局限性。此外,优化的Edge版本的开发使这项技术在资源受限设备上的实际应用更加普及,让先进的计算机视觉能力不再局限于高性能服务器,而是可以融入我们的日常设备。

文章图片
#人工智能#计算机视觉#机器学习 +4
探访 DINO 家族 Part 1:始祖目标检测模型 DINO

本文将带读者了解目标检测模型 Grounding DINO 和 DINO-X 的始祖 DINO。该模型不仅在端到端目标检测方面取得了重大突破,在 COCO 基准测试上实现了当时最先进的结果,还显著提升了训练效率,使类 DETR 模型更适用于实际应用。DINO 模型的成功证明了基于 Transformer 的目标检测方法的可行性,还开辟了新的研究方向。随着计算资源的增加和数据规模的扩大,DINO 模

文章图片
#目标检测#人工智能#计算机视觉 +3
探访 DINO 家族 Part 1:始祖目标检测模型 DINO

本文将带读者了解目标检测模型 Grounding DINO 和 DINO-X 的始祖 DINO。该模型不仅在端到端目标检测方面取得了重大突破,在 COCO 基准测试上实现了当时最先进的结果,还显著提升了训练效率,使类 DETR 模型更适用于实际应用。DINO 模型的成功证明了基于 Transformer 的目标检测方法的可行性,还开辟了新的研究方向。随着计算资源的增加和数据规模的扩大,DINO 模

文章图片
#目标检测#人工智能#计算机视觉 +3
探访 DINO 家族 Part 3:最强开集目标检测模型 DINO-X 诞生

DINO-X代表了开放世界目标检测和理解的重大进步。通过将多种感知任务统一到单个模型中并支持灵活的提示机制,它为全面的图像分析提供了一个多功能框架。该模型处理长尾分布的能力以及在罕见物体类别上的强大性能,解决了先前方法的重要局限性。此外,优化的Edge版本的开发使这项技术在资源受限设备上的实际应用更加普及,让先进的计算机视觉能力不再局限于高性能服务器,而是可以融入我们的日常设备。

文章图片
#人工智能#计算机视觉#机器学习 +4
探访 DINO 家族 Part 2:开集目标检测模型 Grounding DINO 首次登场

Grounding DINO 推动了开集目标检测的重大进步,它将基于 Transformer 的DINO检测架构与基础预训练(Grounded Pre-Training)技术的优势相结合。这种融合使模型能够通过自然语言输入检测任意指定的物体,无论是简单的类别名称还是复杂的指代表达。本文将带领读者,了解 DINO 家族首个开集目标检测模型 Grounding DINO。

文章图片
#目标检测#人工智能#计算机视觉 +4
探访 T-Rex2 家族 Part 1:使用文本-视觉提示的模型基座 T-Rex2

本文是《探访 T-Rex2 家族》系列内容的第 1 篇,旨在通过深入浅出的形式为读者介绍使用文本-视觉提示的通用目标检测模型 T-Rex2,并为读者解答:为什么我们需要 T-Rex2?什么是 T-Rex2?它的优势和局限性是什么?它有什么样的应用场景。

文章图片
#目标跟踪#人工智能#计算机视觉 +4
    共 35 条
  • 1
  • 2
  • 3
  • 4
  • 请选择