logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

小白也能懂:AI人体骨骼关键点检测原理与快速应用入门

本文介绍了如何在星图GPU平台上自动化部署AI人体骨骼关键点检测镜像,实现快速搭建姿态分析环境。该技术通过MediaPipe模型精准定位人体33个关节,可广泛应用于健身动作评估、体感游戏交互等场景,为运动分析和人机交互提供核心技术支持。

#计算机视觉
腾讯混元团队揭秘:HunyuanVideo-Foley训练数据集构建方法论

腾讯混元团队提出五阶段流程构建百万级视听对齐数据集,涵盖采集、清洗、对齐、标注与增强,实现毫秒级音画同步和细粒度语义标注,支撑高质量视频音效生成模型训练。

自监督学习SimCLR:TensorFlow 2.x复现

SimCLR通过对比学习从无标签图像中提取通用特征,仅需数据增强与对比损失即可训练强大编码器。结合TensorFlow 2.x的分布式训练与模块化设计,能高效实现大规模自监督预训练,并平滑迁移到下游任务,为缺乏标注数据的场景提供可行解决方案。

基于ESDF、TSDF与Dstar的无人机路径规划工程实现

无人机路径规划是实现自主飞行的核心技术,其目标是在复杂环境中为无人机生成一条从起点到终点的安全、高效、可行的飞行路径。路径规划需应对静态与动态障碍物的挑战,同时兼顾飞行器的动力学约束和任务目标。根据规划方式,可分为全局规划与局部规划,根据算法特性又可分为确定性方法与随机性方法。本文将围绕ESDF、TSDF地图建模、Dstar动态搜索算法、B样条曲线与多项式路径等关键技术展开深入探讨,解析其在路径规

Face Analysis WebUI模型蒸馏技术实践

本文介绍了如何在星图GPU平台上自动化部署人脸分析系统 (Face Analysis WebUI) 镜像,并实践模型蒸馏技术。通过该技术,可将大型教师模型的知识迁移至轻量学生模型,实现高效的人脸识别与分析,适用于智能门禁、移动端美颜等对实时性要求高的边缘计算场景。

#人脸识别
模型预测控制算法实现与实战详解

在MPC控制策略中,核心目标通常包括跟踪参考轨迹和最小化控制输入代价。跟踪误差(Tracking Error)用于衡量系统输出与目标轨迹之间的偏差,而控制输入代价(Control Effort Cost)则用于限制控制动作的剧烈程度,以避免执行器过载或系统震荡。跟踪误差的数学表达如下:其中:$ e(k) $:第 $k$ 步的跟踪误差;$ r(k) $:第 $k$ 步的参考输入;$ y(k) $:第

ResNet18优化指南:模型蒸馏实践步骤

知识蒸馏(Knowledge Distillation, KD)是一种模型压缩技术,其核心思想是让一个结构更简单、参数更少的“学生模型”(Student Model)去学习一个复杂且性能更强的“教师模型”(Teacher Model)的输出分布。不同于直接使用真实标签进行硬目标训练,蒸馏引入了软标签(Soft Labels)——即教师模型对输入样本生成的概率分布。这些概率包含了类别间的相似性信息(

Excalidraw本地部署与远程协作实现

手绘风格白板工具Excalidraw支持跨平台使用,通过Node.js和Git完成本地部署后,结合Cpolar内网穿透实现公网访问,配置固定二级子域名便于长期共享协作,适合团队实时共创流程图、架构图等手绘内容。

Dify如何实现意图识别与槽位填充一体化?

Dify通过提示工程与可视化编排,将意图识别和槽位填充融合于统一工作流,利用大语言模型的上下文理解与结构化输出能力,实现无需训练、可配置的语义解析。开发者只需设计流程节点,即可快速构建具备多轮对话记忆、自动追问与状态管理的智能助手,显著降低开发门槛与维护成本。

机器视觉工业镜头选型指南

简介:在现代工业自动化中,机器视觉系统利用图像处理技术执行物体检测、识别和定位等任务,而工业镜头是系统的关键组件。正确选型镜头对获取高质量图像和提高系统性能至关重要。本资料提供了选型镜头所需掌握的关键知识点,包括镜头基本参数、光学性能、接口类型、工作距离与景深、防护等级与环境适应性、自动调焦与光圈控制、成本与性价比、品牌与售后服务、案例分析与实践以及光学设计与计算。掌握这些知识点可以帮助工程师和用

    共 926 条
  • 1
  • 2
  • 3
  • 93
  • 请选择