logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

AIGlasses智能眼镜实战:盲道导航+过马路辅助+物品查找全流程体验

本文介绍了如何在星图GPU平台上自动化部署AIGlasses_for_navigation可穿戴智能设备镜像,快速搭建智能视觉辅助系统。该镜像集成了AI视觉与语音交互,其核心应用场景是为视障人士提供实时、可靠的盲道导航,通过识别路面黄色砖石并给出清晰的语音转向或直行指引,有效提升出行安全与独立性。

#计算机视觉
街景图像文字识别挑战:HunyuanOCR对模糊、倾斜文本的鲁棒性测试

面对模糊、倾斜和多语言混排的街景文字,传统OCR常因级联架构局限而失效。HunyuanOCR采用端到端多模态设计,以仅1B参数实现高鲁棒性,无需预处理即可准确识别复杂场景文本。其背后依托合成数据训练、知识蒸馏与统一解码机制,兼顾效率与精度,适合边缘部署。

无需联网的高稳定图像分类|通用物体识别-ResNet18镜像详解

通用物体识别-ResNet18」镜像不仅是一个简单的图像分类工具,更是本地化 AI 能力落地的典范。去网络化:内置模型权重,杜绝外部依赖;轻量化设计:ResNet-18 + CPU 优化,适应广泛硬件;开箱即用:WebUI 降低使用门槛,提升用户体验;语义丰富输出:支持物体+场景双重理解,增强实用性。🎯 最佳实践建议1. 在构建 Docker 镜像时,提前下载.pth权重文件,确保完全离线运行;

CosyVoice-300M Lite降本案例:零GPU成本实现企业级语音合成服务

本文介绍了如何在星图GPU平台上自动化部署🎙️ CosyVoice-300M Lite: 轻量级语音合成引擎镜像,无需GPU即可实现企业级语音合成服务。该镜像专为客服通知、课程旁白、商品配音等真实业务场景优化,支持中英粤日韩多语种混合合成,显著降低部署成本与运维复杂度。

基于HTML与JavaScript结合Spark与MongoDB的商品推荐系统开发实战

随着电子商务的快速发展,用户面对海量商品时的选择困难日益凸显,商品推荐系统应运而生并成为提升用户体验与转化率的核心技术之一。推荐系统通过分析用户行为、偏好与历史数据,智能地为用户推送个性化商品,极大地提升了用户粘性与平台收益。目前,推荐系统已广泛应用于各大电商平台,如亚马逊、淘宝和京东等,其核心技术涵盖协同过滤、内容推荐、深度学习等多个领域。本文将基于Spark进行大数据处理与推荐算法建模,并结合

依托RTX4090的Megatron-Turing大模型增强电商推荐系统应用实践

本文探讨基于RTX4090和Megatron-Turing大模型的电商推荐系统实践,涵盖架构解析、本地部署优化、生成式推荐算法设计及端到端系统集成,提出通过LoRA微调、TensorRT-LLM加速和提示工程提升推荐准确性与可解释性。

现代CSS3卡片式登录注册表单设计与实现

情况是否折叠结果相邻兄弟元素是取最大 margin父子关系(无 border/padding/intervening flow)是子元素 margin 影响父元素位置元素与自身内部第一个/最后一个子元素是margin 向上传导这对卡片布局可能造成以下问题:- 卡片组顶部/底部间距异常;- 在 Flex 或 Grid 容器中意外偏移;- 动画过程中因 margin 不稳定导致跳动。

LLaMA-Factory快速入门:从零微调大模型

通过LoRA对LLaMA-3-8B进行指令微调,涵盖数据集构建、训练、评估、模型合并及部署全流程,支持WebUI操作与API服务发布,适合初学者快速上手大模型定制。

#LLaMA-Factory
AudioSeal Pixel Studio部署教程:Docker镜像构建与NVIDIA Container Toolkit集成

本文介绍了如何在星图GPU平台上自动化部署🌊 专业级音频水印加印AudioSeal Pixel Studio镜像,实现高效音频版权保护。该工具基于Meta开源算法,支持隐形水印嵌入与检测,适用于音乐版权管理、AI生成内容识别等场景,通过GPU加速显著提升处理效率。

GLM-4.7-Flash快速入门:零基础玩转30B MoE大模型

本文介绍了如何在星图GPU平台上自动化部署【ollama】GLM-4.7-Flash镜像,快速启用30B MoE架构的高性能中文大模型。依托平台能力,用户可零配置完成部署,并典型应用于技术文档提炼、代码生成与自检、多角色产品对话设计等专业场景,显著提升AI原生工作流效率。

    共 699 条
  • 1
  • 2
  • 3
  • 70
  • 请选择