logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

云平台一键部署【nvidia/LocateAnything-3B】视觉定位推理服务

NVIDIA推出的LocateAnything模型创新性地采用并行框解码(PBD)技术,将完整边界框作为单元一步预测,突破传统自回归解码限制,实现2.5倍速度提升同时保持精度。该模型支持三种推理模式(快速/慢速/混合),适用于开放集检测、多目标定位、自动化标注等场景,已在趋动云平台上线,提供一键部署体验。用户可通过社区项目快速启动,包含视频教程和使用说明,需注意及时关闭环境以避免费用产生。

文章图片
#人工智能#云平台#算力
计算机视觉干货分享!YOLOv1-v10系列全记录

YOLO(You Only Look Once)系列模型是一类非常高效的目标检测模型。其主要特点是能够在单次前向传播中同时进行目标的定位和分类,实现实时的目标检测。YOLO 系列模型从最初的 YOLOv1 到目前的 YOLOv10,经过了多次迭代和改进,逐渐提高了检测的精度和速度。YOLO简史。

文章图片
#人工智能#AI#科技 +1
云平台一键部署【rednote-hilab/dots.ocr】多语言文档布局解析模型

dots.ocr是一款高效的多语言文档解析工具,基于1.7B参数的视觉-语言模型,统一了布局检测和内容识别功能。它在OmniDocBench基准测试中达到SOTA性能,支持低资源语言处理,推理速度快。该工具采用简洁的单一模型架构,通过提示切换即可完成不同任务。典型应用场景包括跨境合同审阅和政务文档数字化,支持多种语言和复杂格式识别。项目已在GitHub和Hugging Face开源,并上线趋动云平

文章图片
#科技#人工智能#GPU +1
从个人笔记本到边缘计算:看懂 OrionX 能做什么

打 Kaggle 或国产大模型比赛,进入冲刺阶段,团队成员要同时跑不同的特征工程和模型融合方案。租云 GPU 成本飙升,一个月花掉好几千,团队预算吃紧。把团队已有的几张消费级显卡(如 4090)通过 OrionX 池化成一个虚拟算力池。显存超分技术让每张卡能支撑更大 batch size 或更高分辨率输入。成员按需申请算力,跑完即释放,避免资源闲置。云 GPU 租用成本降低 60%并行实验数量翻倍

文章图片
#人工智能#GPU#算力 +1
云平台一键部署【ekwek/Soprano-80M】即时、超逼真的文本转语音

Soprano是一款超轻量级开源TTS模型,仅8000万参数即可实现32kHz高保真语音合成,实时因子高达2000倍(20秒生成10小时音频)。其核心技术包括:基于Vocos的神经解码器实现毫秒级响应,无缝流式传输技术(延迟<15ms),以及0.2kbps神经编解码器。支持AR眼镜、直播虚拟人等实时交互场景,已在趋动云平台提供一键部署方案。项目开源地址:github.com/ekwek1/s

文章图片
#人工智能#GPU#科技 +2
一文读懂大语言模型

随着人工智能技术的飞速发展,自然语言处理(NLP)成为了热门的研究领域之一。在这一领域中,预训练大语言模型(Pre-trained Large Language Models)凭借其强大的语言理解和生成能力,逐渐成为了研究和应用的热点,越来越多的企业开始将其应用于实际场景,如智能客服、虚拟助手、内容创作、内容审核、机器翻译等。 本文将从大语言模型的基本概念为始,然后分别介绍大语言模型的开发流程、训

文章图片
#语言模型#人工智能#自然语言处理
免费开源的 OrionX,GPU 池化管理终极利器

人工智能研发常面临算力资源错配的痛点,昂贵的GPU常因管理不善而闲置。趋动科技推出的免费OrionX社区版解决方案,将离散硬件转化为智能算力池,实现GPU资源的动态分配与超分利用。该方案无需代码改造,支持主流AI框架,15分钟即可完成部署,能提升3倍研发效率。技术决策者可零成本提升ROI,开发者能专注创新而非资源争夺,科研团队则获得公平的算力环境。OrionX社区版包含完整虚拟化功能,打破算力瓶颈

文章图片
#人工智能#大数据#科技 +1
HOI 研究加速站:精选开源数据集分享

Human Object Interaction (HOI) 是计算机视觉和人工智能领域的一个研究方向,主要关注人类与物体之间的交互行为的识别和理解。HOI 任务旨在识别图像或视频中人类与物体之间的互动,例如“一个人拿着杯子”或者“一个人坐在椅子上”。这一任务对于实现更高层次的场景理解非常重要,也在自动驾驶、机器人、智能监控等应用中具有广泛的应用前景。

文章图片
#人工智能#AI#数据库
十大开源语音识别项目

通过支持在 ModelScope 上发布的工业级语音识别模型的训练和微调,研究人员和开发人员可以更方便地进行语音识别模型的研究和生产,并促进语音识别生态系统的发展。SpeechBrain 是一个基于 PyTorch 的开源、全能的对话人工智能工具包,可用于开发最先进的语音技术,包括语音识别系统,说话人识别、鉴定和记录,语音增强,语音分离,语言识别,语言翻译等。ASRT 是一个基于深度学习的中文语音

文章图片
#语音识别#人工智能
云平台一键体验爆火模型【deepseek】

DeepSeek-R1 一经发布引起国际热议,其性能比肩 OpenAI o1 正式版,但是花费却大大减少,并且该模型已经完全开源。目前使用Ollama搭建的deepseek模型1.5b版本已经在趋动云『社区项目』上线,无需自己创建环境、下载模型,一键即可快速部署,快来体验搭建deepseek 带来的精彩体验吧!视频教程:趋动云一键体验爆火模型【deepseek】

文章图片
#人工智能
    共 94 条
  • 1
  • 2
  • 3
  • 10
  • 请选择