logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

cuda编程实例 linux,CUDA编程入门----Thrust库简介

一、简介Thrust开源库的简介是“code at speed of light”。光速代码的实现听上去太过夸张,但是thrust在cuda硬件加速中确实有着无比强大的功能。Thrust是并行算法和数据结构的基于GPU CUDA的C++库。Thrust主要通过管理系统底层的功能比如memory access(内存获取)和memory allocation(内存分配)来实现加速,使得工程师们在GPU

MoE稀疏激活原理与工程实践:揭秘大模型‘1.8T参数2%使用’真相

稀疏专家混合(MoE)是突破大语言模型内存墙与计算墙的核心范式,其本质是通过条件计算实现动态参数选择,使模型总参数量与单次推理开销解耦。原理上,路由器(Router)依据token语义从N个专家中选出K个进行轻量计算,辅以Auxiliary Loss和Capacity Factor保障负载均衡与稳定性。该技术显著降低显存占用与FLOPs消耗,提升GPU利用率,已在Qwen1.5-72B-MoE、M

小模型如何在特定任务中接管前沿大模型

小型人工智能模型(Small AI Models)正成为工业落地的核心选择,其本质并非参数缩减,而是面向具体任务的结构优化与知识编译。基于计算图拓扑简化、确定性解码机制、小时级数据闭环和领域知识密度强化四大原理,小模型在算力效率、响应稳定性、迭代速度与专业准确性上形成不可替代的技术优势。尤其适用于法律条款提取、工业质检、医疗报告生成、金融规则解释等边界清晰、容错率低、结构化强的垂直场景。本文聚焦真

Mythos解析:大模型可审计推理协议与门控释放机制

在大模型应用迈向高风险决策场景的今天,‘可靠推理’正从性能指标升维为基础设施能力。其核心在于突破传统概率生成范式,转向具备前提显化、证据锚定与反事实校验的因果契约机制。这种转变不仅提升长上下文多跳推理的稳定性,更通过可验证、可归责、可审计的技术设计,支撑金融风控、医药合规、法律审查等容错率为零的关键场景。Mythos作为典型代表,本质是运行于模型之上的推理协议栈,而非模型升级;其‘门控释放’机制将

从竞赛到实战:用机器学习为工业结晶过程序列图像建模(Sklearn/LightGBM实战)

本文探讨了如何利用机器学习技术为工业结晶过程序列图像建模,重点介绍了RGB颜色矩特征提取和LightGBM时间序列建模的实战应用。通过优化特征工程和模型架构,解决了工业场景中的特征稳定性与模型泛化问题,显著提升了结晶过程的监控效率与产品质量。

#机器学习
机器学习对抗概念漂移:Chrome恶意扩展检测的实战与挑战

监督机器学习是自动化安全检测的核心技术,其原理是通过学习已知恶意与良性样本的特征模式,构建分类模型以实现高效识别。这项技术的核心价值在于能够处理海量、快速迭代的威胁,在恶意软件检测、入侵防御等场景中至关重要。然而,在动态对抗的真实世界,模型会面临概念漂移的严峻挑战,即数据背后的统计属性随时间变化,导致基于历史数据训练的模型性能衰退。本文聚焦于浏览器扩展安全领域,通过构建融合源代码与元数据特征的随机

基于单参考视觉相似性的产品美学评估:深度学习与PCA解析设计之美

在计算机视觉领域,特征提取与相似度计算是理解图像内容的核心技术。通过预训练卷积神经网络、自编码器、孪生网络或三元组网络等深度学习模型,可以自动学习并量化图像间的视觉相似性。这一技术原理为产品美学评估提供了新的量化工具,其价值在于能够以极低的标注成本,将主观的美学偏好转化为可计算的视觉特征比对。在工业设计与产品开发的应用场景中,仅需一个公认的“美学标杆”产品作为参考,通过计算其他设计方案与该标杆的视

#深度学习
告别HDFS连接报错:手把手教你正确配置Hadoop的core-site.xml与客户端依赖(以HDP/CDH为例)

本文深入解析Hadoop客户端连接失败的常见问题`No FileSystem for scheme`,提供从原理到实践的全面解决方案。重点讲解如何正确配置`core-site.xml`文件,管理客户端依赖,并扩展处理其他文件系统scheme的方法。适用于HDP/CDH等企业发行版,帮助开发者彻底解决HDFS连接问题。

#文件系统
从云服务器到树莓派:手把手教你用torch.load的map_location实现PyTorch模型全平台部署

本文详细介绍了如何使用PyTorch的`torch.load`和`map_location`参数实现模型在不同硬件平台(从云服务器到树莓派)的无缝部署。通过解析`map_location`的核心用法、跨平台部署实战指南及性能优化技巧,帮助开发者解决模型部署中的硬件适配挑战,提升部署效率和兼容性。

#深度学习
TensorHub:面向AI大模型的高效张量存储与压缩系统设计实践

在深度学习与AI模型部署领域,模型存储与加载效率是影响工作流性能的关键环节。传统文件系统将模型视为单一二进制文件,导致加载冗余、存储膨胀和IO瓶颈。其核心原理在于未能识别模型内部的结构化数据单元——张量(Tensor)。通过将张量作为存储管理的一等公民,结合细粒度访问与高效压缩技术,可以重构模型的存储范式,实现按需加载与增量更新,从而显著提升存储效率与访问性能。这一技术价值在于能够大幅降低海量模型

    共 176 条
  • 1
  • 2
  • 3
  • 18
  • 请选择