logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

归一化与标准化:如何为不同机器学习模型选择最佳数据预处理方法

本文深入探讨了归一化与标准化在机器学习数据预处理中的关键作用,详细比较了最值归一化、均值归一化和标准化的优缺点及应用场景。通过实际案例分析,指导读者如何根据不同模型特性(如SVM、KNN、神经网络等)选择最佳预处理方法,提升模型性能与稳定性。

#机器学习
PyTorch学习笔记:揭秘《动手学深度学习》中#@save标记的隐藏功能

本文深入解析了《动手学深度学习》中#@save标记的隐藏功能与设计哲学。该标记不仅是d2l工具包的入库标识,更是连接教学与工程实践的桥梁,帮助读者识别通用函数,提升代码复用效率。文章还分享了如何借鉴#@save思维构建个人工具库,将书本知识高效转化为实际项目能力。

#深度学习
为什么L2范数和MSE在机器学习中总是成对出现?从数学本质到代码实现的深度解析

本文深度解析了L2范数与均方误差在机器学习中紧密关联的数学本质。两者均源于向量空间的距离度量,MSE本质上是误差向量L2范数平方的算术平均。这种等价关系在损失函数优化和梯度计算中保持一致,并在L2正则化中共同作用以提升模型泛化能力。理解其核心联系有助于在理论分析与代码实践中做出更精准的选择。

#机器学习
用Spark和LSTM搞定毕业设计:一个能预测餐厅销量的美食数据分析系统实战(附完整源码)

本文详细介绍了如何利用Spark和LSTM构建一个餐厅销量预测系统,涵盖从数据采集到模型部署的全流程。通过Spark处理海量数据,结合LSTM进行时间序列预测,实现高精度的销量分析。项目包含完整源码,适合作为毕业设计或实战项目参考。

#数据分析
研一AI论文速成指南:一个月搞定深度学习CV论文全流程

最近和不少研一的同学交流,发现一个普遍现象:导师太忙,基本处于“放养”状态。自己刚入学,面对“发论文”这个硬性毕业指标,感觉无从下手,既不知道做什么方向,也不知道如何快速推进。如果你也面临同样困境,希望用最短时间、最高效率完成一篇能毕业的学位论文或可发表的学术论文,那么这篇文章就是为你准备的。 本文将聚焦于 AI/深度学习/计算机视觉(CV) 这一热门且资源丰富的领域,为你拆解一套从零到一的“快速

#深度学习#计算机视觉
大模型学习路径:从理论到工程实践的完整指南

Transformer架构作为现代大模型的核心基础,通过自注意力机制实现了长距离依赖的高效建模。其数学原理涉及查询-键-值矩阵运算和维度缩放因子,工程实现则需要掌握PyTorch和分布式训练框架。在AI工程实践中,HuggingFace生态已成为标准工具链,配合DeepSpeed等框架可有效解决大模型训练的显存和通信瓶颈。实际应用时,Prompt工程和模型微调技术能显著提升下游任务表现,而量化压缩

机器学习入门:周志华《机器学习》配套视频与Python实践指南

机器学习作为人工智能的核心技术,通过算法让计算机从数据中学习规律,其核心原理包括监督学习、无监督学习和强化学习等范式。从线性回归、决策树到支持向量机,经典算法为解决分类、回归、聚类等问题提供了理论基础。掌握这些基础概念对于理解更复杂的深度学习模型至关重要。在工程实践中,Python因其丰富的库生态成为主流工具,结合scikit-learn等库可以快速实现算法原型。本文聚焦于周志华教授《机器学习》(

#机器学习
大模型量化实战:用llama.cpp将open_llama_7b压缩至4GB并部署

模型量化是一种通过降低神经网络权重和激活值的数值精度来压缩模型、提升推理效率的核心优化技术。其原理是将高精度浮点数转换为低精度整数表示,在保持模型功能的前提下大幅减少内存占用和计算量。这项技术的价值在于让原本需要昂贵硬件的大模型能够在消费级设备上运行,极大地拓展了AI应用的边界,为边缘计算、移动端部署和资源受限场景提供了可能。在实践层面,训练后量化因其无需重新训练、实施便捷的特点成为主流选择,而G

AI Benchmark v4:大模型评估原理、榜单解读与实战部署指南

在人工智能领域,模型评估基准(Benchmark)是衡量算法性能的核心工具,其原理在于通过一系列标准化的测试任务,对模型的各项能力进行量化评分。从早期的图像分类、目标检测,到如今的大语言模型(LLM)评估,Benchmark技术不断演进,旨在为模型研发、选型与部署提供客观、可比较的依据,其技术价值在于推动行业透明化与技术进步。当前,随着大模型技术的普及,开发者面临如何选择适合自身应用场景模型的难题

Hadoop+Spark+Hive构建智能招聘推荐系统实践

大数据处理技术在现代推荐系统中扮演着关键角色,其核心原理是通过分布式计算框架实现海量数据的高效处理。以Hadoop、Spark和Hive为代表的技术栈,分别解决了数据存储、实时计算和数据分析的挑战,特别适合招聘推荐这类需要处理TB级非结构化数据的场景。从技术价值看,Spark的内存计算能力可将算法训练时间从小时级缩短到分钟级,而Hive的数据仓库特性支持多维业务分析。在实际应用中,这种技术组合能有

    共 42 条
  • 1
  • 2
  • 3
  • 4
  • 5
  • 请选择