logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

电商销量预测系统:Python+随机森林+大模型实战

机器学习在电商领域的核心应用之一是销量预测,其技术原理是通过历史数据构建预测模型,帮助商家优化库存和营销策略。随机森林算法因其解释性强、训练速度快等特点,成为中小规模特征数据的首选方案。结合大模型技术进行特征工程和结果解释,可以进一步提升预测准确率。在工程实践中,需要处理动态页面爬取、实时数据处理等挑战,常用Scrapy+Selenium和Kafka等技术栈。本系统通过Django实现可视化展示,

#随机森林
RL训练真能教会大模型新东西吗?我们用Qwen和CodeR1做了个实验,结果有点意外

本文探讨了强化学习(RL)训练对大语言模型(LLM)能力提升的实际效果。通过Qwen和CodeR1系列模型的实验发现,RL训练并未真正教会模型新知识,而是优化了已有能力的展示效率。实验显示,基础模型在大规模采样时表现优于RL训练模型,尤其在数学推理和代码生成等任务中。研究揭示了RL训练的本质是效率提升而非能力突破,为模型优化提供了新的实践启示。

别再让大模型瞎猜了!手把手教你用高质量数据给DeepSeek-R1做‘学前培训’

本文详细介绍了如何通过高质量监督微调(SFT)数据为DeepSeek-R1大模型进行冷启动训练,提升其在专业领域的表现。文章从数据来源、优化维度到效果评估,提供了一套完整的训练方案,帮助开发者避免早期训练陷阱,显著提升模型效率和准确性。

别再让ChatGLM说车轱辘话了!手把手教你用Hugging Face的LogitsProcessor解决LLM重复生成

本文详细介绍了如何使用Hugging Face的LogitsProcessor解决ChatGLM等大语言模型(LLM)在生成过程中出现的重复内容问题。通过实战案例和代码示例,展示了如何应用短语级重复阻断器和数字序列稳定器,有效降低重复生成概率,提升模型输出质量。适用于金融、客服等多种场景,显著改善用户体验。

李宏毅深度学习课程实战:从零搭建PyTorch模型(附作业解析)

本文详细解析了李宏毅深度学习课程中的PyTorch实战内容,从零开始搭建深度学习模型,涵盖线性回归、卷积神经网络和Transformer等核心算法。通过代码示例和作业解析,帮助读者掌握PyTorch框架的使用技巧,实现从理论到实践的完整过渡,适合深度学习初学者和进阶开发者。

#深度学习#机器学习
手把手教你用PyTorch复现DS-Net:一个即插即用的CV模块,轻松提升下游任务性能

本文详细介绍了如何使用PyTorch复现DS-Net,一个即插即用的计算机视觉模块,通过双流架构和跨尺度对齐机制有效结合CNN的局部特征提取能力和Transformer的全局建模能力,显著提升下游任务性能。文章包含环境配置、代码结构解析、核心模块实现细节以及下游任务集成实战,帮助开发者快速掌握并应用这一先进技术。

保姆级教程:用ResNet34训练鸟类识别模型后,如何一键转成ONNX格式(附完整代码)

本文详细介绍了如何将训练好的ResNet34鸟类识别模型转换为ONNX格式,包括环境准备、模型结构调整、转换核心流程、验证测试及生产环境部署优化技巧。通过实战指南和完整代码,帮助开发者高效完成模型转换,提升生产部署效率。

别再让大模型瞎猜了!手把手教你用高质量数据给DeepSeek-R1做‘学前培训’

本文详细介绍了如何通过高质量监督微调(SFT)数据为DeepSeek-R1大模型进行冷启动训练,提升其在专业领域的表现。文章从数据来源、优化维度到效果评估,提供了一套完整的训练方案,帮助开发者避免早期训练陷阱,显著提升模型效率和准确性。

像搭积木一样玩转PyTorch:用Sequential、ModuleList和ModuleDict构建动态神经网络

本文深入探讨了PyTorch中Sequential、ModuleList和ModuleDict三种容器类的使用技巧,帮助开发者像搭积木一样灵活构建动态神经网络。通过实战案例展示了如何利用这些工具实现可配置组件、动态网络深度和高级架构设计,提升模型开发的效率和灵活性。

#神经网络#深度学习
别光看目录了!我整理了学习吴恩达《神经网络与深度学习》时最容易踩的5个坑

本文总结了学习吴恩达《神经网络与深度学习》课程时常见的5个认知陷阱,包括反向传播的数学恐惧、向量化操作的重要性、参数初始化的技巧、超参数调试的策略以及课程知识结构的隐性联系。通过实战经验和代码示例,帮助学习者避开这些坑,提升学习效率200%。特别适合深度学习初学者和神经网络实践者。

#深度学习#神经网络#AI学习
    共 58 条
  • 1
  • 2
  • 3
  • 6
  • 请选择