logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

告别梯度消失!用PyTorch手把手复现DenseNet-121(附完整代码与预训练模型使用)

本文详细介绍了如何使用PyTorch从零构建DenseNet-121模型,包括其核心架构解析、完整代码实现及预训练模型使用技巧。通过密集连接机制,DenseNet有效解决了梯度消失问题,显著提升了模型性能。文章还提供了显存优化、训练技巧及常见问题排查方法,帮助开发者高效应用这一先进的卷积网络架构。

#深度学习
告别版本混乱!用Anaconda Navigator可视化管理CUDA 11.6和PyTorch的多个环境

本文详细介绍如何利用Anaconda Navigator图形化界面高效管理多个PyTorch和CUDA 11.6环境,解决深度学习开发中的版本冲突问题。通过可视化操作实现环境创建、包安装和快速切换,显著提升团队协作效率,特别适合Windows11系统下的GPU加速开发场景。

#深度学习
PyTorch GPU安装翻车实录:从CUDA版本冲突到‘torch.cuda.is_available()‘返回False的全面排雷手册

本文详细解析了PyTorch GPU安装过程中常见的CUDA版本冲突及‘torch.cuda.is_available()‘返回False的问题,提供了从系统级诊断到驱动优化的完整解决方案。涵盖硬件验证、版本兼容性分析、安装方案优化及系统级疑难杂症处理,帮助开发者高效解决GPU加速失效问题。

#GPU#深度学习
别再只会用插值了!用PyTorch的PixelShuffle给图像超分换个思路(附代码示例)

本文介绍了PyTorch中的PixelShuffle技术在图像超分辨率任务中的应用,相比传统插值方法,PixelShuffle能更好地保留高频细节并提升图像质量。文章详细解析了其核心原理、PyTorch实现代码以及高级优化策略,为开发者提供了全新的图像超分思路。

#深度学习
生产级机器学习系统:从Notebook到7×24小时可靠决策

机器学习模型部署不是代码上线,而是构建端到端的可信赖决策系统。其核心在于数据链路稳定性、特征时效性、服务间契约约束与全链路可观测性。在真实业务场景中,模型只是系统齿轮,真正决定成败的是延迟控制(P99/P999)、降级策略、漂移响应机制与决策可追溯性。面向金融、风控、推荐等高可靠性要求领域,需以‘抗脆弱’为目标,将模型版本、特征服务、规则引擎、数据库Schema统一治理,并通过前置监控指标(如fe

大模型推理稳定性架构:静默式韧性层原理与企业接入实践

大模型推理稳定性是当前AI工程落地的核心瓶颈,其本质是系统级不确定性(如节点抖动、prompt敏感性、版本漂移)在多层调用中被指数级放大的结果。解决路径不再依赖客户端重试或自建路由,而需深入token粒度可观测性、模型语义等价图谱与动态资源编排等底层能力。Anthropic推出的静默式韧性层正代表这一范式转变——它不暴露API,却在请求路径中自动实现fallback、token分片与prompt归

Web端CNN图像识别实战:TensorFlow.js应用指南

卷积神经网络(CNN)作为计算机视觉的核心技术,通过局部感知和权值共享显著提升了图像识别效率。TensorFlow.js将深度学习能力引入浏览器环境,实现了无需后端服务的Web端机器学习方案。该技术采用WebGL加速计算,支持模型量化压缩,特别适合教育演示、产品原型等轻量级应用场景。以MobileNetV2为例,量化后的模型仅4MB大小,在普通CPU上可实现200ms内的实时推理。通过Tensor

程序员转型AI大模型的90天速成指南

机器学习作为人工智能的核心技术,通过算法让计算机从数据中学习规律。其核心原理涉及特征提取、模型训练和预测推理三个关键阶段。在工程实践中,Python凭借丰富的库生态成为首选语言,结合PyTorch等框架可快速实现深度学习模型。当前大模型技术展现出强大的泛化能力,通过Transformer架构实现上下文理解,在代码生成、智能问答等场景广泛应用。对于开发者而言,掌握LoRA微调等关键技术,既能降低计算

#机器学习
Markdown转微信HTML:国产大模型工程落地实测对比

Markdown转HTML是前端开发中的基础文档处理任务,其核心在于语义解析、规则映射与目标平台兼容性适配。在微信公众号等封闭沙箱环境中,标准HTML无法直接使用,必须逆向工程排版规范,实现公式渲染、代码高亮、图片嵌入与表格样式等定制化输出。这一过程高度依赖模型对工程约束的理解力、指令遵循精度及垂直领域知识深度。本文基于真实CI/CD流水线需求,聚焦MiniMax 2.5与Kimi K2.1在规则

机器学习算法选型:面向业务约束的实战决策框架

机器学习算法选型不是比拼准确率的技术选择题,而是融合数据特性、业务目标与工程落地能力的系统性决策过程。其核心原理在于将算法性能与真实场景的约束条件(如数据延迟、推理时延、运维复杂度、组织能力)进行动态耦合,形成‘基础性能×场景适配系数’的综合评估模型。这一方法显著提升模型线上稳定性与业务价值转化效率,广泛应用于金融风控(强可解释性需求)、工业质检(小样本+高实时)、本地生活(多目标博弈)等关键场景

    共 128 条
  • 1
  • 2
  • 3
  • 13
  • 请选择