logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

角谷猜想(python实现)

编写一个名为collatz()的函数,设置一个整型参数num。如果参数是偶数,那么collatz()就输出并返回num// 2;如果num是奇数,collatz()就输出并返回3 * number + 1。然后编写程序,让用户输入一个正整数,并不断对这个数调用collatz(),直到函数返回值1

文章图片
#python
使用BEiT模型进行CIFAR-100图像分类:迁移学习实战指南

本文介绍了如何利用微软提出的BEiT-base模型在CIFAR-100数据集上实现高精度图像分类。BEiT采用掩码图像建模(MIM)预训练策略,通过12层Transformer编码器提取视觉特征。针对CIFAR-100的32×32小图像特点,设计了包括上采样、强数据增强等预处理策略,并采用分层学习率优化(5e-5/1e-3)和标签平滑技术。实验在NVIDIA A10 GPU上训练10个epoch,

#分类#迁移学习#数据挖掘
Docker 深度技术解析:从入门到生产级实践

Docker技术2025年全景解析:本文系统梳理了Docker容器技术的现代实践,涵盖架构原理、构建优化、安全防护和生产部署等关键领域。重点包括:1)轻量级容器架构解析(Namespaces/Cgroups/UnionFS);2)多阶段构建与BuildKit应用(镜像体积缩减87.5%);3)全生命周期安全方案(Rootless模式/SBOM/运行时加固);4)生产级Compose配置与Kuber

文章图片
#docker#容器#运维
从 Qwen3-0.6B 到 Qwen3.5-0.8B:轻量级大模型的架构革命与多模态进化

阿里巴巴通义千问团队推出的Qwen3-0.6B和Qwen3.5-0.8B两款轻量级模型展现出显著代际差异。Qwen3.5-0.8B不仅参数量增加0.2B,更实现了架构革新:从纯文本模型升级为原生多模态模型,支持262K超长上下文和视觉处理能力。其采用混合注意力机制(3层线性+1层全注意力交替)降低计算复杂度,引入MRoPE三维位置编码支持多模态输入,并内置视觉编码器处理图像/视频数据。这些改进使Q

#架构#人工智能#阿里云
大模型核心技术深度解析:从Transformer优化到人类偏好对齐

本文系统梳理了大模型三大核心技术:Transformer计算优化、位置编码演进和人类偏好对齐。在计算优化方面,分析了Self-Attention与FFN的复杂度瓶颈,介绍了Flash Attention的硬件感知优化、MQA/GQA架构及MoE技术;位置编码部分重点解析了RoPE旋转编码的数学原理及其外推技术(NTK/YaRN);最后对比了PPO和DPO两种对齐方法,指出DPO通过隐式奖励建模实现

文章图片
#transformer#深度学习#人工智能
深度学习时序预测进阶:CNN-LSTM-MHA混合模型+灰狼优化算法(GWO)实战

本文提出了一种基于CNN-LSTM-MHA混合模型和灰狼优化算法(GWO)的时序预测方法。该模型通过1D-CNN提取局部特征,双向LSTM建模长期依赖,多头注意力机制聚焦关键时间步,实现了时序数据的多层次建模。创新性地引入GWO算法自动优化超参数,解决了传统调参效率低的问题。实验表明,该方法在保持较高预测精度的同时,显著提升了训练效率。全文提供了完整的PyTorch实现代码,包含混合精度训练、Cu

文章图片
#python
vllm 本地部署大模型

本文介绍了Qwen3-8B大模型的部署流程。首先通过pip安装torch、transformers和vllm等必要依赖,然后使用modelscope下载模型文件。接着详细说明了单卡A800服务器上的vLLM服务启动命令,包括指定模型路径、服务名称、端口号等参数配置。启动日志显示系统自动检测CUDA平台,并成功初始化vLLM引擎。整个过程涵盖了从环境配置到服务部署的关键步骤,为Qwen3-8B模型的

文章图片
#python#人工智能
SGLang 本地部署 Qwen3-8B 大模型实战指南

本文介绍了如何在本地服务器上使用SGLang框架部署Qwen3-8B大语言模型。SGLang作为专为LLM/VLM设计的高性能推理框架,具有RadixAttention机制、FlashInfer后端优化等优势。文章详细说明了环境配置(Python 3.10+、Torch 2.6.0等)、通过ModelScope下载模型、服务启动参数配置等关键步骤。重点分析了SGLang的初始化过程,包括模型检测、

文章图片
#sglang#python
基于 SGLang 框架本地部署小米 MiMo-7B-RL 大模型实战

本文介绍了如何利用 SGLang 框架高效部署小米 MiMo-7B-RL 大模型。SGLang 凭借 RadixAttention、Cuda Graph 捕获和 FlashInfer 后端支持,成为新一代推理加速工具。作者详细展示了在 NVIDIA A800-80GB 服务器上的部署流程,包括环境配置、模型下载、服务启动和性能测试。实测显示,SGLang 能快速加载模型(4.4秒加载14.21GB

文章图片
#sglang
模型动态量化实践:让大模型瘦身加速的实战指南

摘要 本文探讨了BERT模型因参数量大导致计算开销高的问题,提出使用PyTorch动态量化技术进行压缩优化。动态量化通过将模型权重从32位浮点(FP32)转换为8位整型(INT8),显著减少模型体积和推理延迟,尤其适合CPU部署场景。量化过程仅需一行代码,支持Transformer架构的线性层优化,且无需校准数据。实验表明,量化后模型在精度损失可控的情况下,存储和计算效率显著提升,为边缘设备和高并

文章图片
    共 86 条
  • 1
  • 2
  • 3
  • 9
  • 请选择