
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
Mac安装Docker全指南:Intel/M1/M2/M3通用
【代码】Mac安装Docker全指南:Intel/M1/M2/M3通用。
RoPE旋转位置编码:Qwen3手搓代码与数学原理详解
RoPE 将 Q/K 向量按二维分组做位置相关正交旋转,利用复数 / 三角差角公式让注意力分数仅依赖 token 相对距离;Qwen3 在旋转前增加 QK-Norm 稳定数值,是当前大模型标准位置编码方案。
苹果芯片专属:MLX框架完美微调Qwen3模型
希望充分利用 Mac 的 GPU 性能,这是针对 Apple Silicon 芯片推荐的方案。MLX 是专为统一内存架构设计的机器学习框架,对 Qwen3 系列模型有原生支持,可以完美解决 GQA 的兼容性问题。切换到。MLX 是苹果官方为 Apple Silicon 设计的深度学习框架,对 Qwen3 的 GQA 机制有完美支持。
轻松上手微调模型的四大实用方法
把你微调好的模型用起来,现在主要有四种方法,你可以根据习惯和场景来选择。我把它们的要点整理在了下面的表格里,方便你快速比较。
Hugging Face 下载和加载预训练BERT模型的步骤
1、打开Hugging Face官网https://huggingface.co/docs/transformers/installation#offline-mode:2、访问Hugging Face模型库,搜索所需BERT模型变体如。3、根据你的框架选择合适的文件,(pytorch:pytorch_model.bin ;TensorFlow:tf_model.h5),把所有文件下载到本地:4、
到底了







