
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
为什么不使用cpp了?使用cpp手搓机器学习的效率还是太低了,还是得上python,有numpy库效率提高一大截。
笔试算法题:Python 比 C++ 好写 3 倍,错率低 10 倍,速度快 2 倍。只要掌握上面这些,笔试几乎无敌。
Codex CLI 版的“界面”就是你的终端窗口。启动时没有任何图形面板,一切交互都通过命令行完成。命令提示符:输入codex后回车,终端会进入交互式环境,显示作为输入提示符。此时你输入的每一行都会被视为自然语言指令。输入区域:就是终端里后面的部分,支持单行直接输入,也可以用反斜杠结尾实现多行输入。输出区域:Codex 的回复(代码、解释、建议等)会直接打印在终端中,与普通命令输出无异。辅助信息:
在"docker.sh"相同的路径里,创建一个"qwen3_workspace"文件夹,作为启动后的初始路径。是上下文长度,可以根据显存大小动态调整,每token上下文长度约为224 KB(计算方法见附录),我这里设置了8k上下文,kvcache约占0.8G左右显存。原因:vllm在检测到所在环境为wsl2时,默认关闭UVA功能,但是vllm2以后,默认在启动时使用该功能,所以会报错。如果是BF1
文件名核心作用典型关键字段模型架构定义推理生成策略分词器全局配置分词器核心数据词汇表、BPE 合并规则权重分片索引weight_map (参数名 -> 文件名)LoRA 适配器配置提示:在昇腾 MindIE 或 ModelArts 部署时,务必确保 config.json 中的架构参数与权重文件一致,且 generation_config.json 中的参数符合业务预期,否则可能导致推理结果异常或
文件名核心作用典型关键字段模型架构定义推理生成策略分词器全局配置分词器核心数据词汇表、BPE 合并规则权重分片索引weight_map (参数名 -> 文件名)LoRA 适配器配置提示:在昇腾 MindIE 或 ModelArts 部署时,务必确保 config.json 中的架构参数与权重文件一致,且 generation_config.json 中的参数符合业务预期,否则可能导致推理结果异常或
虽然本人之前已经学习过了机器学习,但是对于深度学习没有系统的学习过,在深度学习的过程中,仍然有许多独特的优化和改进方法。鱼书是日本作家写的深度学习系列丛书,因此本系列,将发布本人在学习鱼书过程中的笔记和思考。我将以学习天为笔记间隔发布,同时作为自己一天的学习总结和回顾。
虽然本人之前已经学习过了机器学习,但是对于深度学习没有系统的学习过,在深度学习的过程中,仍然有许多独特的优化和改进方法。鱼书是日本作家写的深度学习系列丛书,因此本系列,将发布本人在学习鱼书过程中的笔记和思考。我将以学习天为笔记间隔发布,同时作为自己一天的学习总结和回顾。
打开微软商店,安装ubuntu20.04,这个默认自动将系统安装在C盘。安装完后,要进入ubuntu进行一些初始化命令,如设置用户名,密码等。(本笔记是实验时记录,供本人回忆使用)3.联合wsl+vscode开发。1.依靠wsl安装ubuntu。2.迁移至d盘,参考这篇文章。
4.安装好相关的工具,配置ssh,使得虚拟机可以与Windows的vscode远程连接,可参考此文。可以尝试安装旧版本的vscode如1.73以及使用以下命令升级组件:(升级时间较长)结果如图所示,则恭喜配置成功,问题大概率是vscode的问题。(注意,ubuntu的apt和apt-get命令相同)1.下载安装vm和ubuntu18.04。2.配置网络环境CSDNHeris99的。画框的就是虚拟机








