logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

[Bug已解决] cuda.is_available() 报错排查-驱动-运行时-库不匹配导致调用即崩溃解决方案

[Bug已解决] cuda.is_available() 报错排查-驱动-运行时-库不匹配导致调用即崩溃解决方案

文章图片
#深度学习
[Bug已解决] FakeTensor 模式 fake-grad 复制传播真实张量失效 DISABLED test 绕过方案解决方案

[Bug已解决] FakeTensor 模式 fake-grad 复制传播真实张量失效 DISABLED test 绕过方案解决方案

文章图片
#深度学习
[Bug已解决] Inductor 生成内核调用 empty_strided_cpu 负步长报错 Expected result 大于 0 解决方案

[Bug已解决] Inductor 生成内核调用 empty_strided_cpu 负步长报错 Expected result 大于 0 解决方案

文章图片
#深度学习
[Bug已解决] 无法对 DDP 模型启动 CUDA Graph 捕获报错解决方案

[Bug已解决] 无法对 DDP 模型启动 CUDA Graph 捕获报错解决方案

文章图片
#深度学习
[Bug已解决] NestedTensor 多进程 forkserver 上下文 CUDA DataLoader 失效 DISABLED test 绕过方案解决方案

[Bug已解决] NestedTensor 多进程 forkserver 上下文 CUDA DataLoader 失效 DISABLED test 绕过方案解决方案

文章图片
#深度学习
【Bug已解决】DAPO loss is not normalized by gradient_accumulation_steps 解决方案

用 (Dynamic Sampling Policy Optimization)训练时,我们观察到:调大后,训练行为明显变激进,loss 数值也跟着变大,但训练效果反而变差。具体日志:现象特征:这是典型的"自定义 loss 没接入 Trainer 的梯度累积归一化"问题。HuggingFace里,当开启梯度累积时,每个 micro-batch 算出的 loss 会先除以再 ,这样累加 N 个 mi

文章图片
#深度学习
【Bug已解决】`/resume` picker does not show CWD filter when Codex is launched with `--remote ... --cd`...

【Bug已解决】`/resume` picker does not show CWD filter when Codex is launched with `--remote ... --cd`...

文章图片
【Bug已解决】Codex cli model output rendered truncated 解决方案

【Bug已解决】Codex cli model output rendered truncated 解决方案

文章图片
【共创季稿事节】从毕业设计到鸿蒙开发者:我把求职焦虑做成了一张技能成长地图

《技能成长地图 Skill Path》是一款面向毕业生的鸿蒙应用,旨在解决求职焦虑与技能碎片化问题。通过将ArkTS、ArkUI等能力转化为可视化星图、可执行任务与7日计划,帮助用户建立清晰的能力成长路径。应用采用HarmonyOS 6.1开发,核心设计包括三层结构——当下行动(首页)、能力画像(星图)、职业方向(AI计划),强调“能力证据”而非单纯打卡。技术实现上,利用ArkTS类型系统定义技能

文章图片
#harmonyos#华为
【共创季稿事节】从毕业设计到鸿蒙开发者:我把求职焦虑做成了一张技能成长地图

《技能成长地图 Skill Path》是一款面向毕业生的鸿蒙应用,旨在解决求职焦虑与技能碎片化问题。通过将ArkTS、ArkUI等能力转化为可视化星图、可执行任务与7日计划,帮助用户建立清晰的能力成长路径。应用采用HarmonyOS 6.1开发,核心设计包括三层结构——当下行动(首页)、能力画像(星图)、职业方向(AI计划),强调“能力证据”而非单纯打卡。技术实现上,利用ArkTS类型系统定义技能

文章图片
#harmonyos#华为
    共 186 条
  • 1
  • 2
  • 3
  • 19
  • 请选择