logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

AI认知课:写给技术人的大模型生存指南

我是从二本逆袭的AI负责人。今天《Al认知课》开讲!这篇不讲枯燥代码,只和大家聊聊AI发展史、ChatGPT的冲击,以及程序员的生存法则。AI究竟是砸饭碗的锤子,还是编程界的"照相机”?如果你正感到迷茫焦虑,不妨花十分钟读一读,帮你拨开迷雾,找到笃定。

文章图片
#人工智能
Day03|深度学习基础(1):从神经元到反向传播的数学直觉

很多人卡在"深度学习"这四个字上,是因为被那一串偏导公式吓到了。但你拆开看,它就是中学数学的链式法则,加了个"反向遍历"的工业化流程,再配几个让训练别"飘"的小技巧。这篇文章讲扒开深度学习的底子,给你详细讲讲它的原理。

文章图片
#深度学习#人工智能
Day04 | 深度学习基础(2):用 PyTorch 从 0 训练 MNIST 数字识别

本文是深度学习实战系列Day04,指导读者用PyTorch完成MNIST手写数字识别项目。文章从数据加载(torchvision处理MNIST)、模型构建(MLP与CNN对比)、训练循环封装到结果评估(CNN准确率99.2% vs MLP 97.8%),完整呈现可写进简历的实战项目。重点解析CNN的局部特征提取优势,并总结6个工程踩坑点(如数据未归一化导致loss不下降、漏写zero_grad()

文章图片
#深度学习#pytorch#人工智能
Day23 | 大模型做不好聚类?1.8 万条问题的正确打开方式

Day23 | 大模型做不好聚类?1.8 万条问题的正确打开方式

文章图片
#机器学习#人工智能
Day45|大模型推理加速:KV Cache 和 FlashAttention,根本不是一回事

Day45|大模型推理加速:KV Cache 和 FlashAttention,根本不是一回事

文章图片
#人工智能
Day49|投机解码:小模型帮大模型提速,为什么不一定更快?

Day49|投机解码:小模型帮大模型提速,为什么不一定更快?

文章图片
#人工智能
Day51|从0学习Claude Code(一):一个while循环加一个Bash,复刻Claude Code的心脏

Day51|从0学习Claude Code(一):一个while循环加一个Bash,复刻Claude Code的心脏

文章图片
#学习#bash#人工智能
Day51|从0学习Claude Code(一):一个while循环加一个Bash,复刻Claude Code的心脏

Day51|从0学习Claude Code(一):一个while循环加一个Bash,复刻Claude Code的心脏

文章图片
#学习#bash#人工智能
一切皆插件:DeepSeek Harness 如何重构 Agent 运行时

一切皆插件:DeepSeek Harness 如何重构 Agent 运行时

文章图片
#人工智能
Day19 | Multi-Agent 协作——一个 Agent 干不过来时,怎么让一群 Agent 分工干活

Day19 | Multi-Agent 协作——一个 Agent 干不过来时,怎么让一群 Agent 分工干活

文章图片
#人工智能
    共 30 条
  • 1
  • 2
  • 3
  • 请选择