
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
本文系统整理了深度学习基础课程内容,涵盖线性回归、逻辑回归、神经网络和经典CNN架构。从线性回归的最小二乘解析解和梯度下降法入手,详细推导了逻辑回归的交叉熵损失函数和Softmax多分类方法。重点分析了感知机的局限性及多层感知机解决XOR问题的原理,并给出BP算法的完整推导过程。最后介绍了LeNet、AlexNet、VGG和ResNet等经典CNN结构的发展脉络。全文包含大量公式推导和算法细节,既
本文系统整理了深度学习视觉应用的核心内容,涵盖四大模块:1)常用数据集(MNIST、CIFAR、VOC、COCO、ImageNet)的特点与应用场景;2)模型评价指标(精确率、召回率、P-R曲线、AP/mAP计算方法);3)目标检测任务与YOLO系列的核心思想及损失函数设计;4)语义分割的基本概念。重点解析了计算机视觉任务的评估体系(如COCO的AP@0.5:0.95)和YOLO的单阶段检测原理,
本文系统介绍了Transformer模型的整体架构与核心原理。Transformer通过自注意力机制替代传统RNN结构,解决了序列建模中的长距离依赖和并行计算问题。模型包含编码器-解码器结构,其中编码器使用多头注意力捕捉全局语义关系,解码器通过掩码注意力实现自回归生成。关键创新包括正弦位置编码、缩放点积注意力、残差连接和层归一化等设计。实验表明,Transformer在机器翻译等任务上显著优于传统
本文系统梳理了大模型技术的发展脉络,重点解析了视觉大模型的核心技术。首先介绍了大语言模型(LLM)的基本原理和训练三阶段。随后深入分析了Vision Transformer(ViT)的核心思想,包括图像切分、嵌入层、编码器等关键技术细节,并探讨了ViT的优劣势。接着阐述了多模态大模型的关键技术,如CLIP的跨模态对比学习和DINO的自监督学习框架。最后指出当前视觉大模型正从规模竞赛转向效率竞赛,轻
本文系统整理了深度学习视觉应用的核心内容,涵盖四大模块:1)常用数据集(MNIST、CIFAR、VOC、COCO、ImageNet)的特点与应用场景;2)模型评价指标(精确率、召回率、P-R曲线、AP/mAP计算方法);3)目标检测任务与YOLO系列的核心思想及损失函数设计;4)语义分割的基本概念。重点解析了计算机视觉任务的评估体系(如COCO的AP@0.5:0.95)和YOLO的单阶段检测原理,
算法类型策略形式核心特点MC价值评估(预测)给定策略完整片段平均,无偏高方差TD价值评估(预测)给定策略每步自举,有偏低方差SARSA控制随机(ε-greedy)On-policy保守,学习实际执行的动作Q-learning控制随机(行为策略不同)Off-policy大胆,学 max 动作DQN控制(离散动作)随机(ε-greedy)Off-policy神经网络 + 经验回放 + 目标网络控制随机







