
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
【数据结构】数组和字符串(十一):字符串的定义与存储(顺序存储、链式存储及其C语言实现)
本文详细介绍了字符串的定义与存储,包括顺序存储、链式存储及其C语言实现

【深度学习】Pytorch 系列教程(六):PyTorch数据结构:2、张量的数学运算(4):一维卷积及其数学原理(步长stride、零填充pad;宽卷积、窄卷积、等宽卷积;卷积运算与互相关运算)
本文介绍了一维卷积运算,包括步长、零填充;宽卷积、窄卷积、等宽卷积;卷积运算与互相关运算等及其PyTorch实现

【数据结构】数组和字符串(六):特殊矩阵的压缩存储:稀疏矩阵——压缩稀疏列(Compressed Sparse Column,CSC)
本文介绍了特殊矩阵的压缩存储:稀疏矩阵——压缩稀疏列(Compressed Sparse Column,CSC)

【数据结构实验】图(三)图的深度优先搜索(DFS)生成树
本实验使用C语言实现了深度优先搜索生成树。

【数据结构】数组和字符串(十):稀疏矩阵的链接存储:十字链表的矩阵操作(加法、乘法、转置)
本文介绍了十字链表的矩阵操作,包括加法、乘法、转置等

【赠书】终于等到你!“西瓜书”《机器学习》官方配套习题集重磅出版
"西瓜书”《机器学习》官方配套习题集和教学参考书,周志华老师亲自撰写推荐序和指导本书习题设计和讲解,南京大学机器学习教学团队骨干教师主编

【深度学习实验】前馈神经网络(九):整合训练、评估、预测过程(Runner)
本实验实现了Runner类,用于模型的训练、评估和预测。通过该类,可以更方便地进行模型的训练和评估,并获取训练过程中的损失变化和评价指标的变化情况等。

【深度学习】强化学习(四)强化学习的值函数
在强化学习中,为了评估策略 π 的期望回报,引入了值函数的概念,包括状态值函数和状态-动作值函数。

【深度学习】强化学习(六)基于值函数的学习方法
值函数在强化学习中起到了桥梁的作用,连接了策略、状态和动作的关系。它们是智能体学习和改进的核心工具,使其能够在未知环境中获得最大的累积奖励。这种学习过程涉及到智能体根据当前状态选择动作,环境根据智能体的动作转移状态,并提供即时奖励的循环过程。智能体的决策和学习功能使其能够根据状态选择不同的动作,学习通过获得的奖励来调整策略。:是智能体外部的所有事物,对智能体的动作做出响应,改变状态,并反馈相应的奖









