logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

【科研学习记录】自适应动态规划(ADP)与强化学习(RL)理论入门

本文探讨了动态规划(DP)、自适应动态规划(ADP)和强化学习(RL)的核心思想及其相互关系。三者都旨在解决动态系统中的多步决策问题,通过贝尔曼方程将复杂问题分解为单步决策。文章首先介绍了状态、动作和回报三个核心概念,以及期望、递推关系和压缩映射等数学基础。重点分析了传统DP的局限性(模型依赖、维度灾难和离线计算),并详细阐述了ADP的改进方案:数据驱动、函数逼近和在线自适应。特别介绍了ADP的双

#学习#动态规划#算法
【EDA学习笔记】51 单片机核心板 PCB 项目实战

本文详细介绍了51单片机核心板PCB设计的全流程实战要点。从元件选型开始,围绕最小系统、电源电路和外围功能电路进行器件选择;接着讲解原理图设计的关键是确保电气连接正确;重点阐述了PCB布局的核心原则和布线规范,强调模块化布局、手动布线和关键信号优先;最后说明了丝印设计、DRC检查和生产文件导出的注意事项。文章提供了从入门认知到具体操作的完整指导,特别指出了新手常见错误点,为零基础学习者提供了系统性

#学习#单片机#pcb工艺
【物联网学习笔记】中断

本文系统介绍了STM32中断机制的核心概念与处理流程。主要内容包括:1)中断基础概念,如中断向量、中断向量表及其在STM32中的存储位置;2)程序启动与中断触发流程,从复位到主程序执行再到中断处理的完整链路;3)中断优先级配置规则,强调数值越小优先级越高,并详细说明抢占优先级与响应优先级的区别;4)中断嵌套原理与铁则,只有高抢占优先级中断才能打断正在执行的中断;5)完整中断处理三阶段流程,包括硬件

#物联网#学习#单片机 +1
【ROS2学习笔记】Launch 文件

本文介绍了ROS2中Launch文件的使用方法,主要包括以下内容: Launch文件的作用:解决多节点需要多终端启动的问题,实现一键启动多个节点。 Launch文件的基本结构:固定包含导入类、定义生成函数、创建节点对象和返回容器四个部分。 六大实战案例: 多节点启动(HelloWorld发布订阅) 命令行参数传递(RViz加载配置) 资源重映射(小海龟联动) 参数设置(修改背景色) YAML参数文

#学习
【ROS2学习笔记】DDS(数据分发服务)

本文介绍了ROS2中DDS通信模型的核心概念与应用。首先对比了点对点、Broker、广播和DDS四种通信模型的优缺点,指出DDS以数据为中心、无中心瓶颈、支持高实时性的特点最适合机器人系统。文章详细讲解了DDS的核心概念Domain和QoS(质量服务策略),包括RELIABILITY、HISTORY等常用配置及其适用场景。通过命令行和代码示例演示了QoS的配置方法,强调发布者和订阅者QoS策略必须

#学习
【嵌入式学习笔记】UART

本文详细介绍了STM32嵌入式系统中UART串口通信的基础概念和两种数据接收方法。首先讲解了UART的工作原理,包括串行与并行传输的区别、波特率、数据帧格式等基础知识。然后重点阐述了两种数据接收方案:超时解析法和DMA+空闲中断法。超时解析法通过中断接收单个字节并利用时间间隔判断帧结束,适合低速场景;DMA+空闲中断法则利用DMA自动搬运数据并通过总线空闲状态检测帧结束,适合高速大数据量传输。文章

#学习#嵌入式硬件#单片机
【嵌入式学习笔记】OLED超容易小作业:简单多级菜单交互

本文介绍了基于嵌入式系统的OLED显示与按键交互实现方案。通过全局变量管理模式状态(增加/减少)和数值(0-10),采用刷新标志位机制优化显示性能。具体实现包括:1)使用KEY6切换工作模式;2)通过KEY5在不同模式下增减数值;3)OLED实时显示当前模式和数值。系统采用事件驱动设计,仅在数据变化时刷新屏幕,有效避免了I2C总线资源浪费。文章详细解析了状态管理、按键控制和显示刷新的协作机制,并强

#学习#嵌入式硬件#单片机 +1
【嵌入式学习笔记】OLED 显示驱动 (SSD1306)

本文详细介绍了I²C协议及其在嵌入式系统中的应用,重点讲解了SSD1306 OLED显示屏的驱动开发流程。主要内容包括: I²C协议基础:讲解I²C总线结构、主从架构、设备寻址、数据传输机制等核心概念; SSD1306芯片详解:分析其特性、I²C通信协议、显示原理和控制流程; STM32 HAL库I²C API解析:介绍关键函数的使用方法; 驱动开发实践:提供从基础驱动到u8g2图形库的完整移植指

#学习#嵌入式硬件#单片机
【科研学习记录】自适应动态规划(ADP)与强化学习(RL)理论入门

本文探讨了动态规划(DP)、自适应动态规划(ADP)和强化学习(RL)的核心思想及其相互关系。三者都旨在解决动态系统中的多步决策问题,通过贝尔曼方程将复杂问题分解为单步决策。文章首先介绍了状态、动作和回报三个核心概念,以及期望、递推关系和压缩映射等数学基础。重点分析了传统DP的局限性(模型依赖、维度灾难和离线计算),并详细阐述了ADP的改进方案:数据驱动、函数逼近和在线自适应。特别介绍了ADP的双

#学习#动态规划#算法
【强化学习学习笔记】马尔科夫决策过程

本文摘要: 本文系统介绍了强化学习的核心概念与马尔可夫决策过程。首先回顾强化学习特点(无监督、延迟奖励、序列决策等)和智能体-环境交互流程。重点讲解了马尔可夫过程(MP)、马尔可夫奖励过程(MRP)和马尔可夫决策过程(MDP)的递进关系,详细阐述了状态价值函数、动作价值函数、贝尔曼方程(期望方程和最优方程)等核心概念。最后总结了公式体系和易混淆点,强调MP→MRP→MDP的演进逻辑及策略评估与优化

#学习#交互
    共 26 条
  • 1
  • 2
  • 3
  • 请选择