logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

粒子滤波|粒子滤波算法介绍

粒子滤波(Particle Filter)是一种基于蒙特卡洛采样和贝叶斯估计的非线性滤波算法,主要用于解决非线性、非高斯系统中的状态估计问题。它通过 “粒子”(对系统状态的随机样本)来近似系统状态的后验概率分布,从而实现对未知状态的递归估计。

文章图片
#算法
强化学习之父 Richard Sutton :大模型是死路一条

AI先驱理查德·萨顿警示:大语言模型存在根本性缺陷,而非真正的智能路径。作为强化学习奠基人,他指出当前大模型只是"博闻强识的模仿者",依赖静态文本数据,缺乏对现实世界的理解和交互能力。真正的智能应像婴儿般通过"一手经验"学习,在动态环境中试错、预测和构建世界模型。萨顿认为,未来AI发展需转向"大模拟"环境,培养自主决策能力,而非依赖人类知识结晶。这一观点或将引发AI研究范式转移,从大数据转向实时物

文章图片
强化学习|一文读懂近端策略优化(proximal policy optimization,PPO)

近端策略优化(proximal policy optimization,PPO) 可以通过重要性采样把同策略换成异策略,但重要性采样有一个问题:如果 pθ (at|st) 与 pθ′ (at|st) 相差太多,即这两个分布相差太多,重要性采样的结果就会不好。怎么避免它们相差太多呢?这就是 PPO 要做的事情。近端策略优化(proximal policy optimization,PPO):避免在使

文章图片
强化学习|lesson2:强化学习方法汇总

强化学习领域探讨了多种方法,包括模型自由和模型基于的策略。模型自由方法直接从反馈中学习,无需理解环境;而模型基于方法通过建立环境模型,增强预测能力。基于概率的方法聚焦于动作的概率,旨在最大化成功概率;相比之下,基于价值的方法侧重于选择具有最高价值的动作,追求最优策略。讨论还涉及了按回合更新与单步更新的策略,以及在线学习与离线学习的区别。以Q-learning、Policy Gradients、De

文章图片
#机器学习#人工智能
强化学习|什么是强化学习?

强化学习是一种通过不断尝试和错误反馈来学习规律、实现目标的机器学习方法,类似于计算机通过虚拟老师(如反馈分数)来决定哪些行为在特定环境中能获得高分或避免低分。与监督学习不同,强化学习无需预设数据和标签,而是在实际环境中持续探索和学习。实际应用中,如AlphaGo利用强化学习在围棋比赛中取得胜利,展示了其强大潜力。强化学习中提及的算法,如Q-Learning和Deep Q Network,通过模拟环

文章图片
#python
扩展学习|大数据挖掘与智能体ABM建模

本文主要介绍了智能体ABM(Agent-Based Modeling)建模的综述。首先,讨论了大数据挖掘与ABM仿真建模的范式互补关系,指出二者相互补充可以提高模型的准确性和可解释性。接着,分析了ABM仿真模拟范式的研究优势,包括其能够对复杂系统进行动态建模、模拟多个智能体的相互作用等特点。最后,详细介绍了ABM仿真模拟的核心特征和逻辑流程,包括智能体建模、环境建模、行为规则设计等内容。通过本文的

文章图片
#学习
大数据分析|大数据分析的十大应用领域

本博客介绍了BDA适用的各种分析技术领域。

文章图片
#数据可视化
学术思维如何真正落地?从“解释世界”到“改变世界”的关键一跃

学者常误将研究问题等同实践痛点,导致方案难落地。关键在于区分三层问题:实践问题(真实业务痛点)、研究问题(解决方案方向)与科学问题(底层机理)。在AI与风控领域,落地能力体现在将智能体嵌入业务流程,形成感知、决策、行动的闭环,最终解决“谁在何种场景下的具体问题”,完成从解释世界到改变世界的跨越。

文章图片
#人工智能#机器学习
云服务器概览(什么是?有哪些?怎么选?)

本文介绍了云服务器(Elastic Compute Service,简称 ECS)的基本概念、特点、分类及如何根据需求选择合适的云服务器类型。云服务器是一种基于云计算技术的虚拟服务器,允许用户按需租用计算能力、存储空间和网络带宽,具有弹性扩展、按需付费和高可用性等特点。与传统物理服务器相比,云服务器无需购买和维护硬件,更加灵活且成本效益高。云服务器的配置通常包括 CPU 核心数(如 1 核)、内存

文章图片
#GPU
生产力工具|vscode for mac安装及过程留存

本片博客介绍自己在最新版的mac上搭建vscode以及python环境时所注意的问题以及具体操作步骤。

文章图片
#vscode#macos#ide
    共 62 条
  • 1
  • 2
  • 3
  • 7
  • 请选择