logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

OPAR循环:Agent的迭代执行心脏——从Observe到Plan到Act到Reflect的闭环控制流

让我们回到开头那个机票预订的问题。现在你应该能看懂了:Agent不是一次性回答你,而是启动了它的OPAR循环——Observe:读取你的请求,发现涉及航班、积分、时间三个维度;Plan:制定四步计划(搜航班→查积分→筛选→预订),附带"如果积分不足则切换现金"的退出条件;Act:调用搜索API,拿到10个航班结果;Reflect:发现最便宜的结果违反时间约束,输出REPLAN;回到Observe:

#迁移学习#分类#transformer
具身智能算法:从理论到实践 -- 第1章 具身智能概述

具身智能是指具有物理形态的智能体,通过"感知-决策-行动-反馈"闭环系统与物理环境进行持续交互,能够理解、适应并改造环境,具备在开放世界中完成复杂任务能力的智能系统。其核心特征包括:具身性(Embodiment)、交互性(Interaction)、适应性(Adaptability)和涌现性(Emergence)。这一定义标志着学术界对具身智能认识的深化与统一。相较于2020年代初期仅强调"物理实体

#microsoft
【现代人形机器人:从物理建模到大模型驱动的控制与学习】第13章 高样本效率策略:模仿学习、离线 RL 与混合方法

本章内容包括:行为克隆(Behavioral Cloning, BC)及其误差界与复合误差推导、交互式校正(DAgger)与其保证、逆强化学习(IRL)与最大熵 IRL 的推导、生成对抗模仿(GAIL)的形式化与等价性证明、离线 RL 的核心挑战与保守化(举例 CQL)的理论直觉与推导,以及示范引导的在线精调(IBRL / IBORL 类方法)的原理与样本复杂度层面的直观保证。

#算法#人工智能
【Python零基础教程】003 Python 在 TIOBE 霸榜背后的真相——编程语言生态分析

编程语言有上百种,但过去几年里,TIOBE 编程语言排行榜的第一名几乎只有一个名字:Python。TIOBE 指数根据搜索引擎上某一语言的搜索结果量,反映该语言的热度与关注度。Python 长时间霸榜,不是因为它诞生得晚,而是因为它恰好站在了这三条曲线的交汇点上。。下面一个个拆开说。

文章图片
#人工智能
21 Algorithm of Thoughts (AoT):用一条上下文,教会 LLM 自己走迷宫

让我们用最后一张图,把今天探索的所有内容收束起来:fill:#333;important;important;fill:none;color:#333;color:#333;important;fill:none;fill:#333;height:1em;Algorithm of Thoughts 总览成功死路有潜力问题输入如: 24点 [8,6,4,4]Step 1: 分解选择两个数操作Step

#人工智能#机器学习
C++23 核心特性解析

C++23 通过这些特性,使 C++ 更接近函数式和高性能语言的理想。如果你处理高性能 I/O、多维数据或错误链,升级值得。目前,GCC 11+(-std=c++23)、Clang(C++23 支持良好)和 MSVC(库特性领先)均支持大部分特性。对于生产,检查特定编译器版本;若依赖 C++20,C++23 是自然升级,提升效率和安全性。

#c++23#深度学习
具身智能算法:从理论到实践 —— 第3章 相关技术基础

3D高斯点云渲染(3D Gaussian Splatting, 3DGS)是2023年提出的革命性神经渲染技术,2025年已成为具身智能中实时场景重建的核心方法。其核心思想是将三维场景表示为一组可微分的3D高斯分布,而非传统的神经辐射场(NeRF)中的隐式函数。

#目标跟踪#人工智能#计算机视觉
《计算机视觉:从入门到精通》专栏 持续更新

深入卷积神经网络原理,详解ResNet、EfficientNet等骨干网络设计,覆盖目标检测(YOLO/Faster R-CNN)、语义分割(U-Net/DeepLab)、实例分割等核心任务。探索Transformer视觉模型(ViT/Swin)、自监督学习、神经辐射场(NeRF)及多模态大模型(CLIP/SAM)等前沿方向,剖析注意力机制与扩散模型如何重塑视觉智能。涵盖数字图像表示、色彩空间、滤

文章图片
#计算机视觉#人工智能#目标跟踪 +1
【现代人形机器人:从物理建模到大模型驱动的控制与学习】第13章 高样本效率策略:模仿学习、离线 RL 与混合方法

本章内容包括:行为克隆(Behavioral Cloning, BC)及其误差界与复合误差推导、交互式校正(DAgger)与其保证、逆强化学习(IRL)与最大熵 IRL 的推导、生成对抗模仿(GAIL)的形式化与等价性证明、离线 RL 的核心挑战与保守化(举例 CQL)的理论直觉与推导,以及示范引导的在线精调(IBRL / IBORL 类方法)的原理与样本复杂度层面的直观保证。

#算法#人工智能
SAR目标检测识别数据集汇总(持续更新2025)

SAR目标检测识别数据集汇总(持续更新2025) - 知乎

#数据挖掘#分类
    共 79 条
  • 1
  • 2
  • 3
  • 8
  • 请选择