logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

ROS2+Gazebo仿真环境下基于SLAM Toolbox建图与Nav2的机器人自主导航(含报错处理)

本文详细记录了在ROS2+Gazebo仿真环境中,使用TurtleBot3完成SLAM建图与Nav2导航全流程。首先安装Nav2和slam_toolbox核心包,启动Gazebo仿真世界并运行slam_toolbox的同步建图节点,通过rviz实时观察地图构建过程。利用键盘控制机器人遍历环境,生成完整的二维占据栅格地图保存。随后切换至导航模式,加载先前保存的地图,通过2D Pose Estimat

文章图片
#机器人
从数字智能到物理智能:深度解构具身智能时代的边缘计算、嵌入式实时系统与多形态智能体

本文探讨了2026年AI产业从数字智能向具身智能转型的核心挑战,提出了三重边界理论:自动化、智能化和具身化的本质区别。文章构建了物理智能体的三层神经回路架构模型(反射层、小脑层、大脑层),分析了不同载体机器人在算力配比与延迟预算上的根本差异。重点讨论了边缘AI在确定性实时约束下运行概率性推理的系统级矛盾,提出了时间触发架构、时限封装等工程解决方案。最后指出具身智能必须解决瓶颈:物理数据匮乏、环境泛

文章图片
#人工智能#嵌入式#无人机 +2
从数字智能到物理智能:深度解构具身智能时代的边缘计算、嵌入式实时系统与多形态智能体

本文探讨了2026年AI产业从数字智能向具身智能转型的核心挑战,提出了三重边界理论:自动化、智能化和具身化的本质区别。文章构建了物理智能体的三层神经回路架构模型(反射层、小脑层、大脑层),分析了不同载体机器人在算力配比与延迟预算上的根本差异。重点讨论了边缘AI在确定性实时约束下运行概率性推理的系统级矛盾,提出了时间触发架构、时限封装等工程解决方案。最后指出具身智能必须解决瓶颈:物理数据匮乏、环境泛

文章图片
#人工智能#嵌入式#无人机 +2
打造实时电商数据大屏:Vue 3 + FastAPI + WebSocket

本文介绍了一个基于Vue3和FastAPI的电商实时数据大屏系统。前端采用Vue3+ECharts实现可视化展示,后端使用FastAPI+WebSocket提供实时数据推送。系统包含订单趋势图、地域分布图、商品销售排行等模块,通过数据模拟算法生成真实业务数据。关键技术包括WebSocket状态管理、ECharts按需加载、CSS Grid响应式布局等,实现了秒级延迟、自动重连和跨设备适配。系统支持

文章图片
#vue.js#fastapi#前端 +4
AI 智能体设计模式全景图:从单智能体推理到多智能体编排

系统梳理了当前主流的AgenticAI设计模式,涵盖单智能体和多智能体架构。单智能体模式包括思维链(CoT)、反思迭代(Reflection)、规划执行(Plan-Act)等9种核心范式;多智能体编排分为流水线、并行、层级等6种协作模式。文章通过交互式流程图和对比表格,详细解析了各模式的适用场景、核心机制及成本考量,并提供了包含28个关键点的选型决策树。特别强调企业落地需注意的反模式,如共享凭证、

文章图片
#人工智能#工作流
具身智能架构:一场尚未收敛的范式战争

、本文系统梳理了2026年具身智能领域的技术发展与商业现状。研究表明,架构演进呈现多路线并行特征:端到端融合、语言中介和世界模型等路线正逐步收敛为层次化统一架构,通过时间尺度分层(毫秒级控制/秒级规划)实现安全性与泛化性的平衡。产业层面,智元等企业已实现万台级量产突破,工信部启动万台级落地专项行动,但开放域通用操作的商业成熟度仍需验证。当前技术面临三大挑战:端侧实时性、世界模型工程化难度、多智能体

文章图片
#人工智能#架构
用memU bot做飞书ai办公机器人(含本地ollama模型接入+可视化图表mcp)

本文详细介绍了如何在飞书平台上创建自建应用并与memU Bot进行集成的完整流程。主要包括:1)在飞书开发者平台创建应用并配置7个必要权限;2)安装memU Bot,配置ollama本地模型,并完成飞书平台对接设置;3)配置高德地图和可视化图表MCP服务;4)测试机器人功能,包括消息收发、数据处理和可视化图表生成等。文章还探讨了测试过程中遇到的一些问题及解决方案,展示了AI在商业场景中的实际应用能

文章图片
#人工智能#机器人#科技
OpenClaw+LibTV视频生成实测(含安装+配置+分析):ai生成工作流很规范,但画面在“打架“

摘要:本文详细介绍了LibTV Skills视频生成工具的安装配置流程及使用测试。从密钥获取、环境搭建到技能安装,提供了完整的操作指南。通过生成"桃园三结义"视频的实测案例,分析了当前AI视频生成技术的优缺点:亮点在于自动化工作流搭建和分镜规划能力,但存在字幕异常、转场穿帮、背景不一致等技术缺陷。建议普通用户可将其作为素材生成工具,开发者则需根据项目需求选择现成skills或自

文章图片
#人工智能#AIGC#内容运营 +1
Qwen3-VL-Seg 深度解读:当多模态大模型学会“像素级精准手术“

阿里巴巴通义实验室提出的Qwen3-VL-Seg模型解决了开放世界指代分割的关键挑战,通过轻量级边界框引导的掩码解码器(仅17M参数),将多模态大语言模型预测的边界框作为语义-空间先验,实现了像素级精确分割。该方法创新性地构建了SA1B-ORS训练数据集(299万样本)和ORS-Bench评测基准,在保持通用多模态能力的同时,显著提升了复杂语言描述下的分割精度和分布外泛化能力。实验表明,该模型在4

文章图片
#人工智能#计算机视觉#多模态 +1
具身智能架构:一场尚未收敛的范式战争

、本文系统梳理了2026年具身智能领域的技术发展与商业现状。研究表明,架构演进呈现多路线并行特征:端到端融合、语言中介和世界模型等路线正逐步收敛为层次化统一架构,通过时间尺度分层(毫秒级控制/秒级规划)实现安全性与泛化性的平衡。产业层面,智元等企业已实现万台级量产突破,工信部启动万台级落地专项行动,但开放域通用操作的商业成熟度仍需验证。当前技术面临三大挑战:端侧实时性、世界模型工程化难度、多智能体

文章图片
#人工智能#架构
    共 80 条
  • 1
  • 2
  • 3
  • 8
  • 请选择