logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

打造Agent的视频理解技能:基于抽帧、转写与对齐的完整实现

多模态大模型时代,视频信息的高效解析成为AI应用落地的关键挑战。与传统文本处理不同,视频理解需要同时处理视觉与音频双通道数据。通过视频抽帧、语音转写与时间轴对齐,可将非线性视频流转换为结构化的图文剧本,从而让大模型“看懂”视频内容。这一技术路线在Agent开发中尤为重要——Agent需要扩展视频感知能力,而基于Skill机制的视频处理工具能够低成本实现多模态扩展。本文从工程实践角度,解析基于ffm

#多模态
哈工大集合论与图论慕课答案全解析(2022最新版)——附对比选项技巧

本文提供哈工大集合论与图论慕课的高效学习指南,重点解析2022最新版课程答案及对比选项技巧。内容涵盖集合运算陷阱识别、映射特性判断、无穷基数解题思路等核心知识点,并分享科学解题方法论和期末考试高频题型分析,帮助学习者从被动答题转向主动破题。

#图论
Windows下pyenv安装避坑指南:解决powershell报错与手动缓存加速下载

本文提供了在Windows系统上安装和配置pyenv-win的详细避坑指南。针对PowerShell执行策略报错、环境变量配置失败等常见问题,给出了清晰的解决方案。重点介绍了通过手动缓存Python安装包来加速下载的核心技巧,帮助开发者高效管理多个Python版本,提升开发效率。

【2024|技术解析】CAS滑坡数据集实战:多传感器融合下的深度学习滑坡检测优化策略

本文深入解析2024年CAS滑坡数据集在多传感器融合下的深度学习滑坡检测优化策略。通过对比UAV与SAT影像性能,探讨数据预处理、模型选型及多传感器融合技术,提出改进版Swin-UNet结构,实现89% mIoU与35FPS的高效检测。文章还分享了实战中的调参技巧与评估指标选择,为地质灾害预警提供可靠解决方案。

#深度学习
batocera linux树莓派,树莓派Batocera系统添加OpenBOR模拟器教程

安装文件下载链接https://pan.baidu.com/s/1ezCip4lzxaA28Ba2EYEYJw使用WinSCP登录batocera把FICHIERS-A-COLLER文件夹中的2个文件:openbor-install.sh和OpenBOR文件,放到/usr/share/路径下然后添加文件上openbor-install.sh权限,右键单击属性,然后将八进制0644改写成777。然后

uniapp 右上角登录_使用 UniApp 实现小程序的微信登录功能

1.微信登录思路:在main.js 中封装公共函数,用于判断用户是否登录在main.js 中分定义全局变量,用于存储接口地址如果没有登录、则跳转至登录页面进入登录页面通过 wx.login 获取用户的 code通过 code 获取用户的 SessionKey、OpenId 等信息【本应后台接口、但是此处使用js发送请求】通过 openId 调用后台 Api 获取用户的信息获取成功,则说明已经授权过

开源双足机器人Microduck实战:强化学习从仿真到真机部署

强化学习正逐渐成为机器人运动控制领域的关键技术,它不依赖精确的动力学模型,而是通过智能体与环境的交互自主习得控制策略。在双足机器人方向,从仿真训练到真机部署的迁移(Sim-to-Real)是核心挑战,域随机化与PPO算法则被广泛应用以提升策略的鲁棒性。这一技术路径不仅降低了硬件实验成本,也为教育科研提供了可复现的开放平台。基于开源项目Microduck,文章完整梳理了从环境搭建、仿真训练、策略导出

虹软人脸识别SDK在Java项目中的快速集成与实战

本文详细介绍了如何在Java项目中快速集成虹软人脸识别SDK,从环境搭建、SDK激活与引擎初始化,到核心的人脸检测、特征提取与比对实战。内容涵盖活体检测、年龄性别识别等高级功能,并提供了资源管理、性能优化等避坑指南,帮助开发者高效实现人脸识别应用。

#人脸识别
【2024|技术解析】CAS滑坡数据集实战:多传感器融合下的深度学习滑坡检测优化策略

本文深入解析2024年CAS滑坡数据集在多传感器融合下的深度学习滑坡检测优化策略。通过对比UAV与SAT影像性能,探讨数据预处理、模型选型及多传感器融合技术,提出改进版Swin-UNet结构,实现89% mIoU与35FPS的高效检测。文章还分享了实战中的调参技巧与评估指标选择,为地质灾害预警提供可靠解决方案。

#深度学习
FreeToken引擎实战:8GB显存跑35B大模型的部署与调优

大语言模型本地部署的核心瓶颈在于显存容量,动辄数十GB的权重文件让普通玩家望而却步。FreeToken引擎通过显存调度与KV Cache动态管理,将部分计算卸载至内存,宣称能在8GB显存设备上运行35B参数级别的开源模型,为低配置硬件提供了新的技术路径。这种方式不同于传统的整模型驻留,更接近“以调度换容量,以延迟换门槛”的工程思路。对于手边只有游戏本、想验证大模型效果或搭建API原型的开发者而言,

    共 192 条
  • 1
  • 2
  • 3
  • 20
  • 请选择