
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
在上一章《【课程总结】Day11(上):手势图像识别实战(LeNet模型)》课程中,我们通过使用LeNet模型实现了手势识别。在本章内容中,我们将搭建Vgg模型和ResNet模型,并应用到手势识别中。

随着2024年5月14日GPT-4o的发布,多模态大模型逐渐成为行业热点,国内各大厂商阿里、百度、智谱也相继发布了自己的多模态大模型。本章内容,我们将从多模态的体验感受开始,逐步了解多模态大模型的架构组成、训练数据构成,最后搭建一个多模态大模型。多模态大模型是一种能够处理和理解多种数据类型(模态)的人工智能模型。这些模态通常包括文本、图像、音频和视频等。量化是将高精度浮点数表示(如32位浮点数)转

上一章我们已经学习掌握了计算机视觉中的人脸检测【课程总结】Day14:MTCNN过程的深入理解,接下来的我们将学习了解计算机视觉中:语义分割和图像分割。语义分割,是将图像中的每个像素都分类为特定的语义类别,如"人"、“车”、"建筑"等。访问https://segment-anything.com/demo#也可在线体验语义分割。# U_Net模型中的双卷积网络结构# 此处包含padding,为了使

在上一章【课程总结】day24(上):大模型三阶段训练方法(LLaMa Factory)内容中主要了解一个大模型的训练过程,无论是第三方的大模型还是自研的大模型,都需要部署到服务端,提供对应API接口供上层应用使用。所以,本章将主要了解vLLm + langchain的基本使用方法。

在上一章【课程总结】day24(上):大模型三阶段训练方法(LLaMa Factory)内容中主要了解一个大模型的训练过程,无论是第三方的大模型还是自研的大模型,都需要部署到服务端,提供对应API接口供上层应用使用。所以,本章将主要了解vLLm + langchain的基本使用方法。

PPT自动生成系统是基于LangGraph框架开发的工具,可将Markdown文档智能转换为专业PPT演示文稿。项目开源地址为https://github.com/BJSS-China/ppt_assistant。

PPT自动生成系统是基于LangGraph框架开发的工具,可将Markdown文档智能转换为专业PPT演示文稿。项目开源地址为https://github.com/BJSS-China/ppt_assistant。

点乘(又称内积)是两个矢量的代数运算,结果是一个标量。对于两个矢量Aa1a2a3Aa1a2a3和Bb1b2b3Bb1b2b3A⋅Ba1b1a2b2a3b3A⋅Ba1b1a2b2a3b3叉乘(又称外积)是两个矢量的运算,结果是一个新的矢量,且与原来的两个矢量都垂直。对于两个矢量Aa1a2a3Aa1a2a3和。








