logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

大模型 VS 大语言模型

最近很多朋友搞不懂大模型和大预言模型的区别,总是把大模型就认为是大语言模型。今天就用这篇帖子做一个科普。

#语言模型#人工智能#自然语言处理
大模型——增量预训练

预训练学知识,指令微调学格式,强化学习对齐人类偏好;所以要想大模型有领域知识,得增量预训练。

#人工智能#nlp#AIGC
大模型——强化学习

通过外部获得激励来校正学习方向从而获得一种自适应的学习能力;基于人工反馈的强化学习(Reinforcement Learning from Human Feedback,RLHF):构建人类反馈数据集,训练一个激励模型,模仿人类偏好对结果打分;

文章图片
#人工智能#深度学习
大模型——强化学习

通过外部获得激励来校正学习方向从而获得一种自适应的学习能力;基于人工反馈的强化学习(Reinforcement Learning from Human Feedback,RLHF):构建人类反馈数据集,训练一个激励模型,模仿人类偏好对结果打分;

文章图片
#人工智能#深度学习
搞懂大模型中的提示工程、RGA、微调

近几年AI产品的大火带来了新一轮的技术潮,尤为突出的是以生成式的AIGC模型。例如OpenAI公司的ChatGPT、百度的文心一言、阿里巴巴的通义千问、华为的盘古大模型等等。那么对于提示工程、RAG(检索增强)和微调,在工程当中,我们应该怎么去选择呢?首先我们需要了解大模型的流程:1.数据收集:大量的文本数据作为训练数据;2.模型搭建:构建LLM大模型3.训练模型:将收集的数据作为训练数据训练搭建

文章图片
#人工智能
大模型——提示学习

Prompt提供上下文和任务相关信息,以帮助模型更好地理解要求,并生成正确的输出;例一:问答任务中,Prompt可能包含问题或话题的描述,以帮助模型申城正确的答案;例二:在情感分析任务中,让模型做情感分类任务的做法通常是在句子前面加入前缀“该句子的情感是”即可;通过这种方式将情感分类任务转换成为一个“填空”任务,在训练过程中,BERT可以学到这个前缀与句子情感之间的关联。

#学习#人工智能#深度学习
大模型——强化学习

通过外部获得激励来校正学习方向从而获得一种自适应的学习能力;基于人工反馈的强化学习(Reinforcement Learning from Human Feedback,RLHF):构建人类反馈数据集,训练一个激励模型,模仿人类偏好对结果打分;

文章图片
#人工智能#深度学习
大模型外挂知识库

通过向量召回的方式从文档库里召回和用户问题相关的文档片段,同时输入到LLM中,增强模型回答质量。常用的方式直接用用户的问题进行文档召回。但是很多时候,用户的问题十分口语化,描述的也比较模糊,这样会影响向量的质量,进而影响模型回答的效果。

文章图片
#人工智能#开发语言#AIGC
    共 15 条
  • 1
  • 2
  • 请选择