从0到一搭建聊天机器人(ai大模型开发零基础入门)(一)
·
一.大模型概述
大模型(Large Language Model, LLM)是一种基于深度学习的人工智能模型,通常指参数量达到百亿、千亿级别的神经网络。它通过在海量文本、图像、音视频等数据上进行预训练,学习到了丰富的知识和模式,从而具备理解、生成、推理和交互等强大能力。
用深度学习训练得到的网络叫做深度神经网络,神经网络相当一个函数,也可以当作人的大脑。
二.预训练大模型实现三步走
1.学会说话
在大模型开发里,“学会说话” 通常指的是让模型具备自然语言理解和生成能力,这是大模型落地的第一步,也是最直观的能力体现。

2.理解意图
** 理解意图(Intent Understanding)** 是指大模型在接收到用户的自然语言输入后,不仅对文本进行语义解析,还能进一步识别出用户的核心目标、潜在需求、任务类型以及相关约束条件,从而为后续生成精准、有效的响应或执行相应动作提供依据的能力。

3.反馈择优
反馈择优,是指模型根据用户的反馈、评价或真实效果,从多个候选结果中选择最优、最符合需求的答案,并不断优化后续输出的过程。

三.认识聊天机器人
1.概念
聊天机器人是一种通过自然语言与用户进行交互的智能程序,基于大模型或规则引擎,实现自动理解、响应和服务。
2.应用
应用场景
- 智能客服
- 智能助手(日程、查询、工具)
- 教育辅导、答疑
- 医疗问诊、健康咨询
- 企业内部问答、知识库
- 智能家居、车载语音交互
- 娱乐陪伴、内容生
3.学习目标

4.流程

我们首先将开源大模型通过Ollma/Langchain托管到后端,然后做出前端页面展示给用户端,即可实现聊天机器人

更多推荐


所有评论(0)