
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
【代码】AI第一天 自我理解笔记--微调大模型。

请求body参数结构可参考代码示例中的部分,请求body示例代码如下。根据该命令进行变体的接口测试。
你买来一个强大的裸引擎(大模型),然后你自己设计并安装了一整套复杂的车载系统(MCP服务)。这套系统里,你自己造了导航模块(数据库查询服务)、娱乐模块(邮件发送服务),并且用一套自己定义的总线协议(MCP协议)把它们连接起来。引擎(大模型)只负责根据你的指令输出“该导航了”或“该放音乐了”,而具体怎么做,都是由你的改装系统完成的。这些功能是车厂(OpenAI/Google)预装好的,你只需要在车机
注意力权重=Softmax(QKTd)注意力权重=Softmax(dQKT)特征图=卷积核∗输入图像+偏置特征图=卷积核∗输入图像+偏置。z1=W1⋅输入+b1z1=W1⋅输入+b1。输出=取窗口最大值输出=取窗口最大值。

LLM 推理(Decode)是“搬砖”工作,不是“算术”工作。带宽 = 搬砖速度。A800 的 HBM2e 带宽是 L20 GDDR6 的 2.3 倍以上,因此在生成文本时,A800 的速度天然比 L20 快 2 倍以上。如果你追求低延迟(单个用户响应快),选高带宽卡(A800/H100/A100)。如果你追求低成本大显存(能跑起大模型,但慢一点),选 L20/4090 等 GDDR 卡,并配合量
由开发者手动设置的参数,控制训练过程,但不直接参与模型学习。:在训练过程中通过优化器自动学习的参数,直接影响模型的输出。以下是机器学习和深度学习中。
在模型的每一层(如注意力层、前向层)中,添加一个低秩矩阵(如A∈Rd×rA∈Rd×r和B∈Rr×dB∈Rr×d,r≪dr≪d),通过微调这两个小矩阵来调整模型行为。在模型的每一层中插入一个小型神经网络(Adapter模块),通过调整Adapter参数来适应任务,原始参数冻结。全量微调是将预训练模型的所有参数(如BERT的1亿参数)全部放开,通过反向传播更新所有参数,使其适应新任务。固定模型参数,仅
你买来一个强大的裸引擎(大模型),然后你自己设计并安装了一整套复杂的车载系统(MCP服务)。这套系统里,你自己造了导航模块(数据库查询服务)、娱乐模块(邮件发送服务),并且用一套自己定义的总线协议(MCP协议)把它们连接起来。引擎(大模型)只负责根据你的指令输出“该导航了”或“该放音乐了”,而具体怎么做,都是由你的改装系统完成的。这些功能是车厂(OpenAI/Google)预装好的,你只需要在车机







