
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
手撕 多头注意力机制
最详细的 手撕多头注意力机制MHA

Ollama API
datawhale.com 动手学Ollama。

强化学习 (11)随机近似
本文介绍了增量计算均值的新方法及其理论背景。传统均值计算需等待所有样本收集完毕,而增量方法通过迭代更新实现实时计算。该方法属于随机近似算法(SA)和随机梯度下降(SGD)的特殊形式,其中SGD通过随机样本近似梯度,降低大规模数据计算复杂度。文章详细推导了Robbins-Monro算法证明SGD收敛性,并比较了批量梯度下降(BGD)、小批量梯度下降(MBGD)和SGD的异同。理论分析表明,SGD虽因

Ollama 自定义导入模型
nvidia-smi我的笔记本 可怜兮兮的GPU。

手搓RAG
RAG(检索增强生成)技术框架通过结合检索与生成式AI,先检索外部知识库信息,再输入大模型生成回答。关键技术包括检索引擎(如向量数据库)、大语言模型(如GPT)及数据预处理,有效解决模型知识滞后和幻觉问题,提升回答准确性。应用场景广泛,如智能客服、医疗问答等。Datawhale推出的wow-RAG项目提供了实践教程,涵盖环境配置、文本分割、向量生成、检索匹配及流式生成答案等完整流程,使用智谱AI等

使用 ReAct 框架在 Ollama 中实现本地代理(Agent)
本文是【】的学习笔记网址:datawhale.com 课程名称:动手学ollama。

使用 ReAct 框架在 Ollama 中实现本地代理(Agent)
本文是【】的学习笔记网址:datawhale.com 课程名称:动手学ollama。

到底了







