logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

008-01:RAG 入门-向量存储与企业级向量数据库 milvus

向量数据库不仅仅是“存数据”,它还提供了成熟的 CRUD、多租户隔离、数据备份和水平扩展(Scale-out)能力,这些是简单的内存库(如 FAISS)难以胜任的。向量数据库专门优化了数据的压缩与加载策略。本文是 refine-rag 系列教程的第八篇,我们来学习向量存储的核心技术和 Milvus 数据库的使用。向量数据库就像是为向量量身定制的"仓库管理系统",它不仅能存储海量向量,还能快速检索、

#数据库#milvus
准备写一个LangChain系列的RAG教程

最近浏览一下小红书,经常能刷到后端、前端转 RAG、Agent 工程师的笔记,所以我在学习这些内容之后,也准备分享一下我所学到的的知识(之前学习了黄佳老师的课程),一来是巩固一下自己的知识,二来是分享给有需要的朋友。因为 LangChain 只支持 Python 和 TS,而我之前就会 Python,为了降低学习成本,所以本系列教程是用 Python 编程语言。LangChain 读取 PDF 数

003:RAG入门-LangChain 读取图片数据

这些数据如果不能被 RAG 系统处理,就会造成信息的缺失。在前面的文章中,我们学习了如何读取纯文本数据。但在实际应用中,很多重要信息都存储在图片、PPT、扫描件等非文本格式中。本文是 refine-rag 系列教程的第三篇,教你如何使用 LangChain 处理图片和 PPT 等多媒体数据。使用 Unstructured 的 OCR 功能提取图片中的文字。PPT 是常见的演示文稿格式,包含文字、图

001:LangChain的LCEL语法学习

本文介绍了LangChain表达式语言(LCEL)的基础用法,通过管道符(|)连接Prompt、Model和OutputParser构建处理链。文章演示了如何使用LCEL生成人物生平并转换为文言文,以及通过RunnableParallel和RunnablePassthrough实现并行处理和原样传递数据。提供了从DeepSeek和DashScope获取API密钥的方法,并展示了完整的代码示例。最后

#学习
简单 RAG 入门(01)

本文介绍了RAG(检索增强生成)和AI Agent的基本概念及应用。RAG通过检索外部知识库来增强大模型的回答能力,能解决时效性和幻觉问题,比微调更节省成本。AI Agent则是能执行具体任务的智能助手,具备规划、记忆、工具使用和执行能力。文章提供了基于LlamaIndex(使用千问大模型)和LangChain(使用DeepSeek大模型)的RAG实现示例,包括环境准备、API配置、文档加载、向量

#python#语言模型#人工智能 +2
000:简单 RAG 入门

还有你需要知道的是:RAG 可以解决一些时效性的问题和幻觉问题。相比 Fing-turning 微调,RAG 更节省成本,而且数据可以溯源,可以知道相关的知识点源自哪个文档。在学习 RAG 之前,我们先来对比一下 RAG 和 AI Agent 的概念,只有先了解这些概念,才能继续往前推进。当然了,这个流程也是简化过的,不过不用在意,这个只是便于你理解这个概念。执行:规划好之后,可以执行具体的任务,

002:RAG入门-LangChain读取文本数据

前面学习了 RAG 的概念和 LCEL 的语法,现在来继续学习 LangChain 读取文本数据的使用方法。在构建 RAG 系统时,数据加载是第一步,也是非常关键的一步。LangChain 提供了丰富的 Document Loaders,可以轻松处理各种格式的数据源。本文是 refine-rag 系列教程的第二篇,带你掌握 LangChain 的各种文本数据加载方式。Markdown 是技术文档的

004:RAG 入门-LangChain读取PDF

本文将介绍 4 种主流的 PDF 处理方案,从简单到复杂,从快速到智能,帮你找到最适合的方案。本文是 refine-rag 系列教程的第四篇,深入讲解如何使用多种方案处理 PDF 文档。PDF 是最常见的文档格式,但也是最难处理的格式之一。更强大的 PDF 处理库,提供丰富的元数据和控制能力。• 方案三:Unstructured(智能解析)最智能的 PDF 处理方案,自动识别文档结构。最简单的 P

005:RAG 入门-LangChain读取表格数据

本文是 refine-rag 系列教程的第五篇,全面讲解如何处理 CSV、PDF 表格等结构化数据。本文将介绍 4 种主流的表格处理方案,并实现一个完整的表格问答系统。专业的 PDF 表格提取工具,基于 PDF 的矢量信息。• 方案三:pdfplumber 提取 PDF 表格。方案三:pdfplumber 提取 PDF 表格。最智能的表格提取方案,自动识别表格结构和上下文。• 方案二:Camelo

#策略模式
github 吐血整理:如何应对 HR 的灵魂拷问?

本文首发于小程序:编程面试题库 ,转载请保留出处。最近趁着有时间,整理了一下关于 HR 的灵魂拷问系列,并新建了一个 github 仓库,欢迎持续关注。本文为节选部分内容,点击阅读原文可...

    共 15 条
  • 1
  • 2
  • 请选择