logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Text2SQL智能体学习笔记(一)——NL2SQL及执行流程介绍

一、什么是NL2SQLNL2SQL(也常写作 NLP2SQL)是自然语言处理(NLP)与数据库技术深度融合的交叉领域技术,核心目标是将人类用自然语言(中文、英文等)表达的非结构化数据查询需求,自动转换为可执行的结构化查询语言(SQL)语句,并返回对应的数据库查询结果。

文章图片
#学习
基于paddleocr实现验证码识别——训练数据

验证码(CAPTCHA)用于区分用户是人类还是计算机程序(如机器人)。这是为了防止各种形式的自动化攻击和滥用。

文章图片
#网络#人工智能
大模型从入门到精通(一)——大语言模型微调的前沿技术与应用

AdaLoRA(Adaptive LoRA)是对经典 LoRA 的自适应改进版,由清华大学 & 字节跳动团队 2023 年提出,核心解决了传统 LoRA“固定低秩维度(r)对所有层 / 任务均一化” 的问题 —— 通过动态调整不同层、不同 token 的 LoRA 秩分配,在保持极低参数量的同时,进一步提升微调效果,尤其适配复杂任务(如长文本生成、多模态、复杂对话)。Prompt Tuning 是

文章图片
#语言模型#人工智能#自然语言处理
大语言模型实战(五)——大模型开发范式演进:从“调用API”到“多Agent复杂目标”

大模型的普及不仅带来了能力的升级,也重构了开发思路——从“写代码实现功能”到“用模型能力落地业务目标”。本文结合实际案例,拆解大模型开发范式的四层演进逻辑,帮你理清不同场景下的技术选择。

文章图片
#语言模型#microsoft#服务器
混合知识库搭建:本地Docker部署Neo4j图数据库与Milvus向量库

本文详细讲解了混合知识库的搭建全流程:从Neo4j图数据库的Docker部署、自动建模、Cypher优化,到Milvus向量数据库的分块策略、向量插入、RAG链构建,再到双库的协同逻辑,完整覆盖了“关系型知识+语义型知识”的存储与检索需求。混合知识库是多代理系统的“知识基石”,其设计的合理性直接决定了代理执行的精准度与效率。而要让这些知识库与代理高效协作,离不开Supervisor的智能调度——这

文章图片
#docker#neo4j#数据库
多模态大模型学习笔记(一)——机器学习入门:监督/无监督学习核心任务全解析

使用带标签的数据集训练模型。你可以把它理解为“学生做有答案的练习题”:每个训练样本都包含“输入数据(题目)+ 对应输出标签(答案)”,模型的目标是学习“输入→输出”的映射规律,学成后就能给新的“题目”(未见过的输入数据)给出正确“答案”(预测结果)。使用无标签的数据集训练模型。类比到学习场景,这就像“学生分析一堆没有答案的原始数据,自己总结规律”:训练数据只有输入信息,没有预设的输出标签,模型的目

文章图片
#学习#机器学习
多模态大模型学习笔记(二)——机器学习十大经典算法:一张表看懂分类 / 回归 / 聚类 / 降维

回归选线性回归/决策树系,看是否需要非线性拟合;分类按数据规模/维度选逻辑回归/朴素贝叶斯/KNN/SVM/决策树系;聚类优先K-means,降维优先PCA。后续我们将针对每类算法展开实战教程,包括代码实现、调参技巧和业务落地案例,帮你从“懂理论”到“能落地”。

文章图片
#机器学习#算法#学习
多模态大模型学习笔记(三)——基于测井数据的电阻率预测:地球物理多参数线性回归分析

Warnings:specified.训练样本:3345 个油井测井数据显著地球物理参数:AC(声波时差)、K(钾含量)参数分布特征:多数测井参数呈现右偏分布,符合地质统计规律。

文章图片
#线性回归#人工智能
多模态大模型学习笔记(四)——从零掌握TF-IDF:原理、实战与可视化

TF-IDF = 词频 × 逆文档频率TF衡量词语在当前文档的重要性IDF衡量词语的独特性/区分度TF-IDF综合两者,提取真正有区分度的关键词。

文章图片
#自然语言处理#人工智能
多模态大模型学习笔记(五)—— 神经网络激活函数完整指南

激活函数本质是一个非线性函数f(x)yfzf∑wixibyfzf∑wi​xi​bx_i- 输入信号w_i- 权重参数b- 偏置项z- 线性组合结果y- 神经元输出。

文章图片
#学习#神经网络#自然语言处理 +1
    共 477 条
  • 1
  • 2
  • 3
  • 48
  • 请选择