logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

文本向量化(二)基于Faiss向量数据库语义向量检索

目标函数的值(在 k-means 情况下为总平方误差)随迭代次数的变化存储在变量中,并且更详细的统计信息存储在.kmeans.objkmeans.iteration_stats 中。通过PCA,我们可以将Embedding后得到的高维数据投影到一个较低维度的子空间中,这个子空间由数据方差最大的方向(即主成分)构成,从而简化数据结构并突出主要特征。k-means聚类能够通过迭代优化最小化簇内的总平方

文章图片
#机器学习#支持向量机#人工智能
知识图谱操作(二)Neo4j -设计基础SQL(CYPHER查询)

向量化计划通过Faiss向量数据库实现.文本嵌入后,考虑对嵌入的向量归入Faiss库。

文章图片
#faiss#数据库#numpy
知识图谱操作(一)Neo4j储存基于实体和关系的知识图谱

可视化问答系统的向量化是非常重要的一环.可视化问答系统数据库的向量化主要考虑将数据预处理部分得到的纯txt文件通过faiss向量库标准化为向量以便后续进行RAG增强检索.

文章图片
#python
到底了