logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

【保姆级教程】使用lora微调LLM并在truthfulQA数据集评估(Part 2.在truthfulQA上评估LLM)

truthfulQA数据集格式如下所示question : 旨在引起模仿性虚假(错误答案)的问题字符串。choices : 恰好4个答案选择字符串。label : 一个指示正确答案在 choices 中索引的 int32。所以我们只需要能够格式化读取json,并输给模型就可以,注意,**我们的思路是,让模型从选项中自己挑答案,因此,要精心设置prompt。**然后把模型的选择与参考答案做对比。

文章图片
#深度学习#自然语言处理#人工智能 +1
【保姆级教程】使用lora微调LLM并在truthfulQA数据集评估(Part 1.微调训练)

在本期blog中,我们将逐步完成下面的任务:**1. 使用lora微调`gemma-2b-it`模型,数据集为`Alpaca_cleaned_data`2. 在`truthfulQA`数据集上评估模型效果**

文章图片
#人工智能#深度学习#nlp +2
树莓派4b安装miniconda成功教程(简单易懂好用)

【代码】树莓派4b安装miniconda成功教程(简单易懂好用)

文章图片
#conda
【强化学习】值迭代与策略迭代

如何比较策略的优劣呢?一般是通过对应的价值函数来比较的,也就是说,寻找较优策略可以通过寻找较优的价值函数来完成。我们首先定义策略之间的偏序关系:当且仅当对于任意的状态都有。于是在有限状态和动作集合的 MDP 中,至少存在一个策略比其他所有策略都好或者至少存在一个策略不差于其他所有策略,这个策略就是。之后都执行最优策略。这与在普通策略下的状态价值函数和动作价值函数之间的关系是一样的。最优策略可能有很

文章图片
#算法#人工智能#概率论
从零开始的django+vue项目实战(4--前端登陆页面设计与路由)

前面我们已经创建好数据模型了,并且在admin后台中添加了一些测试用户。下面我们就要设计好站点的url路由、对应的处理视图函数以及使用的前端模板了。注意要先从login导入views模块。

文章图片
#前端#django#vue.js
从0开始的django项目实战(3)ORM与数据库操作

我们前后端开发,肯定要操作数据库。那么django里我们怎么操作数据库捏?手动切换到数据库环境,然后敲入SQL语句?你知道这是个笑话!我们是程序员,讲的是自动化,实现的是Python环境下的操作,所以我们必然是通过写Python代码的方式。可是....Python和数据库语言SQL是两码事啊,它根本操作不了数据库!没关系,我们可以在Python代码中嵌入SQL语句。Python怎么创建和数据库的连

文章图片
#数据库#django#python +1
到底了