logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

大模型+强化学习_精典方法_RLHF

为了解决强化学习系统在与真实世界环境交互时需要理解复杂目标的问题。

文章图片
#人工智能
论文阅读_tinyllama_轻量级大模型

文中介绍了 TinyLlama 一种开源的轻量级大语言模型。

文章图片
#论文阅读
OpenRouter大语言模型接入平台

OpenRouter 是一个开放协议的“大语言模型接入平台”。用户可以在一个平台上使用统一的 API 接口和统一的 APIKey 调用各种模型。

#人工智能
Stata中常用的数据分析命令

1. 常用的数据分析工具 Stata、SPSS、SAS、R、Python,甚至Excel都可以做数据分析工作。R和Python是程序员的首选,可以通过编写程序实现成整体的数据清洗、分析、挖掘,还可以增加扩展支持,把一套代码应用于类似的数据分析场景中。对于专业人士(如生物、医疗领域)来说,掌握编程语言的学习成本太高,他们更关注通过工具,方便快捷地得到分析结果,SPSS和Stata主要是图形界面的..

#数据分析
机器学习_TF-IDF逆文本频率指数

1. 原理 TF-IDF(term frequency–inverse document frequency)是信息处理和数据挖掘的重要算法,它属于统计类方法。最常见的用法是寻找一篇文章的关键词。 其公式如下: TF(词频)是某个词在这篇文章中出现的频率,频率越高越可能是关键字。它具体的计算方法如上面公式所示:某关键在文章中出现的次数除以该文章中所有词的个数,其中的i是词索引号,j...

时序预测之一_概述

1.说明 前一段参加了天池的“盐城汽车上牌量预测“比赛。第一次面对大规模的时序问题,从比赛的过程,到赛后各位大佬的算法分享,收获很多。也将解决该类问题的套路在此总结一下。 本篇是总述,其中提到的具体算法,如:加窗,ARIMA,傅里叶/小波变换,LSTM等等将在本系列的后续文章中一一详述。2.问题描述 上牌量预测是一个典型的时序问题,且数据简单清晰,以复赛A榜数据为例,它提供了前3年...

在机器学习中应用数学方法

我们从初中就开始学习指数和对数,但即使是程序员平时也很少用到这些方法。本篇就来看看如何使用它们解决具体问题。指数在多分类问题中,一般在最后一步使用Softmax,将数值转换成属于各个类别的概率,比如根据输入物品图片,通过一系列处理,判别它是衣服、鞋子、帽子各类别的概率。具体公式如下:其中i为某一类别,j用于遍历所有可能的类别,Si计算的是某一类别的概率,即某一类别在所有类别中的占比。其中用到了自然

实战天池精准医疗大赛之一_数据分析

1. 赛题说明 天池精准医疗大赛——人工智能辅助糖尿病遗传风险预测,这是明天即将开始的天池大数据比赛。赛题名字看起来很高深,其实是根据年龄,性别,肝功,血常规等体验指标,预测血糖值。数据挺少的,特征40个左右,训练集5000多个实例,测试集1000个实例。任何机器都能很快跑完。比赛地址:https://tianchi.aliyun.com/competition/introduction.

#数据挖掘
批量下载公众号文章的开源工具

介绍如何使用开源项目wechat-article-exporter批量下载公众号文章及其部署方法。

#github
    共 117 条
  • 1
  • 2
  • 3
  • 12
  • 请选择