logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

RWKV7-G0a3 13.3B 发布:世界最强纯 RNN 大语言模型

我们以 RWKV6-world-v2.1 14B 模型为基础,仅继续训练 2T tokens(加入了蒸馏的 35B tokens from DeepSeek v3.1),即获得了有竞争力的效果。它依然是纯预训练模型(无后训练,无刷榜),评测成绩符合模型实际使用体验。

文章图片
#rnn#语言模型#人工智能 +4
RWKV-7 G1e模型发布,全面增强,下载量持续增加,用户好评

最近30天在HF和ollama有2190次模型下载,4月发布G1f

文章图片
#rnn#开源#语言模型 +2
RWKV超并发项目教程,RWKV-LM训练提速40%

单卡即可1000并发,包括rwkv_lightning,RWKV版nano-vllm等等项目。

文章图片
#rnn#人工智能#深度学习 +2
RWKV社区一月动态:11篇论文,第1期论文研讨会

RWKV G1c系列模型发布,元始智能与九天睿芯达成战略合作

文章图片
#人工智能#深度学习#语言模型 +4
RWKV-7 G1e模型发布,全面增强,下载量持续增加,用户好评

最近30天在HF和ollama有2190次模型下载,4月发布G1f

文章图片
#rnn#开源#语言模型 +2
RWKV-6-World 14B正式开源发布,迄今最强的稠密纯RNN大语言模型

2024年7月19日,RWKV 开源基金会宣布正式向全球开源 RWKV-6-World-14B 模型。RWKV-6-World-14B 是迄今最强的稠密纯 RNN 大语言模型。

文章图片
#rnn#语言模型#人工智能
Ollama 已支持 RWKV-7 模型,可灵活开关思考模式

Ollama现已支持RWKV7-G1和RWKV-7-World模型系列,用户可通过简单命令安装并运行这些模型。操作步骤包括下载Ollama、安装后运行指定模型命令,支持对话模式切换和上下文管理。推荐使用RWKV7-G1系列模型,还提供了RWKV Chat应用作为替代选择。用户可访问RWKV中文官网和社区获取更多资源与支持。

文章图片
#开源#人工智能#深度学习 +1
国产大模型 RWKV 发布新架构论文:基于矩阵值状态和动态递归的改进

RWKV 新架构:Eagle (RWKV-5) 和 Finch (RWKV-6),在 RWKV-4 架构的基础上进行了改进

文章图片
#语言模型#人工智能
Ollama 已支持 RWKV-7 模型,可灵活开关思考模式

Ollama现已支持RWKV7-G1和RWKV-7-World模型系列,用户可通过简单命令安装并运行这些模型。操作步骤包括下载Ollama、安装后运行指定模型命令,支持对话模式切换和上下文管理。推荐使用RWKV7-G1系列模型,还提供了RWKV Chat应用作为替代选择。用户可访问RWKV中文官网和社区获取更多资源与支持。

文章图片
#开源#人工智能#深度学习 +1
RWKV社区十一月动态:10篇新论文,G0a3 13.3B发布

PENG Bo发表关于大模型的认知的观点,同月发布RWKV7+ROSA完成数字颠倒任务Demo

文章图片
#深度学习#人工智能#rnn +4
    共 23 条
  • 1
  • 2
  • 3
  • 请选择