基于英文模型增量预训练的中文模型

LLama系列:

llama作为开源社区的宠儿,有许多基于它的中文模型,下面列举比较流行的一些模型

  • hfl/chinese-llama-2:https://github.com/ymcui/Chinese-LLaMA-Alpaca
  • Linly-Al/Chinese-LLaMA-2:https://huggingface.co/hfl/chinese-llama-2-7b
  • Atom:https://huggingface.co/FlagAlpha/Atom-7B

如果要学习如何做模型训练,推荐学习hfl/chinese-llama-2。如果是要选择强大的中文llama,推荐选Atom。

Mistral系列:

Mistral是超越llama的最强开源模型之一,由于发布时间晚于llama,因此其中文版本较少。

  • openbuddy-mistral:https://huggingface.co/OpenBuddy/openbuddy-mistral-7b-v13-base。openbuddy持续更新了llama、mistral、gemma等模型的中文版本,推荐大家去https://huggingface.co/OpenBuddy找找宝藏。
  • Chinese-Mistral:https://huggingface.co/itpossible/Chinese-Mistral-7B-v0.1。这是huggingface最新开源的中文Mistral,包括base和instruct两个版本。其C-Eval、C-MMLU、MMLU分数高于其他llama、mistral变体,具有较强的中英文能力。
  • JiuZhou:https://huggingface.co/itpossible/JiuZhou-base。该模型的基座模型为Chinese-Mistral,采用大规模中英文地球科学相关语料进行增量预训练,并使用了多种优化方法。由于地球科学是交叉性非常强的学科,因此其C-Eval、C-MMLU、MMLU分数进一步提高。不仅在专业领域表现出较强的语义理解能力,而且能力泛化到通用领域。C-Eval榜单显示,其中文能力仅次于Chatglm2-6B。模型包括base和instruct两个版本。

如果大家需要选用强大的中文Mistral,推荐选JiuZhou。

从头训练的中文模型

  • Qwen系列
  • Chatglm系列
  • Baichuan系列
  • Yi系列

后面持续更新

Logo

旨在为数千万中国开发者提供一个无缝且高效的云端环境,以支持学习、使用和贡献开源项目。

更多推荐