• 开源中文大语言模型汇总


    基于英文模型增量预训练的中文模型

    LLama系列:

    llama作为开源社区的宠儿,有许多基于它的中文模型,下面列举比较流行的一些模型

    • hfl/chinese-llama-2:https://github.com/ymcui/Chinese-LLaMA-Alpaca
    • Linly-Al/Chinese-LLaMA-2:https://huggingface.co/hfl/chinese-llama-2-7b
    • Atom:https://huggingface.co/FlagAlpha/Atom-7B

    如果要学习如何做模型训练,推荐学习hfl/chinese-llama-2。如果是要选择强大的中文llama,推荐选Atom。

    Mistral系列:

    Mistral是超越llama的最强开源模型之一,由于发布时间晚于llama,因此其中文版本较少。

    • openbuddy-mistral:https://huggingface.co/OpenBuddy/openbuddy-mistral-7b-v13-base。openbuddy持续更新了llama、mistral、gemma等模型的中文版本,推荐大家去https://huggingface.co/OpenBuddy找找宝藏。
    • Chinese-Mistral:https://huggingface.co/itpossible/Chinese-Mistral-7B-v0.1。这是huggingface最新开源的中文Mistral,包括base和instruct两个版本。其C-Eval、C-MMLU、MMLU分数高于其他llama、mistral变体,具有较强的中英文能力。
    • JiuZhou:https://huggingface.co/itpossible/JiuZhou-base。该模型的基座模型为Chinese-Mistral,采用大规模中英文地球科学相关语料进行增量预训练,并使用了多种优化方法。由于地球科学是交叉性非常强的学科,因此其C-Eval、C-MMLU、MMLU分数进一步提高。不仅在专业领域表现出较强的语义理解能力,而且能力泛化到通用领域。C-Eval榜单显示,其中文能力仅次于Chatglm2-6B。模型包括base和instruct两个版本。

    如果大家需要选用强大的中文Mistral,推荐选JiuZhou。

    从头训练的中文模型

    • Qwen系列
    • Chatglm系列
    • Baichuan系列
    • Yi系列

    后面持续更新

  • 相关阅读:
    Python基础语法速成1
    CenterNet目标检测【详解】
    Ruby线程安全秘籍:深入探索并发编程的隐秘角落
    go语法入门1
    NetMvc通过亚马逊方式服务器端和客户端上传MinIO顺利解决
    HJ46 截取字符串
    进程的状态
    微信小程序_20,使用第三方npm包
    aop 阶段性概况
    【论文阅读】基于隐蔽带宽的汽车控制网络鲁棒认证(一)
  • 原文地址:https://blog.csdn.net/weixin_44612221/article/details/137276660