Skip to content

lonePatient/awesome-pretrained-chinese-nlp-models

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 
 
 
 
 
 
 

Repository files navigation

Awesome Pretrained Chinese NLP ModelsAwesome

在自然语言处理领域中,预训练语言模型(Pretrained Language Models)已成为非常重要的基础技术,本仓库主要收集目前网上公开的一些高质量中文预训练模型、中文多模态模型、中文大语言模型等内容(感谢分享资源的大佬),并将持续更新......

国内下载HuggingFace仓库模型推荐使用HuggingFace镜像地址: https://hf-mirror.com/

Expand Table of Contents

备注

ND: Non-Causal Decoder or Prefix LM

CD: Causal Decoder

ED: Encoder-Decoder

Base-LLM

大规模基础模型:表格中只罗列出参数量大于7B以上模型。

模型 大小 时间 语言 领域 下载 项目地址 机构/个人 架构 文献 备注
DeepSeek-V2-Base A21B/236B 2024-05 中英 通用 🤗HF DeepSeek-V2 deepseek-ai MOE Paper
Llama-3-Base 8/70B 2024-04 多语 通用 🤗HF llama3 Meta Llama CD
Zhinao-Base 7B 2024-04 中英 通用 🤗HF 🤖 / 奇虎科技 CD
XVERSE-MoE A4.2B/25.8B 2024-04 中英 通用 🤗HF XVERSE-MoE-A4.2B 元象科技 CD
SoftTiger-Base 13/70B 2024-04 中英 通用 🤗HF TigerBot TigerResearch CD
HammerLLM 1.4b 2024-04 中英 通用 🤗HF HammerLLM DataHammer
Mengzi3-Base 13B 2024-04 中英 通用 🤗HF Mengzi3 Star Langboat CD
Breeze-Base 7B 2024-02 中英 通用 🤗HF / MediaTek Research
TowerBase 7/13B 2024-02 多语 通用 [🤗HF] / Unbabel CD
Qwen1.5-Base 0.5/1.8/4
7/14/32/72/110B
2024-02 中英 通用 [🤗HF] Qwen1.5Star Qwen / Blog
LongAlign-Base 6/7/13B 2024-02 中英 通用 [🤗HF] LongAlignStar THUDM / Paper
Chinese-Mixtral-Base 8x7B 2024-02 中英 通用 [Baidu] [🤗HF] Chinese-MixtralStar Yiming Cui MOE
iFlytekSpark-Base 13B 2024-01 中英 通用 mindspore / 科大讯飞 CD
Orion-Base 14B 2024-01 多语 通用 [🤗HF] OrionStar OrionStarAI CD Paper RAG
Plugin
YaYi2-Base 30B 2023-12 多语 通用 [🤗HF] YAYI2Star wenge-research CD Paper
Aquila2-Base 7/34/70B 2023-12 中英 通用 [🤗HF] Aquila2 Star FlagAI CD
Alaya-Base 7B 2023-12 中英 通用 [🤗HF] AlayaStar DataCanvas CD
Qwen-Base 1.8/7
14/72B
2023-12 中英 通用 [🤗HF] Qwen Star 阿里云 CD Paper Report Report2
DeepSeek-Base 7/67B 2023-11 中英 通用 [🤗HF] DeepSeek-LLMStar deepseek-ai CD
Yuan-2.0 2/51
102B
2023-11 中英 通用 baidu [🤗HF] Yuan-2.0Star IEIT-Yuan CD
Alaya-Base 7B 2023-11 中英 通用 [🤗HF] AlayaStar DataCanvasIO CD
Yi-Base 6/9/34B 2023-11 中英 通用 [🤗HF] YiStar 01.AI CD
XVERSE-Base 7/13
65B
2023-11 多语 通用 [🤗HF] XVERSEStar 元象科技 CD
Nanbeige-Base 16B 2023-11 中英 通用 [🤗HF] NanbeigeStar Nanbeige LLM Lab CD
LingoWhale 8B 2023-11 中英 通用 [🤗HF] LingoWhale-8BStar DeepLang AI CD
Skywork-base 13B 2023-10 中文 通用 [🤗HF] Skywork Star SkyworkAI CD Paper
BlueLM-Base 7B 2023-11 中英 通用 [🤗HF] BlueLMStar vivo AI Lab CD
Chatglm3-base 6B 2023-10 中英 通用 [🤗HF] ChatGLM3Star THUDM ND
Ziya2-Base 13B 2023-10 中英 通用 [🤗HF] Fengshenbang-LM Star IDEA研究院 CD
OpenBA-LM 15B 2023-09 中英 通用 [🤗HF] OpenBAStar OpenNLG Group ED Paper
TigerBot-Base-70B 80B 2023-09 多语 通用 [🤗HF] TigerBotStar 虎博科技 CD Paper
FLM 101B 2023-09 中英 通用 [🤗HF] / CofeAI CD
falcon 7/40
180B
2023-09 多语 通用 [🤗HF] / Technology Innovation Institute CD
Baichuan2 7/13B 2023-09 中文 通用 [🤗HF] Baichuan2Star 百川智能 CD
Chinese-LLaMA-2-16K 7/13B 2023-08 中英 通用 [🤗HF] Chinese-LLaMA-Alpaca-2 Star Yiming Cui CD
YuLan-LLaMA-2 13B 2023-08 中英 通用 [🤗HF] YuLan-Chat Star 中国人民大学 CD
Aquila-Base-33B 33B 2023-08 中英 通用 TODO AquilaStar FlagAI CD
TigerBot-Base-13B 13B 2023-08 多语 通用 [🤗HF] TigerBotStar 虎博科技 CD
Linly-Chinese-LLaMA-2 7/13B 2023-07 中英 通用 [🤗HF] Linly Star 深圳大学计算机视觉研究所 CD
Chinese-LLaMA-2 7B 2023-07 中英 通用 [🤗HF] Chinese-LLaMA-Alpaca-2Star Yiming Cui CD
Jiang-base 13B 2023-07 中文 通用 [🤗HF] / 知未智能 CD
bwx 7/13B 2023-07 中文 通用 [🤗HF] / 蓝鲸国数 CD
Llama2 7/13
70B
2023-07 多语 通用 [🤗HF] llamaStar Meta CD Paper
PolyLM 13B 2023-07 多语 通用 [🤗HF] PolyLM 达摩院 CD Paper
Baichuan-13B 13B 2023-07 中文 通用 [🤗HF] Baichuan-13BStar 百川智能 CD
TigerBot 7B 2023-07 多语 通用 [🤗HF] TigerBotStar 虎博科技 CD
InternLM-base 7/20B 2023-07 中文 通用 [🤗HF] InternLMStar 上海人工智能实验室 CD report
MPT 7/30B 2023-06 多语 通用 [🤗HF] llm-foundryStar MosaicML CD
Baichuan 7B 2023-06 中英 通用 [🤗HF] baichuan-7BStar 百川智能 CD
Chinese-Falcon 7B 2023-06 中英 通用 [🤗HF] LinlyStar 深圳大学计算机视觉研究所 CD Blog
AtomGPT 13B 2023-06 中英 通用 [🤗HF] / 原子回声 CD
Aquila 7B 2023-06 中英 通用 [🤗HF] AquilaStar FlagAI CD
Chinese-LLaMA 33B 2023-06 中英 通用 [🤗HF] Chinese-LLaMA-AlpacaStar Yiming Cui CD
TigerBot 7B 2023-06 多语 通用 [🤗HF] TigerBotStar 虎博科技 CD
Panda-OpenLLaMA 7B 2023-05 中英 通用 [🤗HF] pandallmStar dandelionsllm CD
Panda 7/13B 2023-05 中英 通用 [🤗HF] pandallmStar dandelionsllm CD
OpenLLaMA 13B 2023-05 中英 通用 [🤗HF] LinlyStar 深圳大学计算机视觉研究所 CD
BiLLa-LLM 7B 2023-05 中英 通用 [🤗HF] BiLLaStar Zhongli Li CD
Ziya-LLaMA-Reward 7B 2023-05 中英 通用 [🤗HF] Fengshenbang-LMStar IDEA研究院 CD
YuYan 11B 2023-04 中文 通用 [🤗HF] / 网易伏羲 CD Paper
Chinese-LLaMA 7/13/33B 2023-04 中文 通用 [🤗HF] LinlyStar 深圳大学计算机视觉研究所 CD Blog
OpenChineseLLaMA 7B 2023-04 中英 通用 [🤗HF] OpenChineseLLaMAStar OpenLMLab CD
MOSS-003 16B 2023-04 中英 通用 [🤗HF] MOSSStar 复旦大学 CD
BBT-2-Text 13B 2023-04 中文 通用 申请 BBT-FinCUGE-ApplicationsStar 超对称 CD Paper
BBT-2-Text 12B 2023-04 中文 通用 申请 BBT-FinCUGE-ApplicationsStar 超对称 CD Paper
Chinese-LLaMA 13B 2023-04 中英 通用 [🤗HF] Chinese-LLaMA-AlpacaStar Yiming Cui CD
flan-ul2 20B 2023-03 多语 通用 [🤗HF] ul2 Google ED Paper
CPM-Bee 10B 2023-01 中英 通用 [🤗HF] CPM-BeeStar OpenBMB CD
BLOOM 176B 2022-11 多语 通用 [🤗HF] Megatron-DeepSpeed Star BigScience CD Paper
BLOOMZ 176B 2022-11 多语 通用 [🤗HF] Megatron-DeepSpeed Star BigScience CD Paper
flan-t5-xxl 11B 2022-11 多语 通用 [🤗HF] t5x Star Google ED paper
CPM-Ant+ 10B 2022-10 中英 通用 BMB CPM-Live Star OpenBMB CD blog
GLM 130B 2022-10 中英 通用 申请 GLM-130BStar 清华大学 ND paper
CPM-Ant 10B 2022-09 中文 通用 [🤗HF] CPM-Live Star OpenBMB CD blog
GLM 10B 2022-09 中文 通用 [🤗HF] GLM Star 清华大学 ND paper
源1.0 245B 2021-09 中文 通用 API Yian-1.0 Star 浪潮 CD paper
CPM-2 10/11/
200B
2021-06 中文 通用 申请 CPMStar 智源研究院 ED paper
PanGu-Alpha 13/200B 2021-05 中文 通用 [🤗HF] PanGu-Alpha 鹏城实验室 CD paper
PLUG 27B 2021-04 中文 通用 申请 AliceMind 阿里巴巴 ED
GPT-3 13/30B 2021-04 中文 通用 TODO GPT-3 达摩院 CD

[Back to Top]

Domain-Base-LLM

各个垂直领域开源基础模型

模型 大小 时间 语言 领域 下载 项目地址 机构/个人 架构 文献 备注
Tongyi-Finance-Base 14B 2023-11 中文 金融 ModelScope 通义金融-14B 通义金融大模型 CD
ChiMed-GPT 13B 2023-10 中文 医疗 [🤗HF] ChiMed-GPT 中国科学技术大学 CD Paper
CodeShell-base 7B 2023-10 中英 代码 [🤗HF] codeshellStar WisdomShell CD
WiNGPT-base 7B 2023-09 中文 医学 [🤗HF] WiNGPT2Star Winning Health AI Research CD
XuanYuan 70B 2023-09 中文 金融 [🤗HF] XuanYuan Star 度小满 CD Report
CodeLLAma 7/13/
34B
2023-08 多语 代码 [🤗HF] codellamaStar Meta Research CD Paper
educhat-base-002 7/13B 2023-06 中英 教育 [🤗HF] EduChatStar 华东师范大学 CD
AquilaCode-NV 7B 2023-06 中英 代码 [🤗HF] AquilaStar FlagAI CD
AquilaCode-TS 7B 2023-06 中英 代码 [🤗HF] AquilaStar FlagAI CD
LaWGPT 7B 2023-05 中英 法律 [🤗HF] LawGPTStar Pengxiao Song CD
CodeGeeX 13B 2022-06 多语 代码 申请 CodeGeeX 清华大学 CD blog

[Back to Top]

ChatLLM

具备问答和对话等功能的大型语言模型。

模型 大小 时间 语言 领域 下载 项目地址 机构/个人 架构 文献
DeepSeek-V2-Chat A21B/236B 2024-05 中英 通用 🤗HF DeepSeek-V2 deepseek-ai MOE Paper
XVERSE-MoE A4.2B/25.8B 2024-05 中英 通用 🤗HF XVERSE-MoE-A4.2B xverse-ai MOE
Llama3-zh 8/70B 2024-04 中英 通用 🤗HF / / CD llama3中文列表
Llama3-Chinese-Chat 8B 2024-04 中英 通用 🤗HF / Shenzhi Wang CD
Llama-3-Chat 8/70B 2024-04 多语 通用 🤗HF llama3 Meta Llama CD
Zhinao-Chat 7B 2024-04 中英 通用 🤗HF 🤖 / 奇虎科技 CD
MiniCPM-MoE 8x2B 2024-04 中英 通用 🤗HF MiniCPM OpenBMB MoE
Nanbeige2-Chat 8B 2024-04 中英 通用 🤗HF Nanbeige Nanbeige LLM Lab CD
Sailor 7B 2024-04 多语 通用 🤗HF sailor-llm Sea AI Lab CD Paper
Mengzi3-Chat 13B 2024-04 中英 通用 🤗HF Mengzi3 Star Langboat CD
Qwen-MoE 2.7B 2024-03 中英 通用 🤗HF Qwen1.5 Star Qwen MoE Blog
Command-R 35B 2024-03 多语 通用 🤗HF / CohereForAI CD
Breeze-Instruct 7B 2024-02 中英 通用 🤗HF / MediaTek Research
aya-101 13B 2024-02 多语 通用 🤗HF / Cohere For AI CD Paper
ChemLLM 7B 2024-02 多语 通用 🤗HF / AI4Chem CD Paper
TowerInstruct 7/13B 2024-02 多语 通用 [🤗HF] / Unbabel CD
Qwen1.5-Chat 0.5/1.8/4/
7/14/32/72/110B
2024-02 中英 通用 [🤗HF] Qwen1.5Star Qwen / Blog
MiniCPM 2B 2024-02 中英 通用 [🤗HF] ModelScope MiniCPMStar OpenBMB / Report
LongAlign-Chat 6/7/13B 2024-02 中英 通用 [🤗HF] LongAlignStar THUDM / Paper
Chinese-Mixtral-Chat 8x7B 2024-02 中英 通用 [Baidu] [🤗HF] Chinese-MixtralStar Yiming Cui MOE
iFlytekSpark-Chat 13B 2024-01 中英 通用 mindspore / 科大讯飞 CD
rwkv-5-world 0.1/1/
3/7B
2023-01 多语 通用 [🤗HF] RWKV-LMStar BlinkDL URL
Orion-Chat 14B 2024-01 多语 通用 [🤗HF] OrionStar OrionStarAI CD Paper
internlm2-chat 7/20B 2024-01 中英 通用 [🤗HF] InternLMStar InternLM CD Report
Chinese-Mixtral 8x7B 2023-01 中英 通用 [🤗HF] / HIT-SCIR CD-MOE
Telechat 7/12B 2024-01 中英 通用 [🤗HF] Telechatx Star Tele-AI CD Report
kagentlms 7/13B 2024-01 中英 通用 [🤗HF] KwaiAgentsStar KwaiKEG
YaYi2-Chat 30B 2023-12 多语 通用 [🤗HF] YAYI2Star wenge-research CD Paper
SUS-Chat 34/72B 2023-12 中英 通用 [🤗HF] SUS-ChatStar SUSTech-IDEA CD
Aquila2-Chat 7/34/70B 2023-12 中英 通用 [🤗HF] Aquila2 Star FlagAI CD
Alaya-Chat 7B 2023-12 中英 通用 [🤗HF] AlayaStar DataCanvas CD
Qwen-Chat 1.8/7/
14/72B
2023-12 中英 通用 [🤗HF] Qwen Star 阿里云 CD Paper Report Report2
DeepSeek-Chat 7/67B 2023-11 中英 通用 [🤗HF] DeepSeek-LLMStar deepseek-ai CD
Yi-Chat 6/34B 2023-11 中英 通用 [🤗HF] Yi Star 01.AI CD
Alaya-Chat 7B 2023-11 中英 通用 [🤗HF] AlayaStar DataCanvasIO CD
OrionStar-Yi-Chat 34B 2023-11 中英 通用 [🤗HF] OrionStar-Yi-34B-ChatStar OrionStarAI CD
Nanbeige-Chat 16B 2023-11 中英 通用 [🤗HF] NanbeigeStar Nanbeige LLM Lab CD
OpenChat 3.5 7B 2023-11 中英 通用 [🤗HF] openchat OpenChat CD Paper
XVERSE-Chat 7/13B 2023-11 多语 通用 [🤗HF] XVERSEStar 元象科技 CD
AndesGPT 7B 2023-11 中文 通用 [🤗HF] AndesGPT-7B OPPO-Mente-Lab CD
SeaLLM-Chat 13B 2023-11 多语 通用 [🤗HF] SeaLLMs SeaLLMs CD
BlueLM 7B 2023-11 中英 通用 [🤗HF] BlueLMStar vivo AI Lab CD
Skywork-chat 13B 2023-10 中文 通用 [🤗HF] Skywork SkyworkAI CD Paper
Zephyr 7B 2023-10 多语 通用 [🤗HF] alignment-handbookStar Hugging Face H4 CD Paper
Mistral 7B 2023-10 多语 通用 [🤗HF] mistral-srcStar Mistral AI CD Paper
chatglm3 6B 2023-10 中英 通用 [🤗HF] ChatGLM3Star THUDM ND
Zhiyin-chat 7B 2023-10 中英 通用 [🤗HF] ZhiyinStar 中科院声学所 CD
Ziya2-Chat 13B 2023-10 中英 通用 [🤗HF] Fengshenbang-LM IDEA研究院 CD
Vulture 40/180B 2023-10 多语 通用 [🤗HF] / VILM-AI TODO
Vulture 3/7/
40/180B
2023-09 多语 通用 [🤗HF] / VILM CD
Colossal-LLaMA-2 7B 2023-09 中英 通用 [🤗HF] ColossalAIStar HPC-AI Tech CD Blog
OpenBA-chat 15B 2023-09 中英 通用 TODO OpenBAStar OpenNLG Group ED Paper
WeMix-LLaMA2 7/70B 2023-09 中英 通用 [🤗HF] WeMix-LLMStar Alpha-VLLM CD
Stable Beluga 7/13/70B 2023-09 中英 通用 [🤗HF] / Stability AI CD
TigerBot-chat 70B 2023-09 中英 通用 [🤗HF] TigerBot Star 虎博科技 CD Paper
Openbuddy_llama 70B 2023-09 多语 通用 [🤗HF] OpenBuddyStar OpenBuddy CD
falcon-180B-chat 180B 2023-09 多语 通用 [🤗HF] / Technology Innovation Institute CD
Baichuan2 7/13B 2023-09 中文 通用 [🤗HF] Baichuan2Star 百川智能 CD
Chinese-Alpaca-2-16K 7/13B 2023-09 中英 通用 [🤗HF] Chinese-LLaMA-Alpaca-2 Yiming Cui CD
InternLM-Chat-8k 7B 2023-08 中文 通用 [🤗HF] InternLMStar 上海人工智能实验室 CD report
InternLM-Chat-v1.1 7B 2023-08 中文 通用 [🤗HF] InternLMStar 上海人工智能实验室 CD report
YuLan-Chat-2 13B 2023-08 中英 通用 [🤗HF] YuLan-Chat 中国人民大学 CD
falcon 7/40B 2023-06 多语 通用 [🤗HF] [🤗HF] Technology Innovation Institute CD
Toucan 7B 2023-08 中英 通用 [🤗HF] Toucan-LLMStar Kendryte CD
Zhuzhi 6B 2023-08 中英 通用 [🤗HF] Zhuzhi-6BStar 竹间智能 ND
Atom 7B 2023-08 中英 通用 [🤗HF] Llama2-ChineseStar FlagAlpha CD
openbuddy 3/7/
13/40B
2023-08 多语 通用 [🤗HF] OpenBuddyStar OpenBuddy CD
Aquila-Chat-33B 33B 2023-08 中英 通用 TODO AquilaStar FlagAI CD
vicuna-V1.5-16K 7/13B 2023-08 多语 通用 [🤗HF] FastChatStar lm-sys CD Paper
vicuna-V1.5 7/13B 2023-08 多语 通用 [🤗HF] FastChatStar lm-sys CD Paper
Chinese-Alpaca-2 13B 2023-08 中英 通用 [🤗HF] Chinese-LLaMA-Alpaca-2 Yiming Cui CD
WizardLM-V1.0 70B 2023-08 多语 通用 [🤗HF] WizardLMStar operatorx CD
TigerBot-chat-13B 13B 2023-07 中英 通用 [🤗HF] TigerBotStar 虎博科技 CD
huozi 7B 2023-08 中英 通用 [🤗HF] huoziStar 哈工大 CD
Chinese-Alpaca-2 7B 2023-07 中英 通用 [🤗HF] Chinese-LLaMA-Alpaca-2Star Yiming Cui CD
AntX 7/13B 2023-07 中文 通用 [🤗HF] / AntX.ai CD
BatGPT 15B 2023-07 中英 通用 [🤗HF] BatGPTStar 上海交通大学 ND Paper
WizardLM-V1.2 13B 2023-07 多语 通用 [🤗HF] WizardLMStar operatorx CD Paper
llama2-Chinese-chat 13B 2023-07 中英 通用 [🤗HF] llama2-Chinese-chatStar Ke Bai CD
Jiang-chat 13B 2023-07 中文 通用 [🤗HF] / 知未智能 CD
Llama2-chinese-chat 7/13B 2023-07 中英 通用 [🤗HF] Llama2-ChineseStar FlagAlpha CD
LL7M 7B 2023-07 多语 通用 [🤗HF] / Joseph Cheung CD
Chinese-Llama-2 7B 2023-07 中英 通用 [🤗HF] Chinese-Llama-2-7bStar LinkSoul-AI CD
Llama2-chat 7/13/70B 2023-07 多语 通用 [🤗HF] llamaStar Meta CD Paper
PolyLM-chat 13B 2023-07 多语 通用 [🤗HF] PolyLM 达摩院 CD Paper
Baichuan-13B-chat 13B 2023-07 中文 通用 [🤗HF] Baichuan-13BStar 百川智能 CD
vicuna-V1.3 7/13/33B 2023-07 多语 通用 [🤗HF] FastChatStar lm-sys CD Paper
WizardLM-V1.0 7/13/30B 2023-07 多语 通用 [🤗HF] WizardLMStar operatorx CD Paper
TigerBot-v2-sft 7B 2023-07 多语 通用 [🤗HF] TigerBotStar 虎博科技 CD
InternLM-chat 7/20B 2023-07 中文 通用 [🤗HF] InternLMStar 上海人工智能实验室 CD report
vicuna汉化版 33B 2023-07 中文 通用 baidu-hiks chinese-StableVicunaStar ziwang-com CD
CuteGPT 13B 2023-07 中英 通用 [🤗HF] CuteGPTStar 复旦大学知识工场 CD
MPT-chat 7/30B 2023-06 多语 通用 [🤗HF] llm-foundryStar MosaicML CD
ChatGLM2 6B 2023-06 中英 通用 [🤗HF] ChatGLM2-6BStar 清华大学 ND
BayLing 7/13B 2023-06 中英 通用 [🤗HF] BayLingStar 中国科学院 CD
ZhiXi-Diff 13B 2023-06 中英 通用 [🤗HF] KnowLLMStar 浙江大学 CD
Anima 33B 2023-06 中文 通用 [🤗HF] AnimaStar Gavin Li CD
OpenLLaMA-Chinese 3/7/13B 2023-06 中文 通用 [🤗HF] OpenLLaMA-ChineseStar FittenTech CD
openbuddy-falcon-7b-v1.5 7B 2023-06 多语 通用 [🤗HF] OpenBuddyStar OpenBuddy CD
AtomGPT_chat 13B 2023-06 中英 通用 [🤗HF] AtomGPTStar 原子回声 CD
AquilaChat 7B 2023-06 中英 通用 [🤗HF] AquilaStar FlagAI CD
YuLan-Chat 13/65B 2023-06 中英 通用 [🤗HF] YuLan-ChatStar 中国人民大学 CD
Chinese-Alpaca 33B 2023-06 中文 通用 [🤗HF] Chinese-LLaMA-AlpacaStar Yiming Cui CD
TigerBot-sft 7/180B 2023-06 多语 通用 [🤗HF] TigerBotStar 虎博科技 CD
ChatYuan 7B 2023-06 中英 通用 [🤗HF] ChatYuan-7BStar ClueAI CD
Panda-Instruct 13B 2023-05 中英 通用 [🤗HF] pandallmStar dandelionsllm CD
Panda-Instruct 7B 2023-05 中英 通用 [🤗HF] pandallmStar dandelionsllm CD
BiLLa-SFT 7B 2023-05 中英 通用 [🤗HF] BiLLaStar Zhongli Li CD
Ziya-LLaMA-v1 13B 2023-05 中英 通用 [🤗HF] Fengshenbang-LMStar IDEA研究院 CD Blog
BLOOMChat V1.0 176B 2023-05 多语 通用 [🤗HF] bloomchat SambaNova Systems CD Blog
BiLLa 7B 2023-05 中英 通用 [🤗HF] BiLLaStar Zhongli Li CD
Bactrian-X 7/13B 2023-05 多语 通用 [🤗HF] bactrian-xStar MBZUAI CD
Bactrian-ZH 7B 2023-05 中文 通用 [🤗HF] bactrian-xStar MBZUAI CD
ChatFlow 7/13B 2023-05 中英 通用 [🤗HF] LinlyStar 深圳大学计算机视觉研究所 CD
OpenBuddy 7/13B 2023-05 多语 通用 [🤗HF] OpenBuddyStar OpenBuddy CD
YuYan-dialogue 11B 2023-04 中文 通用 [🤗HF] / 网易伏羲 CD paper
Moss-moon-003-sft-plugin 16B 2023-04 中英 通用 [🤗HF] MOSSStar 复旦大学 CD
moss-moon-003-sft 16B 2023-04 中英 通用 [🤗HF] MOSSStar 复旦大学 CD
RWKV-4-Raven 3/7/14B 2023-04 中英 通用 [🤗HF] ChatRWKVStar BlinkDL RNN Blog
Phoenix-inst-chat 7B 2023-04 中文 通用 [🤗HF] LLMZooStar 香港中文大学 CD
Phoenix-chat 7B 2023-04 中文 通用 [🤗HF] LLMZooStar 香港中文大学 CD
ChatPLUG 3.7B 2023-04 中文 通用 [🤗HF] ChatPLUGStar 阿里巴巴 ED Paper
Chinese-Alpaca 13B 2023-04 中文 通用 [🤗HF] Chinese-LLaMA-AlpacaStar Yiming Cui CD
BELLE-LLAMA 13B 2023-04 中文 通用 [🤗HF] BELLEStar 贝壳 CD
LLaMA-tuned 7/13/
33/65B
2023-04 中文 通用 [🤗HF] LMFlowStar 香港科技大学 CD
Chinese-Vicuna 7/13B 2023-03 中文 通用 [🤗HF] Chinese-VicunaStar Facico CD
ChatYuan-V2 0.7B 2023-03 中英 通用 [🤗HF] ChatYuanStar 元语智能 ED
Chinese-Alpaca 7B 2023-03 中文 通用 [🤗HF] Chinese-LLaMA-AlpacaStar Yiming Cui CD
Luotuo 7B 2023-03 中文 通用 [🤗HF] Chinese-alpaca-lora 华中师范大学 CD
BELLE-LLAMA 7B 2023-03 中英 通用 [🤗HF] BELLEStar 贝壳 CD
ChatGLM 6B 2023-03 中英 通用 [🤗HF] ChatGLM-6BStar 清华大学 ND

[Back to Top]

Domain-ChatLLM

开源的垂直领域对话大模型

模型 大小 时间 语言 领域 下载 项目地址 机构/个人 架构 文献
CodeQwen1.5-Chat 7B 2024-04 中英 代码 🤗HF Qwen1.5 Qwen CD Blog
codegemma 2/7B 2024-04 多语 代码 🤗HF / Google
WaveCoder 6.7B 2024-04 多语 代码 🤗HF WaveCoder microsoft Paper
ChemDFM 13B 2024-03 中英 化学 🤗HF / OpenDFM CD Paper
starcoder2 3/7/15B 2024-02 中英 代码 🤗HF starcoder2 bigcode-project CD Paper
TuringMM-Chat 34B 2024-02 中英 教育 🤗HuggingFace 🤖ModelScope / 光年无限 CD
deepseek-moe 16B 2024-01 中英 代码 [🤗HF] DeepSeekMoEStar DeepSeek CD-MOE
Code Millenials 1/3/
13/34B
2023-01 多语 代码 [🤗HF] code-millenialsStar BudEcosystem CD
WizardCoder 15/33B 2024-01 多语 代码 [🤗HF] WizardLMStar operatorx CD Paper
DeepSeek-Coder 1/7/33B 2023-11 中英 代码 [🤗HF] DeepSeek-CoderStar deepseek-ai Blog
Phind 34B 2023-10 多语 代码 [🤗HF] / Phind CD Blog zh
Tongyi-Finance-Chat 14B 2023-11 中文 金融 ModelScope 通义金融-14B-Chat 通义金融大模型 CD
Skywork-math 13B 2023-10 中文 数学 [🤗HF] SkyworkStar SkyworkAI CD Paper
XuanYuan-Chat 70B 2023-10 中英 金融 [🤗HF] XuanYuanStar Duxiaoman度小满 CD
zhilu 13B 2023-10 中英 金融 [🤗HF] / SYSU-MUCFC-FinTech-Research-Center CD
TestGPT 7B 2023-10 中文 测试 [🤗HF] Test-AgentStar codefuse-ai CD
cross 7/13B 2023-10 多语 数学 [🤗HF] / Mathoctopus CD
CodeFuse 13/14/
15/34B
2023-10 中文 代码 [🤗HF] MFTCoderStar codefuse-ai CD
Taiyi 7B 2023-10 中英 医学 [🤗HF] Taiyi-LLMStar DUTIR-BioNLP CD
CodeShell-chat 7B 2023-10 中英 代码 [🤗HF] codeshellStar WisdomShell CD
DISC-LawLLM 13B 2023-09 中文 法律 [🤗HF] / ShengbinYue CD Report
WiNGPT-chat 7B 2023-09 中文 医学 [🤗HF] WiNGPT2Star Winning Health AI Research CD
ziya-coding 15/34B 2023-09 中英 代码 [🤗HF] Fengshenbang-LM IDEA研究院 CD
AgriGPT 6/13b 2023-09 中文 农业 [🤗HF] AgriGPTsStar AgriGPTs
XuanYuan-chat 70B 2023-09 中文 金融 TODO XuanYuan 度小满 CD Report
夫子•明察 6B 2023-09 中文 司法 [🤗HF] fuzi.mingchaStar 山东大学 ND
仲景 13B 2023-09 中文 医学 [🤗HF] ZhongjingStar Songhua Yang CD Paper
CodeFuse 13/34B 2023-09 中英 代码 [🤗HF] MFTCoderStar codefuse-ai CD
EcomGPT 7B 2023-09 中英 电商 TODO EcomGPTStar Alibaba
DISC-MedLLM 13B 2023-08 中文 医疗 [🤗HF] DISC-MedLLMStar FudanDISC CD Paper
K2 7B 2023-08 中英 科学 [🤗HF] k2Star daven CD
CodeLLAma 7/13/34B 2023-08 多语 代码 [🤗HF] codellamaStar Meta Research CD Paper
sqlcoder 15B 2023-08 中英 代码 [🤗HF] sqlcoderStar Defog.ai CD
智海-录问 7B 2023-08 中文 法律 [🤗HF] wisdomInterrogatoryStar zhihaiLLM CD
WizardMath-V1.0 7/13/70B 2023-08 多语 数学 [🤗HF] WizardLMStar operatorx CD
QiaoBan 7B 2023-08 中文 情感 [🤗HF] QiaoBenStar 哈尔滨工业大学
HuangDi 13B 2023-08 中文 中医 [🤗HF] HuangDIStar Zlasejd CD
ZhongJing 2023-08 中文 中医 TODO CMLM-ZhongJingStar 复旦大学
TCMLLM 6B 2023-08 中文 中医 [🤗HF] TCMLLMStar 2020MEAI ND
AutoAudit 7B 2023-07 中文 安全 [🤗HF] AutoAuditStar Jiaying Li CD
Lychee 10B 2023-07 中文 法律 [🤗HF] lychee_lawStar davidpig ND
IvyGPT 6B 2023-07 中文 医学 [🤗HF] IvyGPTStar WangRongsheng
MING 7B 2023-07 中文 医学 [🤗HF] MINGStar 上海交通大学 CD
Mozi 7B 2023-07 中英 科技 [🤗HF] science-llmStar GMFTBY CD
StarGLM 6B 2023-07 中文 天文 [🤗HF] StarGLMStar LI YUYANG ND
TransGPT 7B 2023-07 中英 交通 [🤗HF] TransGPTStar 北京交通大学 CD
CodeGeeX2 6B 2023-07 中英 代码 [🤗HF] CodeGeeX2Star 清华大学 ND
Yayi-llama2 7/13B 2023-07 中英 舆情 [🤗HF] YayiStar 中科闻歌 CD
Ziya-Writing 13B 2023-07 中英 写作 [🤗HF] Fengshenbang-LM IDEA研究院 CD
MindChat 13B 2023-07 中文 心理 [🤗HF] MindChatStar 华东理工大学 CD
ShenNong-TCM-LLM 7B 2023-07 中英 医学 [🤗HF] ShenNong-TCM-LLMStar michael-wzhu CD
ailawyer 13B 2023-07 中英 法律 [🤗HF] JurisLMsStar openkg CD
educhat 7B/13B 2023-06 中英 教育 [🤗HF] EduChatStar 华东师范大学 CD
Sunsimiao 7B 2023-06 中英 医学 [🤗HF] SunsimiaoStar 华东理工大学 CD
Media LLaMA 7B 2023-06 中文 媒体 baidu Media-LLaMAStar 智媒开源研究院 CD
PULSE 7/14B 2023-06 中文 医学 [🤗HF] PULSEStar OpenMEDLab CD
ChatLaw 13/33B 2023-06 中文 法律 [🤗HF] ChatLawStar 北京大学 CD
BaoLuo 6B 2023-06 中文 法律 [🤗HF] BaoLuo-LawAssisantStar LeiZi ND
CoLLaMA 7B 2023-06 中英 代码 [🤗HF] CoLLaMAStar Denilah CD
TechGPT 7B 2023-06 中英 教育 [🤗HF] TechGPTStar 东北大学 CD
Yayi 7B 2023-06 中英 舆情 [🤗HF] YayiStar 中科闻歌 CD
MeChat 6B 2023-06 中文 医学 [🤗HF] smileStar qiuhuachuan ND
ziya-medical 13b 2023-06 中英 医学 [🤗HF] MedicalGPTStar Ming Xu CD
Taoli 7B 2023-06 中英 教育 待开源 taoliStar 北京语言大学 CD
Lawyer-llama 13B 2023-06 中英 法律 [🤗HF] lawyer-llamaStar Quzhe Huang CD
QiZhen-CaMA 13B 2023-06 中英 医学 [🤗HF] QiZhenGPTStar 浙江大学 CD
扁鹊-2.0 6B 2023-06 中文 医学 [🤗HF] BianQueStar 华南理工大学 ND
SoulChat 6B 2023-06 中文 心理 [🤗HF] SoulChatStar 华南理工大学 ND
HanFei 7B 2023-05 中文 法律 baidu-d6t5 HanFeiStar 中国科学院深圳先进院 CD
QiZhen 6B 2023-05 中英 医学 [baidu] QiZhenGPTStar 浙江大学 CD
ChatMed-Consult 7B 2023-05 中英 医学 [🤗HF] ChatMedStar michael-wzhu CD
LaWGPT-beta1.1 7B 2023-05 中英 法律 [🤗HF] LawGPTStar Pengxiao Song CD
Cornucopia 7B 2023-05 中英 金融 [🤗HF] Cornucopia-LLaMA-Fin-ChineseStar yuyangmu CD
HuatuoGPT 7B 2023-05 中文 医学 [🤗HF] HuatuoGPT 香港中文大学 CD Paper
LexiLaw 6B 2023-05 中文 法律 [🤗HF] LexiLaw Haitao Li ND Paper
XuanYuan 176B 2023-05 中文 金融 申请 XuanYuanStar 度小满 CD Paper
LawGPT 6B 2023-05 中文 法律 [🤗HF] LAW-GPTStar hongchengliu N
扁鹊-1.0 0.7B 2023-04 中文 医学 [🤗HF] BianQue scutcyr ED
ChatGLM-Med 6B 2023-04 中文 医学 [🤗HF] Med-ChatGLMStar 哈尔滨工业大学 ED
BenTsao 7B 2023-04 中文 医学 [🤗HF] Huatuo-Llama-Med-ChineseStar 哈尔滨工业大学 CD
DoctorGLM 6B 2023-04 中文 医学 TODO DoctorGLMStar xionghonglin ND
Firefly 1/2/7B 2023-04 中文 文化 [🤗HF] FireflyStar Yang JianXin CD
ChatRWKV 7B 2023-01 中英 小说 [🤗HF] ChatRWKVStar BlinkDL RNN Blog

[Back to Top]

MultiModal-ChatLLM

收集包含中文的多模态大模型,具备对话等功能。

模型 大小 时间 语言模型 非语言模型 语言 领域 下载 项目地址 机构/个人 文献
XVERSE-V 13B 2024-05 XVERSE-13B-Chat clip-vit-large-patch14-224 中英 文图 🤖 XVERSE-V-13B xverse-ai
MiniCPM-V 2.0 2.8B 2024-04 MiniCPM-2.4B SigLip-400M 中英 文图 🤗 🤖 MiniCPM-V OpenBMB Blog
Qwen-Audio 7B 2024-03 Qwen-7B Whisper-large-v2 中英 文音 🤗HF Qwen-Audio Star Qwen Paper
DeepSeek-VL 1.3/7B 2024-03 DeepSeek SigLip/SAM 中英 图文 🤗HF DeepSeek-VLStar deepseek-ai Paper
OmniLMM 3/12B 2024-02 MiniCPM SigLip 中英 图文 🤗HF OmniLMMStar [OpenBMB](https://github.com/01-ai)
MiniCPM-V 3B 2024-02 MiniCPM-2.4B SigLip-400M 中英 图文 🤗HF OmniLMMStar [OpenBMB](https://github.com/01-ai)
Yi-VL 6/34B 2024-01 Yi CLIP-VIT 中英 图文 [🤗HF] YiStar 01-ai
Lyrics 14B 2023-12 / / 中英 图文 [🤗HF] Fengshenbang-LM IDEA研究院
Qwen-Audio 7B 2023-12 Qwen-7B Whisper-large-v2 中英 文音 [🤗HF] Qwen-AudioStar Qwen Paper
SPHINX 13B 2023-10 / / 中英 图文 [🤗HF] LLaMA2-AccessoryStar Alpha-VLLM
Skywork-MM 13B 2023-10 / / 中英 图文 [🤗HF] Skywork SkyworkAI Paper
CogVLM 7/14B 2023-10 Qwen ViT 中英 图文 [🤗HF] / CausalLM
fuyu 8B 2023-10 / / 中英 图文 [🤗HF] / Adept AI Labs Blog
Ziya-Visual 14B 2023-10 LLaMA InstructBLIP 中英 图文 [🤗HF] Fengshenbang-LMStar IDEA研究院 Paper
CogVLM 17B 2023-10 EVA2-CLIP-E Vicuna-v1.5 中英 图文 TODO CogVLMStar THUDM Paper
idefics 9/80B 2023-10 LLaMA CLIP-ViT 中英 图文 [🤗HF] / HuggingFaceM4 log
InternLM-XComposer 7B 2023-10 InternLM EVA-CLIP 中英 图文 [🤗HF] InternLM-XComposerStar InternLM Report
WeMix-LLM 13B 2023-09 LLama2 / 中英 图文 [🤗HF] WeMix-LLMStar Alpha-VLLM
Vally 7/13B 2023-08 BelleGroup/BELLE-LLaMA-EXT OFA-Sys/chinese-clip-vit-large-patch14 中英 图文 [🤗HF] [🤗HF] ValleyStar 罗瑞璞 Paper
SALMONN / 2023-08 / / 中英 语音 TODO SALMONNStar Bytedance
IDEFICS 9/80B 2023-08 llama CLIP-ViT 中英 图文-通用 [🤗HF] m4-logsStar HuggingFaceM4 Paper
Qwen-VL 7B 2023-08 Qwen-7B Openclip ViT-bigG 中英 通用 [🤗HF] Qwen-VLStar 阿里云
Qwen-VL-chat 7B 2023-08 Qwen-7B Openclip ViT-bigG 中英 通用 [🤗HF] Qwen-VLStar 阿里云
LLasM 7B 2023-07 Chinese-Llama2 whisper-large-v2 中英 语音 [🤗HF] LLaSMStar 北京灵琐
Chinese-LLaVA 7B 2023-07 Chinese-Llama2 Clip-vit 中英 视觉 [🤗HF] Chinese-LLaVAStar 北京灵琐
RemoteGLM 6B 2023-07 VisualGLM-6B VisualGLM-6B 中文 遥感 TODO RemoteGLMStar lzw-lzw
VisualCLA 7B 2023-07 Chinese-Alpaca-Plus CLIP-ViT-L/14 中文 视觉 [🤗HF] Visual-Chinese-LLaMA-AlpacaStar Ziqing Yang
yuren 7B 2023-07 baichuan-7B CLIP 中英 视觉 [🤗HF] yuren-baichuan-7bStar Pleisto
VisCPM-Chat 10B 2023-06 CPM-Bee Q-Former 中英 视觉 [🤗HF] VisCPMStar OpenBMB
VisCPM-Paint 10B 2023-06 CPM-Bee Stable Diffusion 2.1 中英 视觉 [🤗HF] VisCPMStar OpenBMB
XrayPULSE 7B 2023-06 PULSE MedCLIP 中文 医学 [🤗HF] XrayPULSEStar OpenMEDLab
SEEChat 6B 2023-06 ChatGLM CLIP-ViT 中文 / [🤗HF] SEEChatStar 360
Ziya-BLIP2-14B-Visual-v1 14B 2023-06 LLaMA-13B BLIP2 中英 通用 [🤗HF] Fengshenbang-LMStar IDEA研究院
Video-LLaMA-BiLLA 7B 2023-05 BiLLa-7B MiniGPT-4 中英 通用 [🤗HF] Video-LLaMAStar 达摩院多语言NLP Paper
Video-LLaMA-Ziya 13B 2023-05 Ziya-13B MiniGPT-4 中英 通用 [🤗HF] Video-LLaMAStar 达摩院多语言NLP Paper
XrayGLM 6B 2023-05 ChatGLM-6B BLIP2-Qformer 中英 医学 [🤗HF] XrayGLMStar 澳门理工大学
X-LLM 2023-05 ChatGLM ViT-g 中文 / TODO X-LLMStar 中科院自动化所 Paper
VisualGLM 6B 2023-05 ChatGLM-6B BLIP2-Qformer 中英 视觉 [🤗HF] VisualGLM-6BStar 清华大学

[Back to Top]

中文指令数据集

收集包含中文的指令数据集,用于微调语言模型。

名称 大小 时间 语言 下载 项目地址 作者 备注
FinCorpus 50G 2023-09 中文 dataset XuanYuan 度小满 金融领域
TransGPT-sft 346k 2023-07 中文 dataset TransGPT 北京交通大学
TransGPT-pt 58k 2023-07 中文 dataset TransGPT 北京交通大学
ShareGPT-Chinese-English 90K 2023-07 中英 dataset llama2-Chinese-chatStar Ke Bai
educhat-sft-002-data-osm 400w 2023-06 中英 dataset EduChat 华东师范大学 教育
chatgpt-corpus 3M 2023-06 中文 dataset chatgpt-corpus plex
Simle 350k 2023-06 中文 dataset smile qiuhuachuan 心理健康
QiZhen 20k 2023-06 中文 dataset QiZhenGPT 浙江大学 医学
BayLing-80 80 2023-06 中英 dataset BayLing 中国科学院 多轮指令
Tigerbot-dataset 120k 2023-06 中英 dataset TigerBot 虎博科技
lawyer-llama / 2023-05 中文 dataset lawyer-llama Quzhe Huang 法律
Bactrian-X 67K 2023-05 多语 dataset bactrian-x MBZUAI
CrimeKgAssitant 52k 2023-05 中文 dataset LAW-GPT hongchengliu 法律
moss-002-sft-data 1.1M 2023-04 中英 dataset MOSS 复旦大学
moss-003-sft-data 1.1M 2023-04 中英 dataset MOSS 复旦大学
moss-003-sft-plugin-data 300K 2023-04 中英 dataset MOSS 复旦大学
Safety-Prompts 100K 2023-04 中文 dataset Safety-Prompts 清华大学 评测平台
OASST1 / 2023-04 多语 dataset Open-Assistant OpenAssistant
ShareChat 90K 2023-04 中英 dataset ShareChat czhko
GPT-4-LLM 52K 2023-04 中文 dataset GPT-4-LLM Instruction-Tuning-with-GPT-4 paper
COIG 200K 2023-04 中文 dataset FlagInstruct BAAI paper
RedGPT 50k 2023-04 中文 dataset RedGPT MiniGPT
shareGPT_cn 20k 2023-04 中文 dataset shareGPT_cn shareAI
generated_chat_0.4M 0.4M 2023-04 中文 dataset BELLE Ke Technologies 角色对话
multiturn_chat_0.8M 0.8M 2023-04 中文 dataset BELLE Ke Technologies 多轮任务
school_math_0.25M 0.25M 2023-04 中文 dataset BELLE Ke Technologies 数学题
Zhihu-KOL / 2023-03 中文 dataset Zhihu-KOL Rui Wang
InstructionWild 104k 2023-03 中英 dataset InstructionWild Xue Fuzhao
Alpaca-CoT /. 2023-03 中英 dataset Alpaca-CoT Qingyi Si
GuanacoDataset / 2023-03 多语 dataset guanaco-model Guanaco
Traditional-Chinese-alpaca 52K 2023-03 中文 dataset Traditional-Chinese Alpaca NTU NLP Lab gpt翻译
alpaca_chinese_dataset / 2023-03 中文 dataset alpaca_chinese_dataset akou 人工校验
alpaca-chinese-dataset / 2023-03 中文 dataset alpaca-chinese-dataset carbonz 机器翻译
train_2M_CN 2M 2023-03 中文 dataset BELLE Ke Technologies
train_1M_CN 1M 2023-03 中文 dataset BELLE Ke Technologies
train_0.5M_CN 0.5M 2023-03 中文 dataset BELLE Ke Technologies
HC3 人类-ChatGPT 问答 / 2023-03 中文 dataset chatgpt-comparison-detection SimpleAI
firefly-train-1.1M 1.1M 2023-03 中文 dataset Firefly Jianxin Yang

[Back to Top]

Embedding

MTEB排行榜: https://huggingface.co/spaces/mteb/leaderboard 镜像

模型 大小 时间 语言 领域 下载 项目地址 机构/个人
BCE 279M 2024-01 多语 通用 [🤗HF] BCEmbedding netease-youdao
Cohere Base 2023-09 多语 通用 [🤗HF] / Cohere Blog
jina Base 2023-10 中英 通用 [🤗HF] / Jina AI
Dmeta 400MB 2024-02 中文 通用 [🤗HF] / DMetaSoul
bge-m3 2024-02 中文 通用 [🤗HF] / BAAI Paper
tao-8k 2023-11 中文 通用 [🤗HF] amu
bge s/b/l 2023-10 中文 通用 [🤗HF] / BAAI
gte-zh s/b/l 2023-08 中文 通用 [🤗HF] / Alibaba DAMO Paper
m3e s/b/l 2023-06 中文 通用 [🤗HF] / Moka-AI
LaBSE 多语 通用 [🤗HF] / Sentence Transformers

[Back to Top]

大模型评估基准

1. C-Eval Star

C-Eval 是一个全面的中文基础模型评估套件。它包含了13948个多项选择题,涵盖了52个不同的学科和四个难度级别,查看论文了解更多细节。

[官方网站] [Github] [论文]

2. FlagEval Star

FlagEval是一个面向AI基础模型的评测工具包。我们的目标是探索和集合科学、公正、开放的基础模型评测基准、方法及工具,对多领域(如语言、语音、视觉及多模态)的基础模型进行多维度(如准确性、效率、鲁棒性等)的评测。我们希望通过对基础模型的评测,加深对基础模型的理解,促进相关的技术创新及产业应用。

[官方网站] [Github]

3. SuperCLUElyb Star

SuperCLUE琅琊榜,这是一个中文通用大模型对战评价基准,它以众包的方式提供匿名、随机的对战。在本文中,我们发布了初步的结果和基于Elo评级系统的排行榜,Elo评级是国际象棋和其他竞技游戏中广泛使用的评级系统。我们邀请整个社区加入这项工作,贡献新的模型,并通过提问和投票选出你最喜欢的答案来评估它们。

[官方网站] [Github]

4. XiezhiBenchmark Star

该基准包括来自13个不同学科的516个学科的220,000个多项选择题,以及15,000个来自单一学科和多个学科的问题。我们对47个最新的大型语言模型在Xiezhi上进行了评估,结果表明在科学、工程、农学、医学和艺术等领域,大型语言模型的表现超过了人类的平均水平,但在经济学、法学、教育学、文学、历史和管理学等领域,人类的表现仍然远远超过了大型语言模型。

[官方网站] [Github] [论文]

5. Open LLM Leaderboard

由HuggingFace组织的一个LLM评测榜单,目前已评估了较多主流的开源LLM模型,以英文为主。主要目标是跟踪、排名和评估最新的大语言模型和聊天机器人,让所有人方便的观察到开源社区的进展和评估这些模型。这个排行榜有一个关键优势,社区中的任何成员都可以提交模型,并在 Hugging Face 的 GPU 集群上自动评估。

[官方网站]

6. 中文大模型安全评测平台 Star

大模型安全测评依托于一套系统的安全评测框架,涵盖了仇恨言论、偏见歧视言论、犯罪违法、隐私、伦理道德等八大类别,包括细粒度划分的40余个二级安全类别。

[官方网站] [Github] [论文]

7. OpenCompass大语言模型评测 Star

OpenCompass 是一款开源、高效、全面的评测大模型体系及开放平台。我们提供完整开源可复现的评测框架,支持大语言模型、多模态模型各类模型的一站式评测。利用分布式技术,即使面对千亿参数模型也能在数小时内完成评测。基于多个不同维度的高认可度数据集开放多样化的评测方式,包括零样本评测、小样本评测和思维链评测,全方位量化模型各个维度能力。

[官方网站] [Github]

[Back to Top]

在线体验大模型

:需要申请或者注册方可体验,更多见Github

1. ChatGPT--OpenAI

OpenAI所提出的GPT相关模型,也是目前最火的大语言模型,发布版本已经到了4.0.

[官方网站]

2. New bing--微软

NewBing是微软在2023年3月推出的一款全新的搜索引擎,它基于OpenAI的大型语言模型(LLM),并结合了ChatGPT和DALL·E的技术,为用户提供了一个AI驱动的网络助手。

[官方网站]

3. 文心一言--百度

百度全新一代知识增强大语言模型,文心大模型家族的新成员,能够与人对话互动,回答问题,协助创作,高效便捷地帮助人们获取信息、知识和灵感。

[官方网站]

4. 通义大模型--阿里

阿里大模型统一品牌,覆盖语言、听觉、多模态等领域致力于实现接近人类智慧的通用智能,让AI从“单一感官”到“五官全开”

[官方网站]

5. 星火认知大模型--科大讯飞

科大讯飞推出的新一代认知智能大模型,拥有跨领域的知识和语言理解能力,能够基于自然对话方式理解与执行任务。从海量数据和大规模知识中持续进化,实现从提出、规划到解决问题的全流程闭环。

[官方网站]

6. Claude--Anthropic

Claude,是人工智能初创公司Anthropic 发布的一款类似ChatGPT的产品。

[官方网站]

7. ChatGLM--智谱AI

基于千亿基座模型 GLM-130B,注入代码预训练,通过有监督微调等技术实现人类意图对齐,具备问答、多轮对话、代码生成功能的中英双语大模型。

[官方网站]

8. 天工大模型--昆仑万维

天工作为一款大型语言模型,拥有强大的自然语言处理和智能交互能力,能够实现智能问答、聊天互动、文本生成等多种应用场景,并且具有丰富的知识储备,涵盖科学、技术、文化、艺术、历史等领域。

[官方网站]

9. 序列猴子大模型--出门问问

序列猴子大模型是一个具有长序列、多模态、单模型、大数据等特点的超大规模语言模型,基于其通用的表示能力与推理能力,能够进行多轮交互,打造更便捷流畅的用户体验,极大地提高了生产效率和数据处理能力,被广泛应用于问答系统、自然语言处理、机器翻译、文本摘要等领域。

[官方网站]

10. MOSS--复旦大学

MOSS是复旦大学自然语言处理实验室发布的国内第一个对话式大型语言模型

[官方网站]

11. 360智脑大模--360

360智脑的生成与创作、多轮对话、代码能力、阅读理解、逻辑与推理、多模态等十大核心能力可覆盖大模型全部应用场景。

[官方网站]

12. 曹植GPT大语言模型--达观数据

达观数据积极探索大语言模型LLM的实践,研发国产版GPT“曹植”系统,作为垂直、专用、自主可控的国产版ChatGPT模型,不仅实现专业领域的AIGC智能化应用,且可内置在客户各类业务系统中提供专用服务

[官方网站]

13. 日日新--商汤

商汤“日日新SenseNova”大模型体系,正式问世

不仅展示了大模型体系下的语言大模型,还展示了AI文生图创作、2D/3D数字人生成、大场景/小物体生成等一系列生成式AI模型及应用,还揭开了依托商汤AI大装置SenseCore实现“大模型+大算力”融合创新的研发体系。

[官方网站]

14. 天燕大模型--APUS

天燕大模型是APUS公司自研的多模态大模型(LMM),具备对文本、图像、视频、音频的理解和生成能力(视频和音频的能力即将推出)。

[官方网站]

15. 元乘象--智子引擎

图文机器人

[官方网站]

16. 西湖大模型--西湖心辰

[官方网站]

17. Dongni--深思考

AI多模态搜索引擎

[官方网站]

18. 山海大模型--云知声

只需一次对话即可获取信息、知识和灵感,解决需求。是每个人身边的助理、朋友和专家。

[官方网站]

19. MiniMax大模型--MiniMax

MiniMax 最新一代的中文大语言模型帮助人类高效写作、激发创意、获取知识、做出决策现已对企业开放API体验

[官方网站]

[Back to Top]

开源模型库平台

  1. 🤗HuggingFace: The AI community building the future.
  1. ModelScope: ModelScope平台是以模型为中心的模型开源社区
  1. flagopen: flagopen飞智大模型技术开源体系
  1. 始智AI: 中国AI开源创新社区

[Back to Top]

开源数据集库

  1. huggfaceing数据集仓库: https://huggingface.co/datasets
  • 包含了自然语言处理、计算机视觉、语音、多模态等数据集,内置100多个多语言公共数据集下载
  1. ModelScope数据集仓库:https://modelscope.cn/datasets
  • 提供了覆盖自然语言处理、计算机视觉、语音、多模态等数据集,更有阿里巴巴集团贡献的专业领域数据集,
  1. flagopen数据集仓库: https://data.baai.ac.cn/data
  • 内置公共数据集下载,可下200G大规模预训练语料WuDaoCorpora
  1. cluebenchmarks数据集仓库:https://www.cluebenchmarks.com/dataSet_search.html
  • 多个中英文NLP数据集,并可申请下载100GB的高质量中文预训练语料CLUECorpus2020
  1. MNBVC: Massive Never-ending BT Vast Chinese corpus
  • 超大规模中文语料集
  1. OpenDataLab数据集仓库: https://opendatalab.com/
  • OpenDataLab 是有影响力的数据开源开放平台,公开数据集触手可及。
  1. OSCAR: Open Super-large Crawled Aggregated coRpus, 多语言数据集
  • 最新版本包含1.4T的中文语言数据集

[Back to Top]

other-awesome

1. Awesome-Chatgpt Star github

本项目旨在收集关于ChatGPT 的资源、工具、应用和用法等。

2. Awesome-ChatGPT-Prompts Star github

本项目旨在收集关于ChatGPT 模型使用的Prompts示例集。

3. Awesome-LLM Star github

本项目旨在收集有关大型语言模型相关资料,尤其是 ChatGPT 的论文的精选列表。它还包含 LLM 训练框架、部署 LLM 的工具、有关 LLM 的课程和教程以及所有公开可用的 LLM 模型和 API。

4. Awesome-LangChain Star github

本项目旨在收集与LangChain有关应用列表。LangChain是一个惊人的框架,可以在短时间内完成相关LLM应用开发。

5. Awesome-Open-Gpt Star github

本项目旨在收集关于GPT开源精选项目的合集(170+全网最全),其中包括了一些GPT镜像、GPT增强、GPT插件、GPT工具、GPT平替的聊天机器人、开源大语言模型等等。

6. Awesome-Multimodal-Large-Language-Models Star github

本项目是关于多模态大语言模型(MLLM)的精选列表,包括数据集、多模态模型、多模态语境学习、多模态思维链、llm 辅助视觉推理、基础模型等。此列表将实时更新。✨

7. Awesome-Transformer-Attention Star github

此 repo 包含 Vision Transformer & Attention 的综合论文列表,包括论文、代码和相关网站。

8. Awesome-Prompt-Engineering Star github

This repository contains a hand-curated resources for Prompt Engineering with a focus on Generative Pre-trained Transformer (GPT), ChatGPT, PaLM etc

9. Awesome-AITools Star github

这个仓库整理AI相关的实用工具。

10. Awesome-Chinese-LLM Star github

本项目旨在收集和梳理中文LLM相关的开源模型、应用、数据集及教程等资料,目前收录的资源已达100+个!

11. Awesome-LLM4Tool Star github

Awesome-LLM4Tool is a curated list of the papers, repositories, tutorials, and anythings related to the large language models for tools.

12. Awesome LLM Security Star github

A curation of awesome tools, documents and projects about LLM Security.

13. Awesome AI Agents Star github

Welcome to our list of AI agents. We structured the list into two parts: Open source projects and Closed-source projects and companies

14. Awesome-LLM-Large-Language-Models-Notes Star github

LLM-Large-Language-Models-Notes

15. Awesome-Efficient-LLM Star github

A curated list for Efficient Large Language Models。

16. Awesome Datasets for LLM Training Star github

A quick guide (especially) for trending instruction finetuning datasets。

17. Awesome-Align-LLM-Human Star github

A collection of papers and resources about aligning large language models (LLMs) with human.

18. Awesome RLHF (RL with Human Feedback) Star github

This is a collection of research papers for Reinforcement Learning with Human Feedback (RLHF). And the repository will be continuously updated to track the frontier of RLHF.

19. Prompt-in-context-learning Star github

An Open-Source Engineering Guide for Prompt-in-context-learning from EgoAlpha Lab.

20. Awesome Instruction Learning Star github

An awesome reading list of Instruction Tuning (or, put it more comprehensively, Instruction Learning), including papers and datasets.

21. Awesome-Foundation-Models Star github

A foundation model is a large-scale pretrained model (e.g., BERT, DALL-E, GPT-3) that can be adapted to a wide range of downstream applications. This term was first popularized by the Stanford Institute for Human-Centered Artificial Intelligence. This repository maintains a curated list of foundation models for vision and language tasks. Research papers without code are not included.

22. Awesome-AI-Devtools Star github

This is a curated list of AI-powered developer tools. These tools leverage AI to assist developers in tasks such as code completion, refactoring, debugging, documentation, and more.

23. Awesome-Autonomous-GPT Star github

A curated list of awesome projects and resources related to autonomous AI agents.

24. Awesome-Papers-Autonomous-Agent Star github

This is a collection of recent papers focusing on autonomous agent.

25. Awesome-Code-LLM Star github

a comprehensive review of LLM researches for code.

26. Awesome-LLM-Compression Star github

Awesome LLM compression research papers and tools to accelerate LLM training and inference.

27. Autonomous-Agents Star github

Autonomous Agents (LLMs). Updated daily.

28. Awesome-Large-Multimodal-Agents Star github

Awesome Large Multimodal Agents.

29. Awesome-LLM-Prompt-Optimization Star github

This repo aims to record advanced papers of LLM prompt tuning and automatic optimization (after 2022).

30. Awesome-LLMs-Datasets Star github

代表性LLM文本数据集大列表,包括预训练语料库、微调指令数据集、偏好数据集、评估数据集和传统NLP数据集.

30. Awesome-RAG-Survey Star github

This repo is constructed for collecting and categorizing papers about RAG according to our survey paper: Retrieval-Augmented Generation for AI-Generated Content: A Survey. Considering the rapid growth of this field, we will continue to update both paper and this repo.

31. Awesome-Tool-LLM Star github

Language models (LMs) are powerful yet mostly for text-generation tasks. Tools have substantially enhanced their performance for tasks that require complex skills.

[Back to Top]

NLU系列

BERT

  • 2018 | BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding | Jacob Devlin, et al. | arXiv | PDF
  • 2019 | Pre-Training with Whole Word Masking for Chinese BERT | Yiming Cui, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
BERT-Base base Google Drive Google Research github 通用
BERT-wwm base

Google Drive
讯飞云-07Xj

Google Drive Yiming Cui github 通用
BERT-wwm-ext base

Google Drive
讯飞云-4cMG

Google Drive Yiming Cui github 通用
bert-base-民事 base 阿里云 THUNLP github 司法
bert-base-刑事 base 阿里云 THUNLP github 司法
BAAI-JDAI-BERT base 京东云 JDAI github 电商客服对话
FinBERT base

Google Drive
百度网盘-1cmp

Google Drive
百度网盘-986f

Value Simplex github 金融科技领域
EduBERT base 好未来AI 好未来AI tal-tech github 教育领域
guwenbert-base base

百度网盘-4jng
[🤗HF]

Ethan github 古文领域
guwenbert-large large

百度网盘-m5sz
[🤗HF]

Ethan github 古文领域
BERT-CCPoem small thunlp THUNLP-AIPoet github 古典诗歌

备注:

wwm全称为**Whole Word Masking **,一个完整的词的部分WordPiece子词被mask,则同属该词的其他部分也会被mask

ext表示在更多数据集下训练

[Back to Top]

ChineseBERT

  • 2021 | ChineseBERT: Chinese Pretraining Enhanced by Glyph and Pinyin Information | Zijun Sun, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
ChineseBERT base [🤗HF] ShannonAI github 通用
ChineseBERT large [🤗HF] ShannonAI github 通用

[Back to Top]

RoBERTa

  • 2019 | RoBERTa: A Robustly Optimized BERT Pretraining Approach | Yinhan Liu, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
RoBERTa-tiny-clue tiny Google Drive 百度网盘-8qvb CLUE github 通用
RoBERTa-tiny-pair tiny google drive 百度网盘-8qvb CLUE github 通用
RoBERTa-tiny3L768-clue tiny Google Drive CLUE github 通用
RoBERTa-tiny3L312-clue tiny google drive 百度网盘-8qvb CLUE github 通用
RoBERTa-large-pair large Google Drive 百度网盘-8qvb CLUE github 通用
RoBERTa-large-clue large google drive 百度网盘-8qvb CLUE github 通用
RBT3 3层base

Google Drive
讯飞云-b9nx

Google Drive Yiming Cui github 通用
RBTL3 3层large

Google Drive
讯飞云-vySW

Google Drive Yiming Cui github 通用
RBTL4 4层large 讯飞云-e8dN Yiming Cui github 通用
RBTL6 6层large 讯飞云-XNMA Yiming Cui github 通用
RoBERTa-wwm-ext base

Google Drive
讯飞云-Xe1p

Google Drive Yiming Cui github 通用
RoBERTa-wwm-ext-large large

Google Drive
讯飞云-u6gC

Google Drive Yiming Cui github 通用
RoBERTa-base base

Google Drive
百度网盘

Google Drive
百度网盘

brightmart github 通用
RoBERTa-Large large

Google Drive
百度网盘

Google Drive brightmart github 通用
RoBERTa-tiny tiny [🤗HF] [🤗HF] DBIIR @ RUC UER 通用
RoBERTa-mini mini [🤗HF] [🤗HF] DBIIR @ RUC UER 通用
RoBERTa-small small [🤗HF] [🤗HF] DBIIR @ RUC UER 通用
RoBERTa-medium medium [🤗HF] [🤗HF] DBIIR @ RUC UER 通用
RoBERTa-base base [🤗HF] [🤗HF] DBIIR @ RUC UER 通用

[Back to Top]

ALBERT

  • 2019 | ALBERT: A Lite BERT For Self-Supervised Learning Of Language Representations | Zhenzhong Lan, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Albert_tiny tiny Google Drive Google Drive brightmart github 通用
Albert_base_zh base Google Drive Google Drive brightmart github 通用
Albert_large_zh large Google Drive Google Drive brightmart github 通用
Albert_xlarge_zh xlarge Google Drive Google Drive brightmart github 通用
Albert_base base Google Drive Google Research github 通用
Albert_large large Google Drive Google Research github 通用
Albert_xlarge xlarge Google Drive Google Research github 通用
Albert_xxlarge xxlarge Google Drive Google Research github 通用

[Back to Top]

NEZHA

  • 2019 | NEZHA: Neural Contextualized Representation for Chinese Language Understanding | Junqiu Wei, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
NEZHA-base base

Google Drive
百度网盘-ntn3

lonePatient HUAWEI github 通用
NEZHA-base-wwm base

Google Drive
百度网盘-f68o

lonePatient HUAWEI github 通用
NEZHA-large large

Google Drive
百度网盘-7thu

lonePatient HUAWEI github 通用
NEZHA-large-wwm large

Google Drive
百度网盘-ni4o

lonePatient HUAWEI github 通用

WoNEZHA
(word-base)

base 百度网盘-qgkq ZhuiyiTechnology github 通用

[Back to Top]

MacBERT

  • 2020 | Revisiting Pre-Trained Models for Chinese Natural Language Processing | Yiming Cui, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
MacBERT-base base

Google Drive
讯飞云-E2cP

Yiming Cui github 通用
MacBERT-large large

Google Drive
讯飞云-3Yg3

Yiming Cui github 通用

[Back to Top]

WoBERT

  • 2020 | 提速不掉点:基于词颗粒度的中文WoBERT | 苏剑林. | spaces | Blog post
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
WoBERT base 百度网盘-kim2 ZhuiyiTechnology github 通用
WoBERT-plus base 百度网盘-aedw ZhuiyiTechnology github 通用

[Back to Top]

XLNET

  • 2019 | XLNet: Generalized Autoregressive Pretraining for Language Understanding | Zhilin Yang, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
XLNet-base base

Google Drive
讯飞云-uCpe

Google Drive Yiming Cui github 通用
XLNet-mid middle

Google Drive
讯飞云-68En

Google Drive Yiming Cui github 通用
XLNet_zh_Large large 百度网盘 brightmart github 通用

[Back to Top]

ELECTRA

  • 2020 | ELECTRA: Pre-training Text Encoders as Discriminators Rather Than Generators | Kevin Clark, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
ELECTRA-180g-large large

Google Drive
讯飞云-Yfcy

Yiming Cui github 通用
ELECTRA-180g-small-ex small

Google Drive
讯飞云-GUdp

Yiming Cui github 通用
ELECTRA-180g-base base

Google Drive
讯飞云-Xcvm

Yiming Cui github 通用
ELECTRA-180g-small small

Google Drive
讯飞云-qsHj

Yiming Cui github 通用
legal-ELECTRA-large large

Google Drive
讯飞云-7f7b

Yiming Cui github 司法领域
legal-ELECTRA-base base

Google Drive
讯飞云-7f7b

Yiming Cui github 司法领域
legal-ELECTRA-small small

Google Drive
讯飞云-7f7b

Yiming Cui github 司法领域
ELECTRA-tiny tiny

Google Drive
百度网盘-rs99

CLUE github 通用

[Back to Top]

ZEN

  • 2019 | ZEN: Pre-training Chinese Text Encoder Enhanced by N-gram Representations | Shizhe Diao, et al. | arXiv | PDF
  • 2021 | ZEN 2.0: Continue Training and Adaption for N-gram Enhanced Text Encoders | Yan Song, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
ZEN-Base base

Google Drive
百度网盘

Sinovation Ventures AI Institute github 通用
Erlangshen-ZEN2 large [🤗HF] IDEA-CCNL github 通用

[Back to Top]

ERNIE

  • 2019 | ERNIE: Enhanced Representation through Knowledge Integration | Yu Sun, et al. | arXiv | PDF

  • 2020 | SKEP: Sentiment Knowledge Enhanced Pre-training for Sentiment Analysis | Hao Tian, et al. | arXiv | PDF

  • 2020 | ERNIE-Gram: Pre-Training with Explicitly N-Gram Masked Language Modeling for Natural Language Understanding | Dongling Xiao, et al. | arXiv | PDF

模型 版本 PaddlePaddle PyTorch 作者 源地址 应用领域
ernie-1.0-base base link PaddlePaddle github 通用
ernie_1.0_skep_large large link Baidu github 情感分析
ernie-gram base link Baidu github 通用

备注:

PaddlePaddle转TensorFlow可参考: tensorflow_ernie

PaddlePaddle转PyTorch可参考: ERNIE-Pytorch

[Back to Top]

ERNIE3

  • 2021 | ERNIE 3.0: Large-scale Knowledge Enhanced Pre-training for Language Understanding and Generation | Yu Sun, et al. | arXiv | PDF

  • 2021 | ERNIE 3.0 Titan: Exploring Larger-scale Knowledge Enhanced Pre-training for Language Understanding and Generation | Shuohuan Wang, et al. | arXiv | PDF

模型 版本 PaddlePaddle PyTorch 作者 源地址 应用领域
ernie-3.0-base 12-layer, 768-hidden, 12-heads link [🤗HF] PaddlePaddle github 通用
ernie-3.0-medium 6-layer, 768-hidden, 12-heads link [🤗HF] PaddlePaddle github 通用
ernie-3.0-mini 6-layer, 384-hidden, 12-heads link [🤗HF] PaddlePaddle github 通用
ernie-3.0-micro 4-layer, 384-hidden, 12-heads link [🤗HF] PaddlePaddle github 通用
ernie-3.0-nano 4-layer, 312-hidden, 12-heads link [🤗HF] PaddlePaddle github 通用

PaddlePaddle转PyTorch可参考: ERNIE-Pytorch

[Back to Top]

RoFormer

  • 2021 | RoFormer: Enhanced Transformer with Rotary Position Embedding | Jianlin Su, et al. | arXiv | PDF

  • 2021 | Transformer升级之路:2、博采众长的旋转式位置编码 | 苏剑林. | spaces | Blog post

模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
roformer base(L12) 百度网盘-xy9x ZhuiyiTechnology github 通用
roformer small(L6) 百度网盘-gy97 ZhuiyiTechnology github 通用
roformer-char base(L12) 百度网盘-bt94 ZhuiyiTechnology github 通用
roformerV2 small(L6) 百度网盘-ttn4追一 ZhuiyiTechnology github 通用
roformerV2 base(L12) 百度网盘-pfoh追一 ZhuiyiTechnology github 通用
roformerV2 large(L24) 百度网盘-npfv追一 ZhuiyiTechnology github 通用

[Back to Top]

StructBERT

  • 2019 | StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding | Wei Wang, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
StructBERT large(L24) 阿里云 Alibaba github 通用

[Back to Top]

Lattice-BERT

  • 2021 | Lattice-BERT: Leveraging Multi-Granularity Representations in Chinese Pre-trained Language Models | Yuxuan Lai, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
LatticeBERT tiny(L4) 阿里云 Alibaba github 通用
LatticeBERT small(L6) 阿里云 Alibaba github 通用
LatticeBERT base(L12) 阿里云 Alibaba github 通用

[Back to Top]

Mengzi-BERT

  • 2021 | Mengzi: Towards Lightweight yet Ingenious Pre-trained Models for Chinese | Zhuosheng Zhang, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Mengzi-BERT base(L12) [🤗HF] Langboat github 通用
Mengzi-BERT-fin base(L12) [🤗HF] Langboat github 金融财经

[Back to Top]

Bloom

  • 2022 | Bloom: BigScience Large Open-science Open-access Multilingual Language Model | huggingface bigscience | - | BLOG
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
bloom-6b4-zh 6B(L30) [🤗HF] Langboat github 通用

注:作者另有bloom-389m-zh到bloom-2b5-zh等多个中文模型

[Back to Top]

TaCL

  • 2021 | TaCL: Improving BERT Pre-training with Token-aware Contrastive Learning | Yixuan Su, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
TaCL base(L12) [🤗HF] yxuansu github 通用

[Back to Top]

MC-BERT

  • 2021 | MC-BERT: Conceptualized Representation Learning for Chinese Biomedical Text Mining | alibaba-research | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
MC-BERT base(L12) link alibaba-research github 生物医疗

[Back to Top]

二郎神

模型 版本 类型 TensorFlow PyTorch 作者 源地址 应用领域
Erlangshen large(L24) bert [🤗HF] IDEA-CCNL github 中文通用

[Back to Top]

PERT

  • 2022 | PERT: Pre-Training BERT with Permuted Language Model | Yiming Cui, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
PERT-base base(12L) 百度网盘-rcsw [🤗HF] Yiming Cui github 通用
PERT-large large(24L) 百度网盘-e9hs [🤗HF] Yiming Cui github 通用

[Back to Top]

MobileBERT

  • 2020 | MobileBERT: a Compact Task-Agnostic BERT for Resource-Limited Devices | Zhiqing Sun, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Chinese-MobileBERT-base-f2 base 百度网盘-56bj Yiming Cui github 通用
Chinese-MobileBERT-base-f4 base 百度网盘-v2v7 Yiming Cui github 通用
Chinese-MobileBERT-large-f2 large 百度网盘-6m5a Yiming Cui github 通用
Chinese-MobileBERT-large-f4 large 百度网盘-3h9b Yiming Cui github 通用

[Back to Top]

GAU-α

  • 2022 | GAU-α: (FLASH) Transformer Quality in Linear Time | Weizhe Hua, et al. | arXiv | PDF | blog
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
chinese_GAU-alpha-char_L-24_H-768 base 下载 ZhuiyiTechnology github 通用

[Back to Top]

DeBERTa

  • 2020 | DeBERTa: Decoding-enhanced BERT with Disentangled Attention | Pengcheng He, et al. | arXiv | PDF |
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
DeBERTa-v2-Large large [🤗HF] IDEA-CCNL github 通用
DeBERTa-v2-xLarge xlarge [🤗HF] IDEA-CCNL github 通用
DeBERTa-v2 base [🤗HF] IDEA-CCNL github 通用

[Back to Top]

GlyphBERT

  • 2021 | GlyphCRM: Bidirectional Encoder Representation for Chinese Character with its Glyph | Yuxin li, et al. | arXiv | PDF |
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
GlyphCRM-base base [🤗HF] HITsz-TMG github 通用

[Back to Top]

CKBERT

  • 2022 | Revisiting and Advancing Chinese Natural Language Understanding with Accelerated Heterogeneous Knowledge Pre-training | Zhang, Taolin, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
pai-ckbert-base-zh base [🤗HF] Alibaba github 通用
pai-ckbert-large-zh large [🤗HF] Alibaba github 通用
pai-ckbert-huge-zh huge [🤗HF] Alibaba github 通用

[Back to Top]

LERT

  • 2022 | LERT: A Linguistically-motivated Pre-trained Language Model | Yiming Cui et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Chinese-LERT-small 15m 百度网盘-4vuy [🤗HF] Yiming Cui github 通用
Chinese-LERT-base 400m 百度网盘-9jgi [🤗HF] Yiming Cui github 通用
Chinese-LERT-large 1.2G 百度网盘-s82t [🤗HF] Yiming Cui github 通用

[Back to Top]

RoCBert

  • 2022 | RoCBert: Robust Chinese Bert with Multimodal Contrastive Pretraining | Hui Su et al. | ACL | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
rocbert base [🤗HF] Weiwe Shi github 通用

[Back to Top]

M3E

模型 版本 PyTorch 作者 源地址 备注
m3e-base base m3e-base Moka-AI uniemStar 文本嵌入模型
M3e-small Small m3e-small Moka-AI uniemStar 文本嵌入模型

[Back to Top]

LEALLA

  • 2023 | LEALLA: Learning Lightweight Language-agnostic Sentence Embeddings with Knowledge Distillation | Zhuoyuan Mao et al. | EACL | PDF
模型 版本 PyTorch 作者 源地址 备注
LEALLA-base base LEALLA-base Google Research / 文本嵌入模型
LEALLA-large large LEALLA-large Google Research / 文本嵌入模型

[Back to Top]

NLG系列

GPT

  • 2019 | Improving Language Understandingby Generative Pre-Training | Alec Radford, et al. | arXiv | PDF

  • 2019 | Language Models are Unsupervised Multitask Learners | Alec Radford, et al. | arXiv | PDF

模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
GPT2 30亿语料

Google Drive
百度网盘-ffz6

Caspar ZHANG gpt2-ml 通用
GPT2 15亿语料

Google Drive
百度网盘-q9vr

Caspar ZHANG gpt2-ml 通用
CDial-GPTLCCC-base base [🤗HF] thu-coai CDial-GPT 中文对话
CDial-GPT2LCCC-base base [🤗HF] thu-coai CDial-GPT 中文对话
CDial-GPTLCCC-large large [🤗HF] thu-coai CDial-GPT 中文对话
GPT2-dialogue base

Google Drive
百度网盘-osi6

yangjianxin1 GPT2-chitchat 闲聊对话
GPT2-mmi base

Google Drive
百度网盘-1j88

yangjianxin1 GPT2-chitchat 闲聊对话
GPT2-散文模型 base

Google Drive
百度网盘-fpyu

Zeyao Du GPT2-Chinese 散文
GPT2-诗词模型 base

Google Drive
百度网盘-7fev

Zeyao Du GPT2-Chinese 诗词
GPT2-对联模型 base

Google Drive
百度网盘-i5n0

Zeyao Du GPT2-Chinese 对联
roformer-gpt base(L12) 百度网盘-2nnn ZhuiyiTechnology github 通用

[Back to Top]

GPT-3

  • 2019 | Transformer-XL: Attentive Language Models Beyond a Fixed-Length Context | Zihang Dai, et al. | arXiv | PDF

  • 2020 | Language Models are Few-Shot Learners | Tom B. Brown, et al. | arXiv | PDF

模型 版本 介绍 PyTorch 作者 源地址 应用领域
Chinese-Transformer-XL 29亿参数(GPT-3) 项目首页 模型下载 THUDM github 通用

[Back to Top]

NEZHA-Gen

  • 2019 | NEZHA: Neural Contextualized Representation for Chinese Language Understanding | Junqiu Wei, et al. | arXiv | PDF

  • 2019 | Improving Language Understandingby Generative Pre-Training | Alec Radford, et al. | arXiv | PDF

模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
NEZHA-Gen base

Google Drive
百度网盘-rb5m

HUAWEI github 通用
NEZHA-Gen base

Google Drive
百度网盘-ytim

HUAWEI github 诗歌

[Back to Top]

CPM-Generate

  • 2020 | CPM: A Large-scale Generative Chinese Pre-trained Language Model | Zhengyan Zhang, et al. | arXiv | PDF
模型 版本 资源 PyTorch 作者 源地址 应用领域
CPM 26亿参数 项目首页 模型下载 Tsinghua AI github 通用

备注:

PyTorch转TensorFlow可参考: CPM-LM-TF2

PyTorch转PaddlePaddle可参考: CPM-Generate-Paddle

[Back to Top]

T5

  • 2019 | Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer | Colin Raffel, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
T5 small [🤗HF] [🤗HF] DBIIR @ RUC UER 通用

[Back to Top]

T5-PEGASUS

  • 2019 | Exploring the Limits of Transfer Learning with a Unified Text-to-Text Transformer | Colin Raffel, et al. | arXiv | PDF

  • 2019 | PEGASUS: Pre-training with Extracted Gap-sentences for Abstractive Summarization | Jingqing Zhang, et al. | arXiv | PDF

  • 2021 | T5 PEGASUS:开源一个中文生成式预训练模型 | 苏剑林. | spaces | Blog post

模型 版本 Keras PyTorch 作者 源地址 应用领域
T5 PEGASUS base 百度网盘-3sfn ZhuiyiTechnology github 通用
T5 PEGASUS small 百度网盘-qguk ZhuiyiTechnology github 通用

Keras转PyTorch可参考: t5-pegasus-pytorch

[Back to Top]

Mengzi-T5

  • 2021 | Mengzi: Towards Lightweight yet Ingenious Pre-trained Models for Chinese | Zhuosheng Zhang, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Mengzi-T5 base(L12) [🤗HF] Langboat github 通用

[Back to Top]

PanGu-Alpha

  • 2021 | PanGu-α: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation | Wei Zeng, et al. | arXiv | PDF
模型 版本 资源 下载地址 作者 源地址 应用领域
盘古α-2.6B 2.6G 项目首页 模型下载 PCL-Platform.Intelligence github 通用
盘古α-13B 12G 项目首页 模型下载 PCL-Platform.Intelligence github 通用
盘古α-2.6B pytorch版本 2.6G 项目首页 模型下载 PCL-Platform.Intelligence github 通用
盘古α-13B pytorch版本 12G 项目首页 模型下载 PCL-Platform.Intelligence github 通用

[Back to Top]

EVA

  • 2021 | EVA: An Open-Domain Chinese Dialogue System with Large-Scale Generative Pre-Training | Hao Zhou, et al. | arXiv | PDF
模型 版本 介绍 模型下载 作者 源地址 应用领域 备注
EVA 28亿参数 项目首页 模型下载 thu-coai github 中文开放域对话 需要登陆才能下载
EVA2.0-xLarge xlarge 项目首页 [🤗HF] thu-coai github 中文开放域对话
EVA2.0-large large 项目首页 [🤗HF] thu-coai github 中文开放域对话
EVA2.0-base base 项目首页 [🤗HF] thu-coai github 中文开放域对话

[Back to Top]

-

BART

  • 2019 | BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension | Mike Lewis, et al. | arxiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
BART-base base [🤗HF] fastNLP github 中文通用
BART-large large [🤗HF] fastNLP github 中文通用

[Back to Top]

闻仲

模型 版本 类型 TensorFlow PyTorch 作者 源地址 应用领域
Wenzhong large(L24) GPT2 [🤗HF] IDEA-CCNL github 中文通用

[Back to Top]

余元

模型 版本 类型 TensorFlow PyTorch 作者 源地址 应用领域
Yuyuan large(L24) GPT2 [🤗HF] IDEA-CCNL github 医学领域

[Back to Top]

RWKV

  • 2021 | An Attention Free Transformer | Shuangfei Zhai, et al. | arxiv | PDF
  • 2022 | The RWKV Language Model . | github
模型 版本 类型 TensorFlow PyTorch 作者 源地址 应用领域
RWKV base(L12) github PENG Bo github 小说
RWKV 7B [🤗HF] PENG Bo github 小说
RWKV 14B [🤗HF] PENG Bo github 小说

[Back to Top]

PromptCLUE

模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
PromptCLUE base(L12) [🤗HF] ClueAI github 通用
PromptCLUE-v1-5 base(L12) [🤗HF] ClueAI github 通用
PromptCLUE-large large API在线调用 ClueAI github 通用

[Back to Top]

ChatYuan

模型 版本 类型 TensorFlow PyTorch 作者 源地址 应用领域
ChatYuan large T5 [🤗HF] ClueAI github 功能型对话
ChatYuan-large-v2 large T5 [🤗HF] ClueAI github 功能型对话

[Back to Top]

SkyText

模型 版本 类型 TensorFlow PyTorch 作者 源地址 应用领域
SkyText large GPT3 [🤗HF] SkyWorkAIGC github 通用

[Back to Top]

ProphetNet

  • 2020 | Prophetnet: Predicting future n-gram for sequence-to-sequence pre-training | Qi, Weizhen, et al. | arxiv | PDF
  • 2021 | ProphetNet-X: Large-Scale Pre-training Models for English, Chinese, Multi-lingual, Dialog, and Code Generation | Qi, Weizhen, et al. | arxiv | PDF
模型 版本 类型 TensorFlow PyTorch 作者 源地址 应用领域
ProphetNet-Zh link microsoft github 通用
ProphetNet-Dialog-Zh link microsoft github 对话

[Back to Top]

NLU-NLG系列

UniLM

  • 2019 | Unified Language Model Pre-training for Natural Language Understanding and Generation | Li Dong, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Unilm base 百度网盘-tblr 百度网盘-etwf YunwenTechnology github 通用

[Back to Top]

Simbert

  • 2020 | 鱼与熊掌兼得:融合检索和生成的SimBERT模型 | 苏剑林. | spaces | Blog post
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
SimBERT Tiny tiny 百度网盘-1tp7 ZhuiyiTechnology github 通用
SimBERT Small small 百度网盘-nu67 ZhuiyiTechnology github 通用
SimBERT Base base 百度网盘-6xhq ZhuiyiTechnology github 通用

[Back to Top]

RoFormer-sim

  • 2021 | SimBERTv2来了!融合检索和生成的RoFormer-Sim模型 | 苏剑林. | spaces | Blog post
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
roformer-sim base(L12) 百度网盘-2cgz ZhuiyiTechnology github 通用
roformer-sim small(L6) 百度网盘-h68q ZhuiyiTechnology github 通用
roformer-sim-v2 base(L12) 百度网盘-w15n ZhuiyiTechnology github 通用

[Back to Top]

周文王

模型 版本 类型 TensorFlow PyTorch 作者 源地址 应用领域
Zhouwenwang base(L12) roformer [🤗HF] IDEA-CCNL github 中文通用
Zhouwenwang large(L24) roformer [🤗HF] IDEA-CCNL github 中文通用

[Back to Top]

CPM-2

  • 2021 | CPM-2: Large-scale Cost-effective Pre-trained Language Models | Zhengyan Zhang, et al. | arXiv | PDF
模型 版本 介绍 模型下载 作者 源地址 应用领域 备注
CPM-2 110亿参数 项目首页 模型下载 BAAI-WuDao github 通用 需要申请才能下载
CPM-2 100亿参数 项目首页 模型下载 BAAI-WuDao github 中英 需要申请才能下载
CPM-2 1980亿参数 项目首页 模型下载 BAAI-WuDao github 中英 需要申请才能下载

[Back to Top]

CPT

  • 2021 | CPT: A Pre-Trained Unbalanced Transformer for Both Chinese Language Understanding and Generation | Yunfan Shao, et al. | arxiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
CPT-base base(L12) [🤗HF] fastNLP github 通用
CPT-large large(L24) [🤗HF] fastNLP github 通用

[Back to Top]

GLM

  • 2022 | GLM: General Language Model Pretraining with Autoregressive Blank Infilling | Zhengxiao Du, et al. | arXiv | PDF
  • 2022 | GLM-130B: An Open Bilingual Pre-trained Model | Aohan Zeng, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
GLM large [🤗HF] THUDM github 通用
GLM xxlarge [🤗HF] THUDM github 通用
GLM-130B 130B 申请地址1申请地址2 THUDM github 通用

[Back to Top]

PLUG

  • 2019 | StructBERT: Incorporating Language Structures into Pre-training for Deep Language Understanding | Wei Wang, et al. | arXiv | PDF
  • 2020 | PALM: Pre-training an Autoencoding&Autoregressive Language Model for Context-conditioned Generation | Bin Bi, et al. | ACL| PDF
模型 版本 模型下载 作者 源地址 应用领域
PLUG 27B AliceMind-需要申请 Alibaba github 通用

[Back to Top]

OPD

  • 2022 | 待定 | , et al. | arXiv | PDF
模型 版本 介绍 模型下载 作者 源地址 应用领域 备注
OPD 6.3B 项目首页 模型下载 thu-coai github 中文开放域对话 需要申请才能下载

[Back to Top]

Multi-Modal

WenLan

  • 2021 | WenLan: Bridging Vision and Language by Large-Scale Multi-Modal Pre-Training | Yuqi Huo, et al. | arXiv | PDF
模型 版本 介绍 模型下载 作者 源地址 应用领域 备注
BriVL(WenLan) 10亿参数 项目首页 模型下载 BAAI-WuDao github 中文通用图文 需要登陆才能下载

[Back to Top]

CogView

  • 2021 | CogView: Mastering Text-to-Image Generation via Transformers | Ming Ding, et al. | arXiv | PDF
模型 版本 介绍 模型下载 作者 源地址 应用领域 备注
CogView 40亿参数 项目首页 模型下载 THUDM github 中文多模态生成模型 需要登陆才能下载

[Back to Top]

紫东太初

模型 版本 介绍 模型下载 作者 源地址 应用领域 备注
紫东太初- light_vision_text 项目首页 模型下载 中科院自动化所 github 中文图像-文本领域 紫东太初多模态大模型中的图像-文本预训练模型
紫东太初-text[GPT] 32亿参数 项目首页 百度网盘-nos5 中科院自动化所 github 中文通用 紫东太初多模态大模型中的文本预训练模型
紫东太初-vision 项目首页 模型下载 中科院自动化所 github 视觉领域 紫东太初多模态大模型中的视觉预训练模型
紫东太初-speech 项目首页 模型下载 中科院自动化所 github 语音领域 紫东太初多模态大模型中的语音检测与识别多任务模型

[Back to Top]

Mengzi-oscar

  • 2021 | Mengzi: Towards Lightweight yet Ingenious Pre-trained Models for Chinese | Zhuosheng Zhang, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Mengzi-oscar base(L12) [🤗HF] Langboat github 中文多模态-图文

[Back to Top]

R2D2

  • 2022 | Zero and R2D2: A Large-scale Chinese Cross-modal Benchmark and A Vision-Language Framework | Chunyu Xie, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 首页 应用领域
R2D2ViT-L large Google yuxie11 github zero 中文多模态-图文
PRD2ViT-L large Google yuxie11 github zero 中文多模态-图文

[Back to Top]

Chinese-CLIP

  • 2021 | Learning Transferable Visual Models From Natural Language Supervision | Alec Radford, et al. | arXiv | PDF
  • 2022 | Chinese CLIP: Contrastive Vision-Language Pretraining in Chinese | An Yang, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
CN-CLIPRN50 77M aliyuncs OFA-Sys github 中文多模态-图文
CN-CLIPViT-B/16 188M aliyuncs OFA-Sys github 中文多模态-图文
CN-CLIPViT-L/14 406M aliyuncs OFA-Sys github 中文多模态-图文
CN-CLIPViT-L/14@336px 407M aliyuncs OFA-Sys github 中文多模态-图文
CN-CLIPViT-H/14 958M aliyuncs OFA-Sys github 中文多模态-图文

[Back to Top]

TaiYi-CLIP

  • 2021 | Learning Transferable Visual Models From Natural Language Supervision | Alec Radford, et al. | arXiv | PDF
  • 2022 | Fengshenbang 1.0: Being the Foundation of Chinese Cognitive Intelligence | Junjie Wang, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Taiyi-CLIP-Roberta-large-326M-Chinese base [🤗HF] IDEA-CCNL github 中文多模态-图文

[Back to Top]

AltCLIP

  • 2022 | AltCLIP: Altering the Language Encoder in CLIP for Extended Language Capabilities | Chen, Zhongzhi, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
AltCLIP 3.22G [🤗HF] FlagAI github 中文多模态-图文

[Back to Top]

AltDiffusion

  • 2022 | AltCLIP: Altering the Language Encoder in CLIP for Extended Language Capabilities | Chen, Zhongzhi, et al. | arXiv | PDF
  • 2022 | High-Resolution Image Synthesis With Latent Diffusion Models | Rombach, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
AltDiffusion 8.0G [🤗HF] FlagAI github 中文多模态-图文

[Back to Top]

Taiyi-Stable-Diffusion

  • 2022 | Fengshenbang 1.0: Being the Foundation of Chinese Cognitive Intelligence | Junjie Wang, et al. | arXiv | PDF
  • 2022 | High-Resolution Image Synthesis With Latent Diffusion Models | Rombach, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
Taiyi-Stable-Diffusion 1B [🤗HF] IDEA-CCNL github 中文多模态-图文

[Back to Top]

wukong

  • 2022 | Wukong: A 100 Million Large-scale Chinese Cross-modal Pre-training Benchmark | Jiaxi Gu, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
CLIP url HUAWEI github 中文多模态-图文
FILIP url HUAWEI github 中文多模态-图文
wukong url HUAWEI github 中文多模态-图文

[Back to Top]

OFA

  • 2022 | OFA: Unifying Architectures, Tasks, and Modalities Through a Simple Sequence-to-Sequence Learning Framework | Peng Wang, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
OFA link OFA-Sys github 中文多模态-图文
OFA-Chinese [🤗HF] Yang JianXin github 中文多模态-图文

[Back to Top]

QA-CLIP

模型 版本 视觉架构 PyTorch 作者 源地址 应用领域
QA-CLIPRN50 77M ResNet50 [🤗HF] 腾讯 QA-CLIPStar 中文多模态-图文
QA-CLIPViT-B/16 188M ViT-B/16 [🤗HF] 腾讯 QA-CLIPStar 中文多模态-图文
QA-CLIPViT-L/14 406M ViT-L/14 [🤗HF] 腾讯 QA-CLIPStar 中文多模态-图文

[Back to Top]

Table

SDCUP

  • 2021 | Improving Text-to-SQL with Schema Dependency Learning | Binyuan Hui, et al. | arXiv | PDF
模型 版本 TensorFlow PyTorch 作者 源地址 应用领域
sdcup base 阿里云 Alibaba github 中文表格
sdcup large 阿里云 Alibaba github 中文表格

[Back to Top]

更新

[Back to Top]

Contributors

Misc

↳ Stargazers

Stargazers repo roster for

↳ Forkers

Forkers repo roster for

↳ Star History

Visitor Count