Kunoichi-DPO-v2-7B开源大语言模型 - 多项测试表现佳，助力多样文本应用

Kunoichi DPO V2 7B

由 SanjiWatsuki 开发

Kunoichi-DPO-v2-7B是基于Mistral架构的7B参数大语言模型，采用DPO（Direct Preference Optimization）优化训练，在多项基准测试中表现优异。

下载量 185

发布时间 : 1/13/2024

模型简介

该模型是一个经过优化的对话型语言模型，专注于提供高质量的文本生成和理解能力，适用于多种自然语言处理任务。

DPO优化训练

采用Direct Preference Optimization方法进行优化训练，提高了模型的对话质量和一致性

高性能

在MT Bench、EQ Bench等多个基准测试中表现优异，超越同类7B参数模型

多功能性

支持多种自然语言处理任务，包括文本生成、问答和对话系统

文本生成

对话系统

问答系统

逻辑推理

知识问答

智能助手

虚拟客服

用于客户服务场景的自动问答系统

能够提供准确、连贯的客服响应

教育

学习辅导

帮助学生解答学习问题

在MMLU等知识测试中表现良好

本项目主要展示了Kunoichi系列模型与其他知名大语言模型在多个评测基准上的性能对比，为模型的选择和研究提供了有价值的参考。

本项目采用CC BY-NC 4.0许可协议。

模型	MT Bench	EQ Bench	MMLU	Logic Test
GPT-4-Turbo	9.32	-	-	-
GPT-4	8.99	62.52	86.4	0.86
Kunoichi-DPO-v2-7B	8.51	42.18	64.94	0.58
Mixtral-8x7B-Instruct	8.30	44.81	70.6	0.75
Kunoichi-DPO-7B	8.29	41.60	64.83	0.59
Kunoichi-7B	8.14	44.32	64.9	0.58
Starling-7B	8.09	-	63.9	0.51
Claude-2	8.06	52.14	78.5	-
Silicon-Maid-7B	7.96	40.44	64.7	0.54
Loyal-Macaroni-Maid-7B	7.95	38.66	64.9	0.57
GPT-3.5-Turbo	7.94	50.28	70	0.57
Claude-1	7.9	-	77	-
Openchat-3.5	7.81	37.08	64.3	0.39
Dolphin-2.6-DPO	7.74	42.88	61.9	0.53
Zephyr-7B-beta	7.34	38.71	61.4	0.30
Llama-2-70b-chat-hf	6.86	51.56	63	-
Neural-chat-7b-v3-1	6.84	43.61	62.4	0.30

模型	平均得分	AGIEval	GPT4All	TruthfulQA	Bigbench
Kunoichi-DPO-7B	58.4	45.08	74	66.99	47.52
Kunoichi-DPO-v2-7B	58.31	44.85	75.05	65.69	47.65
Kunoichi-7B	57.54	44.99	74.86	63.72	46.58
OpenPipe/mistral-ft-optimized-1218	56.85	44.74	75.6	59.89	47.17
Silicon-Maid-7B	56.45	44.74	74.26	61.5	45.32
mlabonne/NeuralHermes-2.5-Mistral-7B	53.51	43.67	73.24	55.37	41.76
teknium/OpenHermes-2.5-Mistral-7B	52.42	42.75	72.99	52.99	40.94
openchat/openchat_3.5	51.34	42.67	72.92	47.27	42.51
berkeley-nest/Starling-LM-7B-alpha	51.16	42.06	72.72	47.33	42.53
HuggingFaceH4/zephyr-7b-beta	50.99	37.33	71.83	55.1	39.7