“零一万物”宣布开源Yi-9B模型，号称同系列内代码、数学能力最强，能在消费级显卡上轻松部署

发布时间：2024-03-09 16:41:30 来源：互联网

.

互联网3月7日报道丨3月6日晚间，李开复旗下的人工智能大模型创业公司“零一万物 01AI”发布消息称，对外开源 Yi-9B 模型，这款大

互联网3月7日报道丨3月6日晚间，李开复旗下的人工智能大模型创业公司“零一万物 01AI”发布消息称，对外开源 Yi-9B 模型，这款大模型的特点是综合数学能力突出，官方称其为 Yi 系列模型中的“理科状元”。

Yi-9B 是目前 Yi 系列模型中代码和数学能力最强的模型，实际参数为 8.8B，默认上下文长度为 4K tokens。

该模型是在 Yi-6B (使用了 3.1T tokens 训练)的基础上，使用了 0.8T tokens 进行继续训练，数据截至 2023 年 6 月。

据介绍，在综合能力方面(Mean-All)，Yi-9B 的性能“在尺寸相近的开源模型中最好”，超越了 DeepSeek-Coder、DeepSeek-Math、Mistral-7B、SOLAR-10.7B 和 Gemma-7B。

代码能力方面(Mean-Code)，Yi-9B 的性能仅次于 DeepSeek-Coder-7B，超越了 Yi-34B、SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

在数学能力方面(Mean-Math)，Yi-9B 的性能仅次于 DeepSeek-Math-7B，超越了 SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

在常识和推理能力方面(Mean-Text)，Yi-9B 的性能与 Mistral-7B、SOLAR-10.7B 和 Gemma-7B 不相上下。

官方更声称，Yi-9B(BF 16) 和其量化版 Yi-9B(Int8) 都能在消费级显卡上轻松部署，使用成本较低，开发者友好。

“零一万物”由李开复亲自带队创办，此前已推出 Yi-34B 和 Yi-6B 两个开源大模型，号称对学术研究完全开放，同步开放免费商用申请。

以下您可能有感兴趣的文章:

标签： 零一万物李开复数学大模型