零一万物宣布开源 Yi-9B 模型，号称同系列代码、数学能力最强

Typecho维基君 • 站长快讯 • 94次浏览 • 发布 2024-03-07 • 更新 2024-03-07

“零一万物 01AI”官方公众号发文宣布开源 Yi-9B 模型，官方称其为 Yi 系列模型中的“理科状元”——Yi-9B 是目前 Yi 系列模型中代码和数学能力最强的模型，实际参数为 8.8B，默认上下文长度为 4K tokens。

该模型是在 Yi-6B （使用了 3.1T tokens 训练）的基础上，使用了 0.8T tokens 进行继续训练，数据截至 2023 年 6 月。

据介绍，在综合能力方面（Mean-All），Yi-9B 的性能“在尺寸相近的开源模型中最好”，超越了 DeepSeek-Coder、DeepSeek-Math、Mistral-7B、SOLAR-10.7B 和 Gemma-7B。

代码能力方面（Mean-Code），Yi-9B 的性能仅次于 DeepSeek-Coder-7B，超越了 Yi-34B、SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

在数学能力方面（Mean-Math），Yi-9B 的性能仅次于 DeepSeek-Math-7B，超越了 SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

在常识和推理能力方面（Mean-Text），Yi-9B 的性能与 Mistral-7B、SOLAR-10.7B 和 Gemma-7B 不相上下。

官方更称，Yi-9B（BF 16）和其量化版 Yi-9B（Int8）都能在消费级显卡上轻松部署，使用成本较低，开发者友好。

该公司由李开复创新工场董事长兼 CEO 带队创办，此前已已推出 Yi-34B 和 Yi-6B 两个开源大模型，号称对学术研究完全开放，同步开放免费商用申请。

广告声明：文内含有的对外跳转链接（包括不限于超链接、二维码、口令等形式），用于传递更多信息，节省甄选时间，结果仅供参考，Typecho.Wiki所有文章均包含本声明。

厂商投放

腾讯云五一劳动节海量产品 · 轻松上云！云服务器首年1.8折起，买1年送3个月！超值优惠，性能稳定，让您的云端之旅更加畅享。快来腾讯云选购吧！

腾讯云

看完你可能还喜欢