李开复旗下AI公司零一万物宣布开源Yi-9B模型,号称同系列代码、数学能力最强

2024-03-06每日热点

  IT之家 3 月 6 日消息,“零一万物 01AI”官方公众号今晚发文宣布开源 Yi-9B 模型,官方称其为 Yi 系列模型中的“理科状元”——Yi-9B 是目前 Yi 系列模型中代码和数学能力最强的模型,实际参数为 8.8B,默认上下文长度为 4K tokens。

  该模型是在 Yi-6B (使用了 3.1T tokens 训练)的基础上,使用了 0.8T tokens 进行继续训练,数据截至 2023 年 6 月。

  据介绍,在综合能力方面(Mean-All),Yi-9B 的性能“在尺寸相近的开源模型中最好”,超越了 DeepSeek-Coder、DeepSeek-Math、Mistral-7B、SOLAR-10.7B 和 Gemma-7B。

  代码能力方面(Mean-Code),Yi-9B 的性能仅次于 DeepSeek-Coder-7B,超越了 Yi-34B、SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

  在数学能力方面(Mean-Math),Yi-9B 的性能仅次于 DeepSeek-Math-7B,超越了 SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

  在常识和推理能力方面(Mean-Text),Yi-9B 的性能与 Mistral-7B、SOLAR-10.7B 和 Gemma-7B 不相上下。

  官方更称,Yi-9B(BF 16) 和其量化版 Yi-9B(Int8)都能在消费级显卡上轻松部署,使用成本较低,开发者友好。

  据IT之家此前报道,该公司由李开复创新工场董事长兼 CEO 带队创办,此前已已推出 Yi-34B 和 Yi-6B 两个开源大模型,号称对学术研究完全开放,同步开放免费商用申请。

标签: 今日热榜

“李开复旗下AI公司零一万物宣布开源Yi-9B模型,号称同系列代码、数学能力最强” 的相关文章

神牛推出Xnano触摸屏TTL无线引闪器:OLED屏+实体旋钮、兼容六种相机系统

神牛推出Xnano触摸屏TTL无线引闪器:OLED屏+实体旋钮、兼容六种相机系统

  IT之家 1 月 16 日消息,神牛昨天发布一款名为 Xnano 的触摸屏 TTL 无线引闪器,对应六种相机系统分为 C / N / S / F / O 五个版本,售 498 元,暂未...

师承方程豹豹5 比亚迪皮卡内饰谍照曝光:超级硬核

师承方程豹豹5 比亚迪皮卡内饰谍照曝光:超级硬核

  快科技2月2日消息,除了硬派越野车,比亚迪还将开发全新的皮卡车型,近日,其内饰首次得到曝光。   据悉,原型车已经抵达海外进行测试,预计混动版车型...

这类芯片,终于爆火

这类芯片,终于爆火

  以生成式模型为代表的人工智能对于整个芯片半导体行业正在造成巨大的影响。我们看到了云端人工智能让Nvidia的GPU变成了最抢手的芯片,同时在手机端,人工智能也在成为各大新手机发布会的亮...

华为:海外手机暂无使用HarmonyOS的计划

华为:海外手机暂无使用HarmonyOS的计划

  财联社11月20日电,有消息称华为鸿蒙系统明年将不再兼容安卓,华为方面暂未对此回应华为:海外手机暂无使用。但华为方面表示HarmonyOS的计划,目前海外手机暂无使用HarmonyOS...

一理想MEGA挂“5个8”豹子号车牌 网友:车牌比车贵多了吧

一理想MEGA挂“5个8”豹子号车牌 网友:车牌比车贵多了吧

  快科技3月20日消息,日前,有网友分享的一组照片显示,一辆新上牌的理想MEGA,悬挂上了“88888”的豹子号,引起网友关注热议。   有网友表示,“这车牌比车贵吧?...

2024年又一裁:消息称思科计划裁员数千人,以专注于“高增长”领域

2024年又一裁:消息称思科计划裁员数千人,以专注于“高增长”领域

  IT之家 2 月 11 日消息,据路透社报道,有三位熟悉内情的消息人士声称,网络巨头思科正计划进行业务重组,其中一项计划包括裁员数千人,以专注于高增长领域。(暂未透露涉及员工的部门及职...