李开复旗下AI公司零一万物宣布开源Yi-9B模型
IT之家
2024-03-06 22:40:38

原标题:李开复旗下AI公司零一万物宣布开源Yi-9B模型

IT之家 3 月 6 日消息,“零一万物 01AI”官方公众号今晚发文宣布开源 Yi-9B 模型,官方称其为 Yi 系列模型中的“理科状元”——Yi-9B 是目前 Yi 系列模型中代码和数学能力最强的模型,际参数为 8.8B,默认上下文长度为 4K tokens

该模型是在 Yi-6B (使用了 3.1T tokens 训练)的基础上,使用了 0.8T tokens 进行继续训练,数据截至 2023 年 6 月。

据介绍,在综合能力方面(Mean-All),Yi-9B 的性能“在尺寸相近的开源模型中最好”,超越了 DeepSeek-Coder、DeepSeek-Math、Mistral-7B、SOLAR-10.7B 和 Gemma-7B。

代码能力方面(Mean-Code),Yi-9B 的性能仅次于 DeepSeek-Coder-7B,超越了 Yi-34B、SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

在数学能力方面(Mean-Math),Yi-9B 的性能仅次于 DeepSeek-Math-7B,超越了 SOLAR-10.7B、Mistral-7B 和 Gemma-7B。

在常识和推理能力方面(Mean-Text),Yi-9B 的性能与 Mistral-7B、SOLAR-10.7B 和 Gemma-7B 不相上下。

官方更称,Yi-9B(BF 16) 和其量化版 Yi-9B(Int8)都能在消费级显卡上轻松部署,使用成本较低,开发者友好。

据IT之家此前报道,该公司由李开复创新工场董事长兼 CEO 带队创办,此前已已推出 Yi-34B 和 Yi-6B 两个开源大模型,号称对学术研究完全开放,同步开放免费商用申请。

相关内容

热门资讯

光伏产业钙钛矿技术连获突破,多... 1月14日,天合光能光伏科学与技术全国重点实验室宣布,其研发的3.1平方米大面积钙钛矿/晶体硅叠层组...
三星5G基带芯片成功打入特斯拉... 1月14日消息,据韩国媒体The Elec报道,三星电子的车用5G 调制解调器(modem,基带芯片...
夸大功能、人工干预……“伪智能... 原标题:“伪智能”需要真监管(纵横) 智能炒菜机在烹饪过程中需要频繁人工干预,与解放双手的预期相去甚...
首次规模化应用、正式投产!珠海... 三一海工“平沙智造” 在全球超级大港首次规模化应用; 宏仁电子高阶覆铜板项目 在经开区正式投产; …...
AI点外卖、购物、订机票:阿里... 来源:雷科技 关注阿里千问的读者可能都知道,就在上个月(2025 年 12 月 18 日),千问 A...