王小川旗下百川智能发布Baichuan-53B大模型,宣称“写作、文本方

来源:IT之家2023-08-09 09:08    阅读量:6889   

,王小川旗下百川智能今日宣布发布大模型产品 Baichuan-53B,官方表示,“Baichuan-53B 大模型目前在写作、文本创作能力方面,已经达到行业最好的水平”。

不过IT之家发现,Baichuan-53B 定位“闭源大模型”,目前并没有在 GitHub、HuggingFace 处公布相关信息。

官方宣称,“Baichuan-53B 主要面向 B 端用户提供服务,发布后,该大模型也将启动内测,预计下个月将会开放 API 等相关组件”。

在此之前,百川智能已经发布了 Baichuan-7B、Baichuan-13B 两个通用大语言模型,感兴趣的小伙伴们可以在 GitHub 中找到相关内容。

图源 百川智能 GitHub 相关页面

据官方介绍,Baichuan-7B 是一个 70 亿参数量的中英文预训练大模型,在 C-Eval、AGIEval 和 Gaokao 三个最具影响力的中文评估基准进行了综合评估,并且均获得了优异成绩,它已经成为同等参数规模下中文表现最优秀的原生预训练模型。

Baichuan-13B 是由百川智能继 Baichuan-7B 之后开发的包含 130 亿参数的开源可商用的大规模语言模型,在中英文 Benchmark 上均取得同尺寸模型中最好的效果。

广告声明:文内含有的对外跳转链接,用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

关键词:

责任编辑:张璠

郑重声明:此文内容为本网站转载企业宣传资讯,目的在于传播更多信息,与本站立场无关。仅供读者参考,并请自行核实相关内容。