欢迎访问 生活随笔!

ag凯发k8国际

当前位置: ag凯发k8国际 > 编程资源 > 综合教程 >内容正文

综合教程

百川智能与鹏城实验室宣布合力研发“鹏城-ag凯发k8国际

发布时间:2024/9/19 综合教程 48 生活家
ag凯发k8国际 收集整理的这篇文章主要介绍了 百川智能与鹏城实验室宣布合力研发“鹏城-百川·脑海33b”大模型 小编觉得挺不错的,现在分享给大家,帮大家做个参考.

11月16日消息,百川智能与鹏城实验室宣布携手探索大模型训练和应用,合作研发基于国产算力的128k长窗口大模型“鹏城-百川·脑海33b”。

鹏城实验室表示,双方在合作过程中能够充分发挥各自优势形成合力,更好地满足我国不断增长的智能化转型需求,助力中国人工智能产业快速崛起。

百川智能表示,本次百川智能与鹏城实验室合作研发“鹏城-百川·脑海33b”长窗口大模型,是国产算力大模型技术创新和落地的一次突破。未来,百川智能将在技术、算力等诸多维度不断深化与鹏城实验室的合作,持续助力本土大模型创新发展。

与此同时,百川智能和鹏城实验室展示了双方共同研发的“鹏城-百川·脑海33b”大模型。“鹏城-百川·脑海33b”的128k长上下文窗口基于“鹏城云脑”国产算力平台训练,未来可升级至192k,是基于国产算力训练的最长上下文窗口。

据介绍,为了更好地提升“鹏城-百川·脑海33b”上下文窗口长度和模型整体性能,百川智能和鹏城实验室对模型进行了全流程优化。在数据集构建方面,采用精细的数据构造,实现了段落、句子粒度的自动化数据过滤、选择、配比,良好的提升了数据质量;在训练架构上,通过normhead、max-z-loss、dynamic-lr等自研或业界领先的模型训练优化技术,对transformer模块进行深度优化,确保模型收敛稳定的同时,全面提升了模型优化效率和最终效果;此外,还在全生命周期的模型工具集中,通过与北京大学王亦洲、杨耀东老师团队的合作,首创了带安全约束的rlhf对齐技术,有效提升了模型内容生成质量和安全性。

未来,双方将在国产算力大模型技术创新和模型落地等方面继续加强合作,并与相关领域的优势单位如北京大学、清华大学等开展协同创新,助力本土大模型在模型性能、技术创新方面持续突破。(一橙)

总结

以上是ag凯发k8国际为你收集整理的百川智能与鹏城实验室宣布合力研发“鹏城-百川·脑海33b”大模型的全部内容,希望文章能够帮你解决所遇到的问题。

如果觉得ag凯发k8国际网站内容还不错,欢迎将ag凯发k8国际推荐给好友。

网站地图