设置
  • 日夜间
    随系统
    浅色
    深色
  • 主题色

面壁智能发布 Eurux-8x22B 开源大模型:代码性能超越 Llama3-70B

2024/5/3 23:53:08 来源:IT之家 作者:泓澄(实习) 责编:泓澄
感谢IT之家网友 風見暉一 的线索投递!

IT之家 5 月 3 日消息,面壁智能发布开源大模型 Eurux-8x22B,包括 Eurux-8x22B-NCA 与 Eurux-8x22B-KTO,主打推理能力。

官方测试中,Eurux-8x22B 在 LeetCode(180 道 LeetCode 编程真题)与 TheoremQA (IT之家注:美国大学水准的 STEM 题目)测试超越了 Llama3-70B,在 LeetCode 测试上超越闭源的 GPT-3.5-Turbo。

官方测试结果

▲ 官方测试结果

据介绍,Eurux-8x22B 模型激活参数 39B,支持 64k 上下文,是由 Mixtral-8x22B 模型对齐而来,在 UltraInteract 对齐数据集上训练而成。

官方测试数据

▲ 官方测试数据

UltraInteract 是专门设计用于提升大模型推理能力的大规模、高质量的对齐数据集,包含了覆盖数学、代码和逻辑推理问题的 12 个开源数据集的 86K 条指令和 220K 偏好对,共有五十万条左右数据。

UltraInteract 过程

UltraInteract 示例

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

相关文章

关键词:面壁智能LLM大模型

软媒旗下网站: IT之家 最会买 - 返利返现优惠券 iPhone之家 Win7之家 Win10之家 Win11之家

软媒旗下软件: 软媒手机APP应用 魔方 最会买 要知