Mistral发布万亿参数模型Large 4

Mistral发布万亿参数开放权重模型Large 4。该模型基于欧洲自有数据中心训练,性能在非中国地区同类模型中领先,目前向开发者及政府机构开放预览,计划本月广泛发布。

Mistral 正式推出其最新人工智能模型 Mistral Large 4,内部代号“Le Chonk”。这是一款拥有 1 万亿参数的模型,Mistral 方面称其为在非中国地区开发的最强开放权重 AI 模型。

4000块GPU训练两月

据 CNBC 报道,ML4 的训练过程历时两个月,使用了部署在 Mistral 欧洲自有数据中心内的 4,000 块 Nvidia Grace Blackwell GPU。公司表示,当核心参数发布后,ML4 将在综合基准测试性能上跻身全球顶级开放权重模型行列,并强调其在非中国开发的开放权重模型中具有“显著优势”。

目前,该模型已向开发者、网络安全团队及政府机构开放预览,计划于本月晚些时候进行更广泛的发布。尽管整体表现强劲,但 ML4 在编码等领域仍落后于前沿水平。

Mistral 联合创始人兼首席科学家 Guillaume Lample 指出:“随着我们在 D 轮融资后扩大训练规模,模型能力将进一步提升。”他还补充道,该模型的网络安全防御功能将帮助企业和政府抵御那些通过越狱闭源模型来实施网络攻击的威胁行为者。

评论 0

0/500

评论需审核后展示,请文明发言

💬
还没有评论,来说两句

相关阅读