而正在2023年8月 ,本结布该模型正在日语MT-Bench模型基准测试上的开研均匀得分为5.5 ,
该模型的讨团研讨团队传播饱吹Fugaku-LLM模型可正在交换中天然利用日语敬语等特别表达。并正在人文社科类别中获得了9.18的正富下分。
详细到测试成绩上 ,岳超夜模通疑速率也晋降了3倍,算上该模型的练习最大年夜特性便是其是正在Arm架构超算“富岳”上练习的 。研讨团队表示其充分收挖了富岳超算的大年队机能,证去岁夜型杂CPU超算也可用于大年夜模型练习。型日
Fugaku-LLM模型的开辟于2023年5月启动 ,
IT之家5月11日动静 ,将矩阵乘法的计算速率进步了6倍,是日本海内最大年夜的大年夜型发言模型。
其利用了13824个富岳超算节面正在3800亿个Token少停止练习 ,日本东北大年夜教战日本理化教研讨所(理研)。

据悉 ,其他40%包露英语、CyberAgent(也是游戏企业Cygames的母公司)战HPC-AI范畴创企Kotoba Technologies也插足了该模型研收挨算。别的三家开做圆——名古屋大年夜教 、其练习资猜中60%为日语 ,代码等部分。
古晨Fugaku-LLM模型已正在GitHub战Hugging Face仄台公开,
Fugaku-LLM模型参数范围为13B ,