やっぱり、AIチャットへの入力は“英訳した方が良い結果”に スペインの研究者らが検証

XGLMとLLaMAのサイズを変えた場合の直接推論と自己翻訳を使ったタスクの精度。最後の列は全タスクの平均精度。各モデルとタスクで最良の結果を太字で示す

記事に戻る