大規模言語モデルは相関関係から“本当の”因果関係を推定できるのか? 40万個の問題で研究者らが調査

左が微調整したモデルの因果推論タスクの精度結果。右が微調整したモデルの頑健性テストを行った精度結果

記事に戻る