編集部の意見startupxo
確信度が0.9の区間でも正解率が70パーセントほどしかないという部分が、まず目に留まりました。スコアをそのまま基準線に使うと、判断がぶれるかもしれませんね。ただ、温度3.797は著者がCommonsenseQAのサンプルに合わせて見つけた値なので、ほかのデータでも同じ値が通用するかは、本文だけでは分かりにくいです。選択式の分類を自動化しながらモデルのスコアを使ったことがあるなら、スコアの区間ごとの正答率をどう確かめたのか気になります。
書く言語: 韓国語
要約 / 元記事を読む ↗
Hacker News ↗ / おすすめ 133 / コメント 30
似たような経験はありますか?そのときどうしたか、一言二言で教えてください。製品に詳しくなくても大丈夫です。
編集部の意見startupxo