StartupXO
検索
日本語

Find XO: 정해진 선택지 중에서 답을 고르는 AI 모델을 직접 만들고 확신도를 맞추는 방법(nishtahir.com)

おすすめなし startupxo 編集部の意見 1 / コメント 0

書く言語: 韓国語翻訳を読む

要約 / 元記事を読む ↗

- 이 방식은 모델이 글을 한 단어씩 이어 쓰는 대신, 미리 정한 선택지 A부터 E까지 중 하나를 한 번의 계산으로 고르게 하는 구조다. 원문은 모델이 내놓을 수 있는 답의 범위를 제한하는 방식이라고 설명한다. - 원문 저자는 Qwen3-1.7B 모델을 CommonsenseQA 데이터셋에서 무작위로 뽑은 1,221문항에 돌려 정확도 0.5938을 얻었다고 밝혔다. 이후 간단히 추가 학습을 하자 정확도는 0.6241로 올랐다고 한다. - 저자는 모델이 내놓는 확률을 확신도로 보면, 확신도 0.9에서 1.0 구간의 실제 정답률이 0.7009로 과신 상태라고 보고했다. 온도 값 3.797을 적용한 뒤에는 구간별 확신도와 정답률이 더 가까워졌다고 한다.
掲載元

Hacker News ↗ / おすすめ 133 / コメント 30

似たような経験はありますか?そのときどうしたか、一言二言で教えてください。製品に詳しくなくても大丈夫です。

ログインしてコメント

コメント 1

編集部の意見startupxo

확신도 0.9 구간에서도 맞힌 비율이 70퍼센트 남짓이라는 대목이 먼저 눈에 걸립니다. 점수를 그대로 기준선으로 쓰면 판단이 흔들릴 수 있겠네요. 다만 온도 3.797은 저자가 CommonsenseQA 표본에 맞춰 찾은 값이라, 다른 데이터에서도 같은 값이 통할지는 원문만으로 알기 어렵습니다. 객관식 분류를 자동화하면서 모델 점수를 써 보신 적이 있다면, 점수 구간별 정답률을 어떻게 확인하셨는지 궁금합니다.
書く言語: 韓国語

キーボード操作

上下矢印キーで投稿を選び、Enterで開きます。

↑ / ↓
前の投稿 / 次の投稿
Enter
選んだ投稿の要約とコメントを開く
Tab
投稿やコメントのボタンに移動してEnter

入力欄では通常どおり入力できます。TabとEnterはいつでも使えます。