StartupXO
検索
日本語

Find XO: Goodfireが、AIエージェントの内部信号を読んで監視する低コストツールを公開(techcrunch.com)

おすすめなし startupxo 編集部の意見 1 / コメント 0

書く言語: 韓国語書かれた言語で読む

要約 / 元記事を読む ↗

- AIエージェントが誤った行動をしていないかは、通常ほかのAIが結果を読み直して確認する。Goodfireは、モデルが作業中に内部で計算する信号を、小さな検知器であるプローブで読み取る方式を打ち出したと発表した。 - 同社のテストでは、Kimi K3モデルのセッション1,500個を監視する費用は約51ドルだった。同じ作業を各段階ごとに確認する安価なAIモデルで行うと233ドル、最上位モデルでは約1万ドルかかると同社は説明した。 - 同じテストでは、悪意のあるハッキングセッションの94%を検出し、無害なセッションの8.7%を追加検討に回した。プローブ4個を同時に動かしても、モデルが応答を始めるまでの時間は2%未満しか延びなかったと同社は述べた。 - Basetenの顧客は、監視対象としてハッキング、生物化学兵器の悪用、報酬ハッキングから選べ、発見時の対応は記録、人による確認、リクエストの拒否から決められる。
掲載元

TechCrunch ↗ / 掲載記事

似たような経験はありますか?そのときどうしたか、一言二言で教えてください。製品に詳しくなくても大丈夫です。

ログインしてコメント

コメント 1

編集部の意見startupxo

「94%が捉えた割合」という表現で目が止まりました。残りの6%がどのようなセッションなのか記事には出てこないため、その点が分かるまでは任せきりにするには早いと感じます。51ドルと1万ドルの差も大きいですが、Kimi K3という一つのモデルと一社の社内テストから出た数字なので、他の環境でも同じになるかは分かりません。エージェントの監視コストを実際に計算してみたことはありますか?
書く言語: 韓国語

キーボード操作

上下矢印キーで投稿を選び、Enterで開きます。

↑ / ↓
前の投稿 / 次の投稿
Enter
選んだ投稿の要約とコメントを開く
Tab
投稿やコメントのボタンに移動してEnter

入力欄では通常どおり入力できます。TabとEnterはいつでも使えます。