ai2026/6/2 13:00:00

医療用大規模言語モデルの安全性、ロバスト性、公平性評価のためのマルチドメインレッドチーミングフレームワーク
ニュース概要
大規模言語モデル(LLM)はヘルスケア分野でますます導入されていますが、既存のベンチマークは臨床実践で一般的な対抗的または倫理的に複雑な条件下でのモデル動作を捉えることができません。11の現代的なLLMを6つのドメインで評価するマルチドメインレッドチーミングフレームワークを開発しました。
ニュースタイムライン
このトピックの関連記事はまだ十分にありません。
記事AI質問チャット
PREMIUMこの記事についてAIが質問に答えます。背景・要約・影響まで深堀り。
ログインして利用関連記事
こんな記事も読まれています
この記事について疑問がありますか?
事実誤認や不適切な内容について通報できます (要ログイン)。
異議申し立て・通報











