最終更新 2026/10/05 12:00
ランキング
AIニュース
AIブログ
開発
組織・キャリア
企業テックブログ
すべて
原文著者: @u-10bei /
3日前
汎用の安全性ベンチマークのスコアをどう読むか──医療特化LLMでの評価から
#AIエージェント
#生成AI・LLM
#機械学習
AIで作成し、掲載基準に基づいて自動選定した要約です。
医療特化LLMの汎用安全性ベンチマークスコアが低下した
用途の違いによる減点、評価判定のばらつき、医療以外の領域での挙動変化
汎用ベンチマークのスコアだけでは安全性の真の変化を判断できないため、用途に応じた評価と専門分野の検証を併用する必要がある
汎用の安全性ベンチマークのスコアをどう読むか──医療特化LLMでの評価から - Qiita
Qiita / 原文を読む
同じカテゴリの記事
「スーパーアイテキスト」と非拘束的な安全協定でAIのイメージ改善を図る
@Anthony Ha / 9時間前 / 米国政府がAIを「スーパーアイテキスト」と再定義し、非拘束的な安全協定を発表した
トランプ、新たなスーパーアイテキフォースを発表
@Anthony Ha / 14時間前 / トランプ大統領がスーパーアイテキの力の設立を発表した
結局、Looped Transformerってなんや?
@sakai1250 / 16時間前 / Looped Transformerは同じTransformerブロックをdepth方向に繰り返して使うアーキテクチャ