Scraps 最終更新 2026/09/08 10:33

原文著者: @y.takayama /

【Nishika 論文サク読み 第24回】DiaScriber

  • #生成AI・LLM
  • #機械学習
  • #AIエージェント

AIで作成し、掲載基準に基づいて自動選定した要約です。

  • DiaScriberは話者ダイアライゼーションと文字起こしを1モデルで行うMSASRモデル
  • Qwen3-ASR由来の音声エンコーダとQwen3.5-Omniの23B MoEを組み合わせ、85,000時間の学習データを使用
  • 公開5セットでは3セットでMOSSに負けていることが判明し、モデルサイズだけでは性能が確保できないことが示されている
【Nishika 論文サク読み 第24回】DiaScriber

Zenn / 原文を読む