Scraps 最終更新 2026/09/30 07:30

原文著者: @カノン@Zenn /

RX 5500 XTからV100S×4まで、4台の計算機でローカルLLMを測り比べた話

  • #AIエージェント
  • #バックエンド
  • #クラウド

AIで作成し、掲載基準に基づいて自動選定した要約です。

  • 4台のGPUでローカルLLMの性能を測定し、pp512とtg128の差が主な指標となった
  • pp512は行列演算器の有無で、tg128はメモリ帯域で差が決まる。V100SはHBM2でtg128が速く、RDNA4はVulkanの方がROCmより速い
  • pp512は行列演算器の有無が重要で、tg128はメモリ帯域の効率が鍵。マルチGPUは容量拡張に有効で、ベンチマークと実運用の差に注意が必要
RX 5500 XTからV100S×4まで、4台の計算機でローカルLLMを測り比べた話

Zenn / 原文を読む