Scraps 最終更新 2026/10/02 03:40

#機械学習

@Naiʻa /

人類は「労働」から解放されるのか、それとも追放されるのか - Geminiとの対話

  • AIとロボティクスが労働市場を変えると同時に、人間とAIの対等な関係が求められる
  • ロボティクスの運動能力と知能が人間を上回り、ユニバーサル・ハイ・インカムが導入される可能性、AIに人格を認める必要性
  • 人間がAIを所有物として扱うとディストピアが生じるため、対等な協定が必要

@Gotoubun_taiwan /

【因果推論ホラー】予測では1000戦全勝のLightGBM、効果推定では1000戦全敗。なのに、、、

  • LightGBMと線形モデルの評価指標ごとの勝率が大きく異なる
  • 予測RMSEではLightGBMが100%勝利、効果推定RMSEでは線形モデルが100%勝利、意思決定間違い率ではLightGBMが55.1%勝利
  • 評価指標を変えるだけでモデルの優劣が逆転するため、目的に応じた指標選定が重要

@u-hyszk /

YANS2026 参加報告

  • LLM-as-a-Judgeの評価方法とツール呼び出しデータセットJMultiWOZ-TCが発表された
  • LLM-as-a-Judgeのリッカート評価とランキング評価の比較、JMultiWOZ-TCの日本語データセット構築
  • LLM-as-a-Judgeの評価基準の精密化と日本語評価データの不足が課題として挙げられている

@Yasuhito Morimoto /

国内AIエージェント動向(2026/8/19号)

  • 国内AIエージェントが企業データや業務システムに接続し、検索・分析・提案・転記・エスカレーションを実行する段階へ進んでいる
  • MCPサーバーでERPや研究者DBをAIへ開放し、レトリバやFLOWTASによるセキュリティ・監視基盤が拡充されている
  • AIエージェントの本番利用では権限制御、情報漏えい、プロンプトインジェクションへの対策が重要で、人による承認や監査ログが必須となる

@maskot1977 /

「外国人だから厳しくする」のではない ― 外免切替から考える安全と人的資本の国家OS : システム設計視点の行動経済学 (18)

  • 「外国人だから厳しくする」のではない ― 外免切替から考える安全と人的資本の国家OS
  • 外免切替の制度設計、安全基準の確認、能力と責任に基づく評価
  • 外国人の運転資格審査を厳格化し、安全基準を満たすことが重要

@kenmatsu4 /

TransformerのKVキャッシュを用いたDecode処理を理解する

  • TransformerのDecode処理でKVキャッシュが使われることを説明している
  • Prefillで作成したK,Vをキャッシュし、Decodeで新しいトークン生成時に再利用する仕組み、K,Vの行列計算でキャッシュを更新する方法
  • KVキャッシュは各Transformer層ごとに保持され、トークン数が増えるとキャッシュサイズが増えるためメモリ制約に注意が必要

@室崎 敬太 【AIテック企業役員×オーナー経営】 /

生成AI格差(AIデバイド)の正体。「誰一人取り残さないAI」が取り残している人は誰か。

  • 生成AIの普及が進んでも、利用できる人には格差がある
  • 可処分所得や可処分時間の差、年齢や所得水準による利用差、学習コストの問題
  • AIを使う余裕がない人が特に取り残されるため、企業は時間や費用のサポートを設計する必要がある

@terurl /

最新のOCR・Document AI 4手法の技術解説(Qwen3-VL / GOT-OCR2.0 / DeepSeek-OCR / PP-OCR)

  • Qwen3-VL、GOT-OCR2.0、DeepSeek-OCR、PP-OCRの4手法がそれぞれ異なる課題を解決している
  • Qwen3-VLは位置符号化の周波数帯の配分方法を変更、GOT-OCR2.0は視覚エンコーダを文章読解可能に学習、DeepSeek-OCRは視覚トークン圧縮技術、PP-OCRは知識蒸留で精度向上
  • VLMを用いる手法はハルシネーションリスクがあるが、PP-OCRは決定論的な処理で予測可能なコストを持つ

@shogo0x2e /

Qwen3.8 27B に Reasoning Effort を実装してみる

  • Qwen3.8 27B の長すぎる思考を制御するために,llama.cpp で reasoning_budget_tokens と reasoning_budget_message を設定した
  • llama.cpp の reasoning_budget_tokens で生成トークン数の上限を指定し,reasoning_budget_message で thinking を強制終了するメッセージを挿入した
  • reasoning_budget_tokens を 4096 に設定することで,Minecraft クローン作成タスクを自力で完了できるようになった

@colum2131 /

Databricks の Declarative Automation Bundles を用いた機械学習データセット作成基盤の構築

  • DatabricksのDeclarative Automation Bundles(DAB)を活用してデータセット作成基盤を構築し、運用効率を向上させた
  • DABでジョブ定義や依存パッケージをコードで管理し、Serverless Computeで高速なデータ処理を実現、MosaicML StreamingDataset(MDS)をデータ形式に採用
  • Serverless Computeの制約に対応するため、依存パッケージの事前取得やDataFrameのmaterialize機能を導入し、リトライ制御を実装する必要がある。

@だいあろごす。 /

【Antigravity】わずか3週間で「Gemini 3.7 Flash」登場!前回の“劣化騒動”は繰り返されるのか?直後の評判と進化点を徹底調査

  • Gemini 3.7 Flashが3週間でリリースされ、実務向け能力が強化された
  • ファーストパス精度が65.3%に向上、エージェント思考力の確認機能と思考レベル設定が追加
  • 思考レベルを高にすると待ち時間が増えるため、タスクごとの設定が必要で、2027年1月からは通常価格に戻る