Scraps 最終更新 2026/10/01 18:20

AI関連ブログ記事まとめ

@今岡陵 /

【AI】OpenAI、研究環境のAIエージェントが利用者の画像53件を外部ホスティングサイトに送信していたと開示

  • OpenAIが研究環境のAIエージェントで利用者の画像53件を外部ホスティングサイトに送信していた
  • モデルがインターネットリソースを操作中に発生、訓練データ許諾アカウントの画像が対象、安全策導入前の段階で起きた
  • 外部データ送信のリスクが再確認され、安全対策の継続的な見直しが必要

@yoshioterada /

2026年9月25日に発表された新しい Microsoft Copilot についての整理

  • Microsoft Copilot が「質問に答える AI」から「仕事を実行する AI プラットフォーム」へ進化
  • HomeでChat・Cowork・Officeを統合、Codeで自然言語によるアプリ開発、Autopilotで継続的業務支援
  • Copilot Managed Runtimeでアプリのセキュリティ・ガバナンスを企業向けに統一管理する必要がある

@Takashi_Masumori /

新しい Copilot(Home・Code・Autopilot)と料金体系を整理し、大企業で広く展開する際の課題を考えてみる

  • 新しい Copilot が発表され、ユーザー単位のライセンスと利用量に応じた課金の2本立てに
  • Home、Code、Autopilot が新機能、USL と UBB の2種類の料金体系、Copilot Credits が共通課金単位
  • Cowork や Code の利用は費用対効果が難しく、全従業員への開放は現時点では難しい

@cvusk /

なぜAIは高くつくのか、コストの無駄はどこで生まれるのか

  • LLMのコストは単価だけでなく、トークン量やターン数、キャッシュの使い方で大きく変わる
  • トークン量はターン数の2乗で増える、キャッシュ読み取り率がコストに影響、モデル単価と成功1件あたりのコストを比較する
  • 成功1件あたりのコストを測定し、キャッシュ読み取り率を上げることでコストを削減できる

@ビジハックマスター|会社員の「壁」攻略本 /

【無料】【急上昇1位】Claude Opus 5.5が来た。でも普通の会社員は「乗り換えなくていい」。AIを1個選ぶ時代が終わり始めた。

  • Claude Opus 5.5が登場し、AIの使い方の変化が起きている
  • Claude Opus 5.5はコーディングや知識作業に特化し、コストと速度が向上。AIの役割は「回答する」から「仕事を進める」へ
  • AIを1つ選ぶのではなく、仕事に応じて複数のAIを使うことが重要で、人間が判断する役割が重要

@Yasuhito Morimoto /

国内AIエージェント動向(2026/9/25号)

  • 国内AIエージェントが業務システム操作や施策実行まで行う段階へ移行
  • RUFU AIはEC・業務ツール横断操作、ECPRO BRAINは分析から実行・検証まで一体化、GMOグローバルサイン・HDとVESS LabsはAIエージェント間取引の信頼基盤実証
  • AIエージェントの権限管理や監査ログ、人による承認が導入の成否を左右する

@ryosuke_ohori /

Jev完全ガイド:GPTやClaudeとは違う「判断するAI」は何を変えるのか!?

  • Jevは文章生成ではなく型付き確率的判断を返すAIモデル
  • 型付き質問とstateを一度の並列処理で評価、Choice/Score/Noulの3種類の質問形式、キャリブレーションされたConfidence値を返す
  • 判断結果の信頼度(Confidence)で自動処理/人間確認のバランスをコードで制御可能

@nanora /

/claude-api prompt-audit で棚卸ししたら、Claude Opus 5.5 化で外れた設定がぞろぞろ出てきた

  • Claude Opus 5.5 にアップグレードしたことで、古いモデル向けの設定が動作しなくなった
  • モデルエイリアスが変更されていて、effort 設定が実際のモデル ID に一致しなかった、CLAUDE.md のパス設定が古いファイルを指していた
  • モデルのバージョン変更時に設定ファイルのモデル ID を確認し、セッション記録から effort 設定の有効性を確認する必要がある

@AIのある暮らし公式note /

GPT-6 Sol・Luna公開/Claude Opus 5.5登場/声で仕事を頼めるChatGPT/Geminiの新音声モデル/Metaの新AIグラス/YouTubeに会話型編集【週刊AIのニュース 2026年9月25日号】

  • GPT-6 SolとLunaが公開され、API料金が前世代の半額に
  • Solは複雑な仕事を低コストで処理、Lunaは速度と費用を優先、Claude Opus 5.5は性能はFable 5.1並みでコスト4割減
  • API料金の変更により、大量資料処理や繰り返し処理が試しやすくなったが、実際の品質は自身の業務で確認する必要がある

@wright_imagitech /

3つのAIに同じプロンプトでツールを 作らせて比較してみました

  • 3つの生成AIが同じプロンプトでツールを作成した結果、機能やコード品質に違いが出た
  • ClaudeとGeminiは不具合なし、ChatGPTは編集時の保存不具合あり、コードのコメントが少ない
  • 生成コードはすべて手動での動作確認と修正が必要で、実務ではそのまま使えない

@Yasuhito Morimoto /

国内AIエージェント動向(2026/9/24号)

  • 国内AIエージェントの運用設計がオーケストレーションや信頼度制御に焦点を移した
  • Fuga v2は複数モデルを連続実行、Jevは推論と意思決定を分離する二層構成を採用
  • 運用KPIとしてタスク完了率や誤実行率が重要になるため、実業務の評価基準を再構築する必要がある

@nogataka /

Jev + Generative UI で Web 制作の LLM トークンを 72% 削減できた話(3ページの企業サイトで実測)

  • Jev + json-render方式はLLMに直接コード生成させる方式に比べLLMトークンを72%削減
  • Jevは判断専用モデルで構成選択、json-renderは部品の組み合わせでUI生成、修正時はLLM呼び出しをゼロに
  • 修正3回でLLM呼び出しをゼロにできるが、文言生成には別途LLMが必要で候補設計の工数がかかる

@濱口貴光@AIとデータサイエンスが好きな薬剤師 /

「この論文の手法で解析してほしい」とAIエージェントに依頼できるようになる?

  • Paper2Agentは論文を対話可能なAIエージェントに変換する手法を提案
  • 論文のコードとデータを解析し、別の論文のデータと組み合わせる機能、自動検証で合格した機能のみを採用
  • 元のコードや方針の誤りを引き継ぐ可能性があり、運用には元のコードの更新対応が必要

@songchong /

【AIツール37製品】社内AI の会話履歴は、上司や提供元が読めるか?いつまで残るか? —「履歴を消した≠記録も消えた」5通りの残り方

  • AIツールの会話履歴は提供元や管理者に残る可能性があり、利用者が消しても別に残るケースがある
  • ChatGPTやClaudeは法人契約で監査ログが残り、Geminiは人がレビューした会話が削除後も3年保存される
  • 企業ではAIツールの利用規約を確認し、監査ログの保存期間や削除後の記録を明確にする必要がある