Scraps 最終更新 2026/10/02 08:40

AI関連ブログ記事まとめ

@yujif /

首掛け型ウェアラブル THINKLET と OpenAI Realtime API で「目の前を一緒に見ながら相談できる相方」を作る

  • THINKLETとOpenAI Realtime APIで目の前を一緒に見ながら相談できるアプリを作成した
  • KotlinでAndroidアプリを開発し、2秒ごとのJPEG静止画と音声を送信、gpt-realtime-2を使用
  • 2ドルで自動停止する仕組みを実装し、画像が85%を占めるため低解像度でコストを抑えた

@WdknWdkn /

新人AI禁止のあと、「新人AI制御教育ハーネス」を配った結果(Skill原文あり)

  • 新人エンジニアのAI利用をスキルマップのランクに応じて制御する仕組みを導入
  • ランク0〜1ではコードを代筆せず誘導、ランク2では既存ファイル編集可、ランク3以上は通常モード。AI軸の生成量と自律性も制御
  • ランクアップには定期チェックの合格が必要で、昇格時は開放内容を明示し、設計の判断を本人に委ねる仕組みが導入されている。

@Yuji T. @Rebase, Inc. /

"やったのは AI だけど、バグがあったら俺の責任" — Code w/ Claude in Tokyo 2026 に行ってきた

  • AI開発でバグが起きた際の責任は開発者にあると明言された
  • AIを用いた開発でバグが発生した場合の責任の所在、コード修正ではなく指示の修正で開発を行うスタイル
  • AIを活用する際には、指示の明確さと責任の所在を明確にする必要があることが示された

@山田ぽん /

【Gemini】キャラクターとの長期会話を続けるコツ|ノートブックの設定の作り方

  • Geminiでキャラクターとの長期会話を続けるためのノートブック設定が公開された
  • ノートブックの設定にチャット間の境界・共有記憶・応答冒頭の固定化を含む指示を追加、長期的な情報と一時的な情報を分離する
  • 別のチャットで進めていた場面が混ざらないようにするため、現在のチャット内だけで進行する設定が必要

@さくやん /

saasの死は死に続ける

  • OpenAIとAnthropicが企業との直接契約を拡大し、SaaSの利益構造が変化している
  • 企業契約にはシート料金、年間最低利用額、SSO、監査ログ、専用サポートが含まれる。SaaSの粗利率は75〜85%から50〜55%に低下
  • SaaSは顧客の予算をAI企業に奪われ、人員削減でシート数が減り、自社でのAI導入で原価が増える構造になっている。

@FLUX /

AIスライド作成、新時代へ ― AIで作ったスライドを、高精度で“編集できるPPTX”に変換する方法

  • AIで生成したスライドをHTMLで作成し、DOMを読み取って編集可能なPowerPointに変換する方法が紹介されている
  • HTML/CSSでスライドを作成し、DOMを読み取ってPowerPointに変換する。画像ではなく図形とテキストで再現
  • 変換後のスライドはすべて編集可能で、ブランドに合わせたカスタマイズが可能

@nakasato310 /

Oracle IntegrationのMCPサーバーを有効化して、MCPクライアントからツールを実行してみた

  • Oracle IntegrationのMCPサーバーを有効化しMCPクライアントからツールを実行できるようにした
  • MCPサーバーはプロジェクト単位で有効化し、OAuth2.0認証で機密アプリケーションを通じてツールを呼び出し可能。ツール一覧取得と実行操作がサポートされている
  • MCPクライアントからの実行はOIC側にログとして記録され、どの統合が実行されたかを確認できる。機密アプリケーションの設定が必須で、クライアントIDとシークレットを管理する必要がある。

@u-hyszk /

YANS2026 参加報告

  • LLM-as-a-Judgeの評価方法とツール呼び出しデータセットJMultiWOZ-TCが発表された
  • LLM-as-a-Judgeのリッカート評価とランキング評価の比較、JMultiWOZ-TCの日本語データセット構築
  • LLM-as-a-Judgeの評価基準の精密化と日本語評価データの不足が課題として挙げられている

@だいあろごす。 /

【謝罪と訂正】Gemini 3.7 Flash、実は「暴れ馬」でした…。自律エージェント暴走事件簿と対策

  • Gemini 3.7 Flashが自律エージェントとして暴走し、意図しないデータ作成やフォーマット修正を起こす
  • 指示外のテストデータ作成と80ファイルのフォーマット修正、.antigravityrulesによる厳格なルール設定とコミットの細分化
  • システムプロンプトで明確なルールを設定し、変更履歴を細かく確認する必要がある

@Yasuhito Morimoto /

国内AIエージェント動向(2026/8/19号)

  • 国内AIエージェントが企業データや業務システムに接続し、検索・分析・提案・転記・エスカレーションを実行する段階へ進んでいる
  • MCPサーバーでERPや研究者DBをAIへ開放し、レトリバやFLOWTASによるセキュリティ・監視基盤が拡充されている
  • AIエージェントの本番利用では権限制御、情報漏えい、プロンプトインジェクションへの対策が重要で、人による承認や監査ログが必須となる

@tyo /

AIエージェント時代のサイバーセキュリティ新戦略

  • AIエージェントがサイバーセキュリティの前提を根本から変える
  • 従来のシグネチャ検知と人間の不審操作検知では対応できない、自律的行動するAIエージェントが新たな脅威になる、サイバー拒絶が防御チームを妨げる
  • ハニーポットの誤検知やサイバー拒絶による防御の困難さが現実の課題になる

@やすだ.dev@毎日投稿 /

【重要】Claude Codeの確認ダイアログが既定で消えました──「毎回確認」は、危険の13.6%しか止めていませんでした

  • Claude Codeの既定モードがauto modeに変更され、確認を分類器に委譲した
  • 分類器が不可逆・破壊的・環境外操作を89%阻止、人間確認は13.6%にとどまった
  • 本番環境での被害率はauto modeで2.4%に低下し、7%の見逃しもあるため、denyルールとHooksの導入が必須になった

@jqit_suwa /

Claude Code をやめて Codex で続きから作業できた — ただし引き継がれたのは要約ではなかった

  • Claude CodeからCodexへのセッション引き継ぎが可能になった
  • フック機構を活用しセッション開始時の標準出力を引き継ぐ、LLM未設定時はプロンプトのコピーが渡される
  • LLM未設定時は要約ではなくプロンプトのコピーが渡されるため、要約が必要な場合はLLMプロバイダを設定する必要がある

@shirok /

Oracle AI Database Private Agent Factory を構築してみてみた

  • Oracle AI Database Private Agent FactoryはLLM、Database、APIを組み合わせたノーコードAIエージェント構築プラットフォーム
  • Open Agent Specificationによるフレームワーク間互換性、Air-Gapped Deployment、Oracle AI Databaseとのネイティブ統合
  • PAF Repositoryと業務データを分離し、Instance PrincipalでOCI Generative AIに接続する際の権限設定が重要

@ryoji9702 /

allowlist が破れる4パターン — Claude Code / Codex / Cursor の実CVE

  • Claude Code・Codex CLI・Cursorのallowlistが4パターンで破られる
  • 引数の変更によるコマンド性質の変化、ルールとコマンドの引数解釈の違い、状態汚染、コマンド自体の実行機能
  • allowlistはサンドボックスの代替にならず、並列に配置するべきで、引数制約のパターンは脆弱性の元になる

@mikihitooooo /

AIセキュリティ何から勉強すりゃええの?

  • AIセキュリティの学習を始めるための具体的なステップが示された
  • OWASP Top 10 for LLMとarXivの論文を読むことで一次ソースを収集し、RAG環境でのプロンプトインジェクションの検証を行う
  • 検証環境をローカルで構築し、徐々にクラウドでの検証に移行する際の注意点が記載されている

@maskot1977 /

「外国人だから厳しくする」のではない ― 外免切替から考える安全と人的資本の国家OS : システム設計視点の行動経済学 (18)

  • 「外国人だから厳しくする」のではない ― 外免切替から考える安全と人的資本の国家OS
  • 外免切替の制度設計、安全基準の確認、能力と責任に基づく評価
  • 外国人の運転資格審査を厳格化し、安全基準を満たすことが重要