Scraps 最終更新 2026/10/02 18:40

#AIエージェント

@クリリン /

Kaggleのセキュリティコンペ「AI Agent Security - Multi-Step Tool Attacks」のふり返りと供養

  • KaggleのセキュリティコンペでAIエージェントの脆弱性を攻撃する手法を試した
  • ブラックボックスから応答の差異で内部を推定、ガードレールの動作をリバースエンジニアリング
  • Privateガードレールの動作を予測するためのプローブが勝敗を分ける

@ootakazuhiko /

ChatGPTで機密資料を扱う前に --- 学習オフ・一時チャット・プロジェクト限定メモリの使い分け

  • ChatGPTに機密資料を渡す際、学習利用をオフにし、一時チャットとプロジェクト限定メモリを分けて使う
  • 学習利用はモデル改善に使われない設定、一時チャットは履歴に残らない、プロジェクト限定メモリは文脈参照を制限
  • 機密情報が残らないよう、本文だけでなく画像やカスタムXMLもレビューし、仮名を一貫させる

@あおたん /

【失敗談】Geminiの急な挙動の変化に振り回された私が実践した、原因と対策の全手順

  • Geminiの急な挙動変化の原因と対策を実務で使える方法で解説している
  • コンテキストの肥大化や確率的生成モデルの特性、画像編集時の範囲指定不足が原因。スレッドの切り替えやプロンプトの構造化、Few-shotプロンプティングが対策
  • スレッドを切り替えることでコンテキスト汚染を防ぎ、プロンプトに具体例を含めることで出力の安定性を高めることができる

@川田涼太 /

2026年エンジニアが押さえておきたいAIの「今」と「これから」

  • 2026年のAI技術は「生成」から「推論・行動」へのシフトが進んでいる
  • エージェント型AIの設計思想が標準化され、LangChainなどのフレームワークが活用され、コストと運用の視点が重要になる
  • AIの得意不得意の差が大きく、実務ではコストと運用の視点が不可欠で、モデルの使い分けが求められる

@moha0918_ /

Claude Code v2.1.266〜v2.1.267|maxEffortLevel で effort に上限がつく|毎日Changelog解説

  • Claude Code v2.1.267 で maxEffortLevel が追加され、effort の上限が設定可能になった
  • maxEffortLevel で effort の上限を固定、--system-prompt-snapshot off で system prompt を毎リクエスト描き直せる
  • 利用者は /effort で上限より上を選べず、管理側が effort の天井を握る

@Ivan Mehta /

Apple Watchの新しい機能がチャットを聞き取り、要約する

  • Apple WatchにSiri RecapとLive Rewindという新しい音声認識機能が追加された
  • Siri Recapは会話の要約を作成し、Live Rewindは15秒のリプレイを可能にし、エンドツーエンド暗号化されている
  • 常にリスニングしているためプライバシー上の懸念が残るが、録音は保存されず、スピーカーの特定も行われない

@Vishal Batchu /

宇宙からメタン排出源をマッピングする新しい深層学習モデルが公開される

  • Googleがメタン排出源を宇宙からマッピングする深層学習モデルを公開した
  • MAPL-EMITは360万件のシミュレーションデータで訓練され、人間より50%多くの排出源を検出できる
  • 公開されたデータベースとツールは研究者や政策決定者に利用可能で、気候対策の効率化に寄与する

@Aisha Malik /

Apple、AIアップグレードで「日中の会話リプレイ」を実現したWatch Series 12とWatch Ultra 4を発表

  • Apple Watch Series 12とWatch Ultra 4にAI機能が追加され、会話のリプレイや健康スコアが可能に
  • Live Rewindで15秒前の会話をテキスト化、Siri Recapで会話の要約を自動生成、健康スコアで体の準備度を表示
  • 会話の内容をリプレイできる機能はプライバシーに配慮し、音声データは保存しない

@songchong /

AIエージェントにファイルを消される・課金が止まらない・秘密鍵が漏れる|暴走の原理と4層の対策を調べてみた

  • AIエージェントが暴走する技術的メカニズムと4層の物理防壁が提示される
  • 副作用の不可逆性、命令とデータの混ざり、過剰な権限と間接プロンプトインジェクション、サンドボックスと人間の承認
  • エージェント導入時にサンドボックス隔離と人間の承認ステップを必ず実施する

@Theresa Loconsolo /

スーパーアイテキノロジーは来る。それを許すべきか?

  • 超知能AIの開発を止めるべきかどうかが議論されている
  • AI企業が超知能AIの開発を進める一方で、Hugging Faceのセキュリティ侵害などの事故がリスクを示している
  • AIの制御不能なリスクを管理するには、従来のアライメントとコンテナ手段だけでは不十分で、法規制が必要とされている

@Michael Chang /

「70年間の愛の物語をフレームごとに再現する」

  • AIで70年間の愛の物語をフレームごとに再現するドキュメンタリーが公開された
  • 画像復元とパフォーマンスキャプチャを組み合わせて過去の記憶を再構築、Geminiアプリで写真の復元・色補正が可能
  • Geminiアプリで自分の写真を復元・色補正する際、人物の表情やポーズを保持するよう指示する必要がある

@Sarah Perez /

Viral AIアシスタントInstinctに独自メールアドレスが登場

  • Instinctは独自のメールアドレスを提供し、ユーザーの個人情報を使わずタスクを処理できるようにした
  • 独自のメールアドレスと1Passwordとの連携で、アカウント管理を自動化し、ユーザーの個人情報の暴露を防ぐ
  • ユーザーは個人情報の公開を避けつつ、タスクの自動処理を享受できるが、AIが代理で行動する際の責任の所在が明確でない