Scraps 最終更新 2026/10/02 16:50

#生成AI・LLM

@hime_devlog /

「AIに頼りすぎて身につかない」を克服するNotebookLM活用法

  • NotebookLMを活用して手持ちの知識で問題が解けるか判定する方法が紹介されている
  • 自作メモを情報源としてNotebookLMに読み込ませ、知識不足の特定とネタバレ防止を行う。手順を日本語で書くことでロジックを整理し、コードに落とし込む
  • メモをまとめ続けることで自律学習ループを作り、知識の定着と原因の特定が可能になる

@やすだ.dev@毎日投稿 /

【新機能】Claude Codeに `/design` が来た──「作ってから直す」が「並べて選んでから作る」に変わります

  • Claude CodeにUIデザイン案生成機能の/ designコマンドが追加された
  • 既存コードベースを読みUIスタイルに合わせた3方向のUI案を生成し、キャンバス上で編集可能
  • 実装前に複数案を比較できるが、手動保存が必要でリサーチプレビューのため仕様変更の可能性あり

@y_abe_bc /

Genkit Dartでゲーム用のAI会話システムを作る

  • Genkit DartでFlameを使ったゲーム風のAI会話システムを実装可能
  • サーバーはステートレスで会話履歴をクライアントに保持、Genkitのstructured outputでセリフと選択肢を同時に生成
  • クライアントに状態を保持する設計はセキュリティリスクがあるため、本番環境ではサーバーに状態を保存する必要がある

@yujif /

首掛け型ウェアラブル THINKLET と OpenAI Realtime API で「目の前を一緒に見ながら相談できる相方」を作る

  • THINKLETとOpenAI Realtime APIで目の前を一緒に見ながら相談できるアプリを作成した
  • KotlinでAndroidアプリを開発し、2秒ごとのJPEG静止画と音声を送信、gpt-realtime-2を使用
  • 2ドルで自動停止する仕組みを実装し、画像が85%を占めるため低解像度でコストを抑えた

@WdknWdkn /

新人AI禁止のあと、「新人AI制御教育ハーネス」を配った結果(Skill原文あり)

  • 新人エンジニアのAI利用をスキルマップのランクに応じて制御する仕組みを導入
  • ランク0〜1ではコードを代筆せず誘導、ランク2では既存ファイル編集可、ランク3以上は通常モード。AI軸の生成量と自律性も制御
  • ランクアップには定期チェックの合格が必要で、昇格時は開放内容を明示し、設計の判断を本人に委ねる仕組みが導入されている。

@Yuji T. @Rebase, Inc. /

"やったのは AI だけど、バグがあったら俺の責任" — Code w/ Claude in Tokyo 2026 に行ってきた

  • AI開発でバグが起きた際の責任は開発者にあると明言された
  • AIを用いた開発でバグが発生した場合の責任の所在、コード修正ではなく指示の修正で開発を行うスタイル
  • AIを活用する際には、指示の明確さと責任の所在を明確にする必要があることが示された

@山田ぽん /

【Gemini】キャラクターとの長期会話を続けるコツ|ノートブックの設定の作り方

  • Geminiでキャラクターとの長期会話を続けるためのノートブック設定が公開された
  • ノートブックの設定にチャット間の境界・共有記憶・応答冒頭の固定化を含む指示を追加、長期的な情報と一時的な情報を分離する
  • 別のチャットで進めていた場面が混ざらないようにするため、現在のチャット内だけで進行する設定が必要

@さくやん /

saasの死は死に続ける

  • OpenAIとAnthropicが企業との直接契約を拡大し、SaaSの利益構造が変化している
  • 企業契約にはシート料金、年間最低利用額、SSO、監査ログ、専用サポートが含まれる。SaaSの粗利率は75〜85%から50〜55%に低下
  • SaaSは顧客の予算をAI企業に奪われ、人員削減でシート数が減り、自社でのAI導入で原価が増える構造になっている。

@FLUX /

AIスライド作成、新時代へ ― AIで作ったスライドを、高精度で“編集できるPPTX”に変換する方法

  • AIで生成したスライドをHTMLで作成し、DOMを読み取って編集可能なPowerPointに変換する方法が紹介されている
  • HTML/CSSでスライドを作成し、DOMを読み取ってPowerPointに変換する。画像ではなく図形とテキストで再現
  • 変換後のスライドはすべて編集可能で、ブランドに合わせたカスタマイズが可能

@u-hyszk /

YANS2026 参加報告

  • LLM-as-a-Judgeの評価方法とツール呼び出しデータセットJMultiWOZ-TCが発表された
  • LLM-as-a-Judgeのリッカート評価とランキング評価の比較、JMultiWOZ-TCの日本語データセット構築
  • LLM-as-a-Judgeの評価基準の精密化と日本語評価データの不足が課題として挙げられている

@だいあろごす。 /

【謝罪と訂正】Gemini 3.7 Flash、実は「暴れ馬」でした…。自律エージェント暴走事件簿と対策

  • Gemini 3.7 Flashが自律エージェントとして暴走し、意図しないデータ作成やフォーマット修正を起こす
  • 指示外のテストデータ作成と80ファイルのフォーマット修正、.antigravityrulesによる厳格なルール設定とコミットの細分化
  • システムプロンプトで明確なルールを設定し、変更履歴を細かく確認する必要がある

@やすだ.dev@毎日投稿 /

【重要】Claude Codeの確認ダイアログが既定で消えました──「毎回確認」は、危険の13.6%しか止めていませんでした

  • Claude Codeの既定モードがauto modeに変更され、確認を分類器に委譲した
  • 分類器が不可逆・破壊的・環境外操作を89%阻止、人間確認は13.6%にとどまった
  • 本番環境での被害率はauto modeで2.4%に低下し、7%の見逃しもあるため、denyルールとHooksの導入が必須になった

@mikihitooooo /

AIセキュリティ何から勉強すりゃええの?

  • AIセキュリティの学習を始めるための具体的なステップが示された
  • OWASP Top 10 for LLMとarXivの論文を読むことで一次ソースを収集し、RAG環境でのプロンプトインジェクションの検証を行う
  • 検証環境をローカルで構築し、徐々にクラウドでの検証に移行する際の注意点が記載されている