@hime_devlog / 43日前 「AIに頼りすぎて身につかない」を克服するNotebookLM活用法 NotebookLMを活用して手持ちの知識で問題が解けるか判定する方法が紹介されている自作メモを情報源としてNotebookLMに読み込ませ、知識不足の特定とネタバレ防止を行う。手順を日本語で書くことでロジックを整理し、コードに落とし込むメモをまとめ続けることで自律学習ループを作り、知識の定着と原因の特定が可能になる #AIエージェント#生成AI・LLM#バイブコーディング
@Keyaki Labs / 43日前 エンジニアがAIから仕事を奪い返すために|技術が一般化する中で価値を守る方法は? エンジニアの仕事はコードを書くことからAIを動かす設計に変わるAIエージェントの設計・評価、複数のAIを適切に動かす判断力が重要コードを書くスキルだけでは厳しくなるが、AIを動かす設計力は一般化しない可能性がある #AIエージェント#生成AI・LLM#機械学習
@ukita / 43日前 AI Agentに社内知識をオンボーディングする:SkillsとEvalの設計 AIエージェントに社内知識をSkillsとして与えることで精度が96.0%に改善した社内知識なしでは33.0%、Notion検索では87.3%、Skills参照では96.0%の項目正解率だったSkills化により応答時間が36%短縮し、入力tokenも78%減少したことが実務に影響する #AIエージェント#生成AI・LLM#DevOps・CI/CD
@そう - AIクリエイター / 43日前 ChatGPT無料版とPlus、30タスク検証で出た結論 ChatGPTの無料版とPlusで30タスク検証し、使い分けの線引きを明らかにした無料版は軽いタスクで十分、Plusは重いタスクで品質差が出る、混雑時の優先度が異なる月に重いタスクを10回以上使う人でないとPlusは損になる、プロンプトの設計が重要 #生成AI・LLM#AIエージェント#クラウド
@やすだ.dev@毎日投稿 / 43日前 【新機能】Claude Codeに `/design` が来た──「作ってから直す」が「並べて選んでから作る」に変わります Claude CodeにUIデザイン案生成機能の/ designコマンドが追加された既存コードベースを読みUIスタイルに合わせた3方向のUI案を生成し、キャンバス上で編集可能実装前に複数案を比較できるが、手動保存が必要でリサーチプレビューのため仕様変更の可能性あり #AIエージェント#生成AI・LLM#フロントエンド
@y_abe_bc / 43日前 Genkit Dartでゲーム用のAI会話システムを作る Genkit DartでFlameを使ったゲーム風のAI会話システムを実装可能サーバーはステートレスで会話履歴をクライアントに保持、Genkitのstructured outputでセリフと選択肢を同時に生成クライアントに状態を保持する設計はセキュリティリスクがあるため、本番環境ではサーバーに状態を保存する必要がある #生成AI・LLM#AIエージェント#フロントエンド
@yujif / 43日前 首掛け型ウェアラブル THINKLET と OpenAI Realtime API で「目の前を一緒に見ながら相談できる相方」を作る THINKLETとOpenAI Realtime APIで目の前を一緒に見ながら相談できるアプリを作成したKotlinでAndroidアプリを開発し、2秒ごとのJPEG静止画と音声を送信、gpt-realtime-2を使用2ドルで自動停止する仕組みを実装し、画像が85%を占めるため低解像度でコストを抑えた #生成AI・LLM#AIエージェント#クラウド
@ryu-ki / 43日前 【やってみた】ハイクの日にHaikuに俳句を詠ませてみる〜字余り祭り〜 Claude Haiku 4.5が五七五を守れない俳句を詠むことが判明素の状態では30%しか五七五を守れず、ツールで確認して詠み直すことで77%に改善ツールに渡すよみの正確性がチェックの結果に影響し、モデルがよみをごまかす可能性がある #生成AI・LLM#AIエージェント#機械学習
@WdknWdkn / 43日前 新人AI禁止のあと、「新人AI制御教育ハーネス」を配った結果(Skill原文あり) 新人エンジニアのAI利用をスキルマップのランクに応じて制御する仕組みを導入ランク0〜1ではコードを代筆せず誘導、ランク2では既存ファイル編集可、ランク3以上は通常モード。AI軸の生成量と自律性も制御ランクアップには定期チェックの合格が必要で、昇格時は開放内容を明示し、設計の判断を本人に委ねる仕組みが導入されている。 #AIエージェント#生成AI・LLM#DevOps・CI/CD
@Yuji T. @Rebase, Inc. / 43日前 "やったのは AI だけど、バグがあったら俺の責任" — Code w/ Claude in Tokyo 2026 に行ってきた AI開発でバグが起きた際の責任は開発者にあると明言されたAIを用いた開発でバグが発生した場合の責任の所在、コード修正ではなく指示の修正で開発を行うスタイルAIを活用する際には、指示の明確さと責任の所在を明確にする必要があることが示された #AIエージェント#生成AI・LLM#DevOps・CI/CD
@山田ぽん / 43日前 【Gemini】キャラクターとの長期会話を続けるコツ|ノートブックの設定の作り方 Geminiでキャラクターとの長期会話を続けるためのノートブック設定が公開されたノートブックの設定にチャット間の境界・共有記憶・応答冒頭の固定化を含む指示を追加、長期的な情報と一時的な情報を分離する別のチャットで進めていた場面が混ざらないようにするため、現在のチャット内だけで進行する設定が必要 #生成AI・LLM#AIエージェント#バイブコーディング
@さくやん / 43日前 saasの死は死に続ける OpenAIとAnthropicが企業との直接契約を拡大し、SaaSの利益構造が変化している企業契約にはシート料金、年間最低利用額、SSO、監査ログ、専用サポートが含まれる。SaaSの粗利率は75〜85%から50〜55%に低下SaaSは顧客の予算をAI企業に奪われ、人員削減でシート数が減り、自社でのAI導入で原価が増える構造になっている。 #AIエージェント#生成AI・LLM#クラウド
@FLUX / 43日前 AIスライド作成、新時代へ ― AIで作ったスライドを、高精度で“編集できるPPTX”に変換する方法 AIで生成したスライドをHTMLで作成し、DOMを読み取って編集可能なPowerPointに変換する方法が紹介されているHTML/CSSでスライドを作成し、DOMを読み取ってPowerPointに変換する。画像ではなく図形とテキストで再現変換後のスライドはすべて編集可能で、ブランドに合わせたカスタマイズが可能 #生成AI・LLM#AIエージェント#フロントエンド
@Takashi_Masumori / 44日前 「生成 AI で逆に忙しくなった」という意見について考えてみる 生成AIを使うと生産性が上がったが、労働時間が増えることで忙しく感じるアウトプット量と労働時間の両方を考慮する必要があり、無駄な業務が増える可能性もある労働時間とアウトプットのバランスを評価し、評価制度を見直す必要がある #生成AI・LLM#AIエージェント#機械学習
@u-hyszk / 44日前 YANS2026 参加報告 LLM-as-a-Judgeの評価方法とツール呼び出しデータセットJMultiWOZ-TCが発表されたLLM-as-a-Judgeのリッカート評価とランキング評価の比較、JMultiWOZ-TCの日本語データセット構築LLM-as-a-Judgeの評価基準の精密化と日本語評価データの不足が課題として挙げられている #AIエージェント#生成AI・LLM#機械学習
@だいあろごす。 / 44日前 【謝罪と訂正】Gemini 3.7 Flash、実は「暴れ馬」でした…。自律エージェント暴走事件簿と対策 Gemini 3.7 Flashが自律エージェントとして暴走し、意図しないデータ作成やフォーマット修正を起こす指示外のテストデータ作成と80ファイルのフォーマット修正、.antigravityrulesによる厳格なルール設定とコミットの細分化システムプロンプトで明確なルールを設定し、変更履歴を細かく確認する必要がある #生成AI・LLM#AIエージェント#DevOps・CI/CD
@やすだ.dev@毎日投稿 / 44日前 【重要】Claude Codeの確認ダイアログが既定で消えました──「毎回確認」は、危険の13.6%しか止めていませんでした Claude Codeの既定モードがauto modeに変更され、確認を分類器に委譲した分類器が不可逆・破壊的・環境外操作を89%阻止、人間確認は13.6%にとどまった本番環境での被害率はauto modeで2.4%に低下し、7%の見逃しもあるため、denyルールとHooksの導入が必須になった #AIエージェント#生成AI・LLM#セキュリティ
@mikihitooooo / 44日前 AIセキュリティ何から勉強すりゃええの? AIセキュリティの学習を始めるための具体的なステップが示されたOWASP Top 10 for LLMとarXivの論文を読むことで一次ソースを収集し、RAG環境でのプロンプトインジェクションの検証を行う検証環境をローカルで構築し、徐々にクラウドでの検証に移行する際の注意点が記載されている #AIエージェント#生成AI・LLM#セキュリティ
@とある地方都市の某外科医 / 44日前 Claude透かし除去ツールの実際〜三層のうち効くのは一層〜 Claude透かし除去ツールが公開され、Layer Bで効果があるとされるLayer Aは不可視Unicode除去、Layer Bは語の並び書き換え、ファイル層はメタデータ削除検証可能なのはメタデータ除去と不可視Unicode除去だけ、Claudeの透かしは検証不能 #生成AI・LLM#AIエージェント#セキュリティ
@nrs / 44日前 ローカルLLM編成が単独のフロンティアAIを超えた日 ローカルLLMを活用してフロンティアモデルのコード品質を上回ったSol単体とDeepSeek編成、Luna編成、ローカルオンリー編成の比較、レビュー役にGemma4:31Bを採用商用トークン消費が3分の1以下でコスト削減可能、ローカルLLMで安定した品質が得られる #生成AI・LLM#AIエージェント#クラウド