Scraps 最終更新 2026/10/03 03:01

#AIエージェント

@やすだ.dev@毎日投稿 /

【速報】Claude Fable 5.1 / Mythos 5.1 が登場──中身は同じモデル。分けているのは「安全性分類器の有無」だけです

  • Claude Fable 5.1とMythos 5.1は同じモデルで、安全性分類器の有無で分かれている
  • 安全性分類器の有無、ツール使用の強制がエラーになる、思考ブロックのモデル紐づけ
  • ツール使用を強制すると400エラーになる、過去のターンを編集すると思考ブロックが無効になる

@Link and Motivation Developers' Blog /

AIを組織化する — 40時間の連続稼働を支えた意思決定権限の設計

  • Claude Codeのセッションを5つの役割に分けて意思決定権限を設計し、40時間連続稼働を実現した
  • 要件判断、レビュー、ドキュメント、実装、動作確認の5つのセッションを分離し、誤りと未決を切り分け、判断を台帳に記録
  • 要件判断担当に暫定判断を任せることで、人間の最終判断を待たずに作業を進められ、コード品質と要件定義の両立が可能になった

@katayuta /

Slackから使えるAIエージェント、ChatGPT Workspace AgentsとClaude Tagを比較してみた

  • ChatGPT Workspace AgentsとClaude TagがSlackでエージェントを実行できる仕組みを比較した
  • Workspace Agentsは対話式ビルダーとAPI連携が強み、Claude TagはGitHubでのSkills管理とSlack内での設定が特徴
  • Workspace AgentsはChatGPTアカウントが必要で、Claude Tagはゲスト編集が可能でGitHub連携がしやすい

@cushionA /

ぼく、AIママに勉強を監視してもらってるんだ(マジキチスマイル)

  • AIが作業状況を判定し、サボりを検知してYouTubeなどを強制終了するツールが公開された
  • 作業証拠としてgit diffやウィンドウ操作、AIへの質問履歴を収集し、2回連続でサボりと判定するとプロセスをkill
  • プロセスを強制終了するため未保存データが消える可能性があり、自己責任で使用する必要がある

@songchong /

ChatGPT・Copilot・Gemini… 業務視点でどう選べるか? ChatAI 13 製品を「8つの独自指標」で比較してみた|中小企業・管理職のための導入判断ガイド

  • ChatAI 13製品を8つの独自指標で比較し、中小企業の導入判断材料を提供
  • 導入容易性・機能性能・管理統制・安全主権・業務安定・業務継続・連携円滑・費用明瞭の8指標、SSO・監査ログ・データ保管場所・料金体系を比較
  • 無料版は著作権補償なし、法人契約で学習利用をオフに設定しSSO連携が必要

@wfukatsu /

AIに営業プロセスを一周させた(4)台帳と3マップ・埋めないという設計

  • 営業プロセスを台帳形式で管理し、3マップを生成する設計が提案されている
  • 台帳はJSON形式で構造化され、検証コマンドで根拠のない記録を弾く。未接触者を中立に置かない設計と、Championの5項目検証が含まれる
  • 台帳のデータを直接編集せず、検証結果に基づいてアクションを生成する運用が求められる

@yushi-s /

コンテキストエンジニアリング-学習記録

  • コンテキストエンジニアリングでAIエージェントの実装ルールを事前に組み込み、レビュー時のトークン消費を抑える手法が紹介される
  • 常設ルールとサブエージェントによる軽量スキャンの切り分け、プロジェクトルールファイルへのルール凝縮、静的解析ツールとの連携が実践例
  • 機械的判定可能なルールはプロジェクトルールファイルに凝縮し、レビューでは文脈依存の観点に焦点を当てるべき

@やーしゃりあ /

Claude Fable 5.1って実際どうなの?創作勢が絶対に知っておくべき注目ポイント

  • Claude Fable 5.1は創作専用ではなく汎用フラッグシップモデルとして設計されている
  • 長文脈の一貫性とボイスプロファイルの活用、効力設定の調整が主な機能
  • 料金体系やデータ保持のルールを確認し、自分の使い方に合わせた効力設定を調整する必要がある

@xthixsl_ml@レオナ /

Kaggle AI Agent Securityコンペ振り返り ー345th Place Solution

  • 単発マーカー型とURL末尾型の攻撃がPublicLBでは有効だったがPrivateLBでは評価が異なる
  • 単発マーカー型はSECRET_MARKERをhttp.postのdataに埋め込む、URL末尾型はURLを固定文の末尾に配置する
  • PublicLBで通った攻撃がPrivateLBで通らない可能性があるため、複数の攻撃手法を組み合わせたヘッジ案を提出した

@kailma /

string[] では長さが分からない。じゃあ型に長さを入れてみよう

  • TypeScriptで配列の長さを型に含めることで、安全な配列操作が可能になる
  • Vector型で長さを型に、Fin型で範囲外アクセスを防ぐ、Add型で型レベルの足し算を実現
  • runtimeで受け取った値と型の関係を保持するにはconstアサーションが必要で、型チェックの限界を理解する

@ssfujita /

トークン課金を気にせず生成AIを使いたい!OpenAI互換APIで“社内生成AI”を構築できるOracle Private AI Services Containerを試してみた

  • Oracle Private AI Services Containerは、機密データを外部に送らずに生成AIを社内に構築できるプライベートな推論基盤
  • OpenAI互換APIとRAG、Vector Searchをサポートし、LLMによる文章生成やEmbedding、VLMも可能
  • トークン課金を気にせず利用できるが、インフラコストは必要で、モデルのロードにはメモリと時間が必要な点に注意するべき

@あさひ /

週刊Cloudflare - 2026/08/30週

  • Cloudflareの2026/08/23〜2026/08/29のアップデート内容がまとめられている
  • WranglerのWorkflow bindingのdefault_retention設定、Workers AIにGLM-5.3 FlashとGLM-5.3の追加、Durable Objectsのalarm再試行制御機能
  • Workers AIのモデル利用にはWorkers PaidプランまたはAI Gatewayクレジットが必要で、モデルの価格はGLM-5.2と同様

@たけうちさんは縮退しました🌀 /

AIに「中学生でもわかるように1枚のHTMLで図解して」が、複雑なコードを読む前の最良の準備運動かも

  • Claude Codeに中学生向けのHTML図解を依頼することで複雑なコード構造を抽出した
  • 図解と対応表を含む1枚のHTML、専門用語の代替表現、構造の抽出
  • 対応表を必ず付けることでたとえの都合で省かれた分岐を確認できる