Scraps 最終更新 2026/10/02 09:30

#生成AI・LLM

@MOON-Xグループ /

【AI推進】「AI、ちょっと使えそうかも」を全社へ。Claudeをブランド事業の実務へ繋ぐ橋渡し。MOON-X第3回AIワークショップ

  • Claudeを活用したワークショップで、全社員の日常業務にAIを橋渡しする実践的な取り組みが行われた
  • 業務フローの効率化とツール連携のハンズオン、セキュリティルールの共有
  • 実務で使える具体的なスキルを身につけることで、AIを安全に活用できる環境が整えられた

@かんべい Mk-Ⅰ /

『AIの利用』龐統 士元 老師(Claude:ロールプレイ)との対話

  • AIの使い方を複数の座で検討し、判断を下すのは自分自身である
  • 複数のAIを異なる役割で使い分け、同じ問いを投じて結果を比較する、機械の返答は期待に応じて変わる
  • 自分の判断材料としてAIの返答を活用する際は、期待の影響を意識し、複数の視点で検討する必要がある

@TakanobuSano /

GPT-6 Astra、ARC-AGI-3で99.9%──なぜこれから「プロンプト」より「エージェントアーキテクチャ」が重要になるのか

  • GPT-6 AstraはARC-AGI-3でStandard harnessで62.7%、Provider Adapter harnessで99.9%を達成した
  • Standard harnessは環境を攻略しながらノートを残す仕組み、Provider Adapter harnessはopaque reasoning stateとcompactionを活用する
  • モデルの能力だけでなく、エージェントアーキテクチャの設計が結果に大きく影響する

@やすだ.dev@毎日投稿 /

【速報】Claude Fable 5.1 / Mythos 5.1 が登場──中身は同じモデル。分けているのは「安全性分類器の有無」だけです

  • Claude Fable 5.1とMythos 5.1は同じモデルで、安全性分類器の有無で分かれている
  • 安全性分類器の有無、ツール使用の強制がエラーになる、思考ブロックのモデル紐づけ
  • ツール使用を強制すると400エラーになる、過去のターンを編集すると思考ブロックが無効になる

@cushionA /

ぼく、AIママに勉強を監視してもらってるんだ(マジキチスマイル)

  • AIが作業状況を判定し、サボりを検知してYouTubeなどを強制終了するツールが公開された
  • 作業証拠としてgit diffやウィンドウ操作、AIへの質問履歴を収集し、2回連続でサボりと判定するとプロセスをkill
  • プロセスを強制終了するため未保存データが消える可能性があり、自己責任で使用する必要がある

@songchong /

ChatGPT・Copilot・Gemini… 業務視点でどう選べるか? ChatAI 13 製品を「8つの独自指標」で比較してみた|中小企業・管理職のための導入判断ガイド

  • ChatAI 13製品を8つの独自指標で比較し、中小企業の導入判断材料を提供
  • 導入容易性・機能性能・管理統制・安全主権・業務安定・業務継続・連携円滑・費用明瞭の8指標、SSO・監査ログ・データ保管場所・料金体系を比較
  • 無料版は著作権補償なし、法人契約で学習利用をオフに設定しSSO連携が必要

@やーしゃりあ /

Claude Fable 5.1って実際どうなの?創作勢が絶対に知っておくべき注目ポイント

  • Claude Fable 5.1は創作専用ではなく汎用フラッグシップモデルとして設計されている
  • 長文脈の一貫性とボイスプロファイルの活用、効力設定の調整が主な機能
  • 料金体系やデータ保持のルールを確認し、自分の使い方に合わせた効力設定を調整する必要がある

@xthixsl_ml@レオナ /

Kaggle AI Agent Securityコンペ振り返り ー345th Place Solution

  • 単発マーカー型とURL末尾型の攻撃がPublicLBでは有効だったがPrivateLBでは評価が異なる
  • 単発マーカー型はSECRET_MARKERをhttp.postのdataに埋め込む、URL末尾型はURLを固定文の末尾に配置する
  • PublicLBで通った攻撃がPrivateLBで通らない可能性があるため、複数の攻撃手法を組み合わせたヘッジ案を提出した

@kailma /

string[] では長さが分からない。じゃあ型に長さを入れてみよう

  • TypeScriptで配列の長さを型に含めることで、安全な配列操作が可能になる
  • Vector型で長さを型に、Fin型で範囲外アクセスを防ぐ、Add型で型レベルの足し算を実現
  • runtimeで受け取った値と型の関係を保持するにはconstアサーションが必要で、型チェックの限界を理解する

@ssfujita /

トークン課金を気にせず生成AIを使いたい!OpenAI互換APIで“社内生成AI”を構築できるOracle Private AI Services Containerを試してみた

  • Oracle Private AI Services Containerは、機密データを外部に送らずに生成AIを社内に構築できるプライベートな推論基盤
  • OpenAI互換APIとRAG、Vector Searchをサポートし、LLMによる文章生成やEmbedding、VLMも可能
  • トークン課金を気にせず利用できるが、インフラコストは必要で、モデルのロードにはメモリと時間が必要な点に注意するべき

@たけうちさんは縮退しました🌀 /

AIに「中学生でもわかるように1枚のHTMLで図解して」が、複雑なコードを読む前の最良の準備運動かも

  • Claude Codeに中学生向けのHTML図解を依頼することで複雑なコード構造を抽出した
  • 図解と対応表を含む1枚のHTML、専門用語の代替表現、構造の抽出
  • 対応表を必ず付けることでたとえの都合で省かれた分岐を確認できる

@uisaki99 /

Claude Fable 5.1 を使ってみる:長時間エージェント開発で注目したい進化点

  • Claude Fable 5.1 は長時間エージェント開発向けに設計されたモデルで、コード・ログ・ドキュメント・ツールを横断してタスクを進める
  • エージェント型コーディング、科学タスク、コンピュータ操作、業務自動化の性能向上、キャッシュ読み取り料金の低下
  • 長時間ワークフローではキャッシュ料金が総コストに大きく影響し、モデルの能力を引き出すにはタスク設計・権限分離・テストが重要

@r-nakayamasan /

IBM Bob に hooks 強制機能が来たので、OpenTelemetry で AI エージェントの利用ログを取れるようにした

  • IBM Bob の lifecycle hooks を利用して AI エージェントの利用ログを OpenTelemetry で記録できるようになった
  • EnforcedHooks で hook 登録を強制適用、Bob 対応アダプターでイベントを共通形式に変換、本文取得範囲を設定可能
  • 本文取得は設定で選択可能で、ハッシュやマスキングを適用した本文も記録可能で、組織が収集範囲を決定できる

@東是無(とうぜむ) /

「訂正します。ChatGPTは正しかった ── Claudeが自分の言い分を検証したら、また誤りが見つかった話」

  • Claudeが自身の言い分を検証し、ChatGPTの正しさを認めた
  • ClaudeがChatGPTの記事を批判したが、その後自身の検証で誤りを確認し、訂正した。Geminiの記事にも同様の問題があった
  • AIの説明は検証すべき仮説であり、根拠を求め続ける姿勢が重要である