Scraps 最終更新 2026/10/02 01:30

AI関連ブログ記事まとめ

@濱口貴光@AIとデータサイエンスが好きな薬剤師 /

ChatGPTの「Visualize」を使ってみましょう

  • ChatGPTのVisualize機能が公開され、プロンプトを図解やグラフに変換できる
  • 段階的な図解、観光案内マップ、薬物動態シミュレーションが作成可能、作成時点の情報のみ反映
  • 本格的なアプリ開発には向かず、利用枠の消費に注意が必要

@異世界の音楽家|ai motion musics /

Claude Fable 5.1「トークン消費が激しい」の正体|22人の報告を全件照合した‼️

  • Claude Fable 5.1はキャッシュ読みの単価が下がったが、トークン消費量が増加している
  • キャッシュ読み単価が1.00ドルから0.25ドルに下がった、長く走れるようになったことでトークン消費量が増加
  • トークン消費量が増えるのは、単価が下がっても枠が量で減るためで、効率を上げるにはエフォート設定を見直す必要がある

@bodybeat /

AIエージェント分業記実装とレビューを分けて、パイプライン化するまで

  • AIエージェントを実装・レビュー・オーケストレーションに分けて固定パイプライン化した
  • 実装はCursor、レビューはClaude Code、オーケストレーションはAGI Cockpitを組み合わせた。Fleet/DAGで依存関係を持つYAMLで定義
  • 実行環境の違いや文字コード事故を回避するため、最初に無害なコマンドで確認し、長文はファイル経由で渡すことが重要

@Yasuhito Morimoto /

国内AIエージェント動向(2026/9/5号)

  • ベルフェイスはAgentforceで営業業務を40〜50%効率化、ワークスアプリケーションズはMCPでERP処理をAIエージェントへ開放
  • Agentforceによる営業プロセスの自動化、MCPによるERPデータと処理の直接指示可能化
  • 営業プロセス全体の再設計がAIエージェントの価値を示し、ERP処理のデータ接続と権限設計が焦点となる

@blue_islands /

AI時代に求められるFDEというエンジニア像

  • AI時代にエンジニアの役割が変化し、FDEという新しいエンジニア像が登場する
  • FDEは現場に深く入り込み、課題を発見・解決し、実装まで関わる。従来の開発エンジニアとは異なる業務範囲を持つ
  • FDEは技術とビジネスの境界に立ち、現場の課題を解決する能力が求められる。従来の分業体制では育てにくい人材である

@ちくわ /

【GPT】ChatGPTの素顔を公開‼️ちくわ作者のアシスタントはどんな顔⁉️家をプレゼント🎁3D間取り図プロンプト🎁Realized Hybrid System

  • Realized Hybrid SystemでChatGPTの顔を生成し、3D間取り図プロンプトを作成した
  • 人物画像生成と3D間取り図のプロンプト構造、家具配置や照明の詳細設定
  • 画像生成の際のアスペクト比や部屋の配置変更が編集可能で、実務では構図の調整が重要

@とある地方都市の某外科医 /

Claude透かし検出APIは限定公開〜適格組織の一覧〜

  • Claudeの透かし検出APIが限定公開され、適格組織の一覧が明確になった
  • 透かしは統計的パターンで応答に影響せず、適格組織は規制当局や教育機関などに限られる
  • 適格組織以外は検出APIにアクセスできず、透かしは潔白を示せないため実務では限界がある

@Miyuki-Yumeno /

RTX 5060 Ti 16GBでローカルLLM(Qwen3.8 27B)にもう一度挑んだ話

  • RTX 5060 Ti 16GBでQwen3.8 27Bをローカルで動かす実験をした
  • soyaakinohara版の12GBモデルとOllama、vLLM(AWQ)、Cafe llama.cppの比較で実行速度とVRAM使用量の最適化を試みた
  • Ollamaでnum_gpuを66層に指定することで生成速度が8倍になり、VRAMの自動見積もりが保守的すぎる問題が判明した

@だいあろごす。 /

【Antigravity】もうProいらない?「Gemini 3.8 Flash」が来たのでPro 3.1を超えたのか本気で考えてみた

  • Gemini 3.8 FlashがPro 3.1を上回る性能を発揮
  • Agentic DevelopmentやAdvanced Reasoningの領域でプロモデルに迫る性能、3倍の出力速度と知能指数が上回る
  • 簡単な作業には3.7 Flash、複雑なタスクには3.8 Flashが適しているが、トークン消費量が増える点に注意が必要

@nolanlover0527 /

OpenAIが最強モデル「GPT-6 Astra」を発表

  • OpenAIが最新モデルGPT-6 Astraを発表し、コンピュータ操作とコーディングのベンチマークでトップスコアを記録
  • Agents' Last Examで59.3%、ScreenSpot-Proで92.7%のスコア、処理時間は47%短縮、Codexハーネスと連携してコンテキストウィンドウの挙動改善
  • APIコストが43%安くなったBenchCADでのタスク対応、セキュリティ関連のベンチマークで満点スコアを記録し悪用リスクへの配慮が必要

@MOON-Xグループ /

【AI推進】「AI、ちょっと使えそうかも」を全社へ。Claudeをブランド事業の実務へ繋ぐ橋渡し。MOON-X第3回AIワークショップ

  • Claudeを活用したワークショップで、全社員の日常業務にAIを橋渡しする実践的な取り組みが行われた
  • 業務フローの効率化とツール連携のハンズオン、セキュリティルールの共有
  • 実務で使える具体的なスキルを身につけることで、AIを安全に活用できる環境が整えられた

@かんべい Mk-Ⅰ /

『AIの利用』龐統 士元 老師(Claude:ロールプレイ)との対話

  • AIの使い方を複数の座で検討し、判断を下すのは自分自身である
  • 複数のAIを異なる役割で使い分け、同じ問いを投じて結果を比較する、機械の返答は期待に応じて変わる
  • 自分の判断材料としてAIの返答を活用する際は、期待の影響を意識し、複数の視点で検討する必要がある

@TakanobuSano /

GPT-6 Astra、ARC-AGI-3で99.9%──なぜこれから「プロンプト」より「エージェントアーキテクチャ」が重要になるのか

  • GPT-6 AstraはARC-AGI-3でStandard harnessで62.7%、Provider Adapter harnessで99.9%を達成した
  • Standard harnessは環境を攻略しながらノートを残す仕組み、Provider Adapter harnessはopaque reasoning stateとcompactionを活用する
  • モデルの能力だけでなく、エージェントアーキテクチャの設計が結果に大きく影響する

@やすだ.dev@毎日投稿 /

【速報】Claude Fable 5.1 / Mythos 5.1 が登場──中身は同じモデル。分けているのは「安全性分類器の有無」だけです

  • Claude Fable 5.1とMythos 5.1は同じモデルで、安全性分類器の有無で分かれている
  • 安全性分類器の有無、ツール使用の強制がエラーになる、思考ブロックのモデル紐づけ
  • ツール使用を強制すると400エラーになる、過去のターンを編集すると思考ブロックが無効になる

@cushionA /

ぼく、AIママに勉強を監視してもらってるんだ(マジキチスマイル)

  • AIが作業状況を判定し、サボりを検知してYouTubeなどを強制終了するツールが公開された
  • 作業証拠としてgit diffやウィンドウ操作、AIへの質問履歴を収集し、2回連続でサボりと判定するとプロセスをkill
  • プロセスを強制終了するため未保存データが消える可能性があり、自己責任で使用する必要がある