Scraps 最終更新 2026/10/02 16:20

#クラウド

@ML_Bear /

LLMのトークン効率化で気をつけたいことまとめ

  • 最新モデルを使い、キャッシュを活用してトークンコストを抑える
  • 最新モデルは低効率でも性能が高く、キャッシュの有効期限とキャッシュ範囲の設定が重要
  • キャッシュ切れを防ぐためにはセッション内でモデルやeffortを変更しないこと、キャッシュ有効期限を確認すること

@szka07 /

モブプロにAIを加えたら人間には疲れる仕事だけが残ったので、AI前提の役割分担を模索している

  • AIを含めたモブプロでドライバー交代時のコンテキスト引き継ぎや待ち時間が課題となった
  • AIアカウントのコンテキスト引き継ぎにファイルを活用、AI作業はモブセッション外に回すことで待ち時間を短縮
  • AIアカウントを複数人で共有できない制約により、ドライバーとナビゲーターの役割が曖昧になる

@takeuchi_kazuya /

別アカウントの API Gateway を Lambda から呼ぶ方法を 2 パターン試してみた

  • AWSのクロスアカウント間でLambdaからAPI Gatewayを呼び出す2つの方法を実装例とともに解説
  • リソースポリシー方式とAssumeRole方式、REST APIとHTTP APIの違い
  • HTTP APIではリソースポリシーが使えないためAssumeRole方式が必要で、呼び出し元のアカウント情報が異なる

@Marina Temkin /

Cognition、480億ドルの評価額で20億ドルを調達、AIコード生成市場に複数の企業が参入

  • Cognitionが20億ドルを調達し480億ドルの評価額を達成した
  • Devinというコードアシスタントを開発し、Nvidiaサーバークラスタを借りて運用、オープンソースモデルに依存を減らす
  • 年間収益が40億〜50億ドルに達する見込みだが、計算リソースの制約が続く可能性がある

@kkkkkou /

Terraform で AWS に「うっかり全公開」しないための最低限のセキュリティ設計

  • TerraformでAWSの「うっかり全公開」を防ぐためのセキュリティ設計を実装する
  • S3のアカウントレベル公開ブロックとバケット設定、Security GroupのCIDRではなくSG参照、IAMのActionとResourceの両方限定、tfstateの暗号化S3バックエンド
  • Security Groupのingressで0.0.0.0/0を書くとレビューで止めること、egressは明示的に書かないと閉じる、tfstateは暗号化S3に置くこと

@carol0226 /

パスキーでも被害に遭うデバイスコードフロー攻撃とは? ~ Entra ID での防御と検証方法を解説

  • デバイスコードフローがフィッシング攻撃に悪用されるリスクがある
  • デバイスコードフローは別のデバイスで認証を完了し、その結果を共有する仕組みで、条件付きアクセスでブロックできる
  • 組織ではサインインログで利用実態を確認し、条件付きアクセスを活用して制御する

@Oyu3m /

Copilot Studio の課金体系の真相を探る ── なんでもCopilot(プレビュー)第10回レポート

  • Copilot Studioのハーネスごとの課金体系が変更され、作成・テスト・実行時にクレジットが消費される
  • GitHub Copilotハーネスはクレジット消費対象、StandardハーネスはM365 Copilotライセンスに依存、作成時・テスト時・実行時にクレジットが減る
  • ハーネスの選択は作成前に確定し、環境ごとのクレジット割り当て設定でテナント残高使用をオフにすること

@hato-se /

Amazon Bedrock 料金が一定額を超えたら使用不可にする仕組みを作ってみた

  • Amazon Bedrock の利用料金が一定額を超えると IAM ポリシーを自動で付与する仕組みを AWS Budgets Actions で実装
  • AWS Budgets Actions で予算上限に達したら IAM ポリシーを付与、CloudFormation テンプレートでリソースを定義
  • 予算上限に達した際のメール通知と、翌月に自動で拒否ポリシーが外れる仕組みがある

@taka_yayoi /

DatabricksのFMAPI直叩きとai_query、大きな違いはレート制御を誰が担当するか

  • Databricksで基盤モデルを呼び出す方法はFMAPI直接呼び出しとai_queryの2種類で、レート制御の責任範囲が異なる
  • FMAPI直接呼び出しは呼び出し側で同時実行制御と再試行の間隔調整が必要、ai_queryはエンジン側が自動管理
  • 実験でFMAPI直接呼び出しでは57件が429エラーになるが、自前バックオフを実装すると200件すべて処理可能

@Tim Fernholz /

Stoke Space、10億ドルを調達し、スペースXに挑む再利用ロケット開発を推進

  • Stoke Spaceが10億ドルを調達し、再利用可能なロケット開発を推進
  • 燃料はメタンや酸素ではなく資金、熱防護システムに超冷却水素を採用、Nova PathfinderとNova Block 2の開発計画
  • 再利用可能なロケットの開発には巨額の資金が必要で、熱防護技術が鍵となる

@ASUNI-NARE /

AIエージェントが「PCに入っている」時代へ。NVIDIA「RTX Spark」が変えるローカルAI

  • NVIDIAがRTX Spark搭載PCを10月に発売し、ローカルAIとAIエージェントの導入を容易にする
  • RTX SparkはGrace CPUとBlackwell RTX GPUを統合したSoCで、最大128GBのユニファイドメモリを搭載。Hermes AgentやOpenClawのローカルモデル導入を支援
  • AIエージェントをワンクリックで導入できる仕組みが整い、ローカルAIの利用が一般化しやすくなる

@Yutaka Kashiwabara /

Gateway不要でBedrockの高額モデルを自動Denyする構成を実測 — IAM反映は約11秒

  • IAM customer managed policyでBedrockの高額モデルを段階的にDenyする構成を実測
  • invocation logの配信遅延(T1)とIAMのDeny反映時間(T3)を測定、cross-Region inference profileのARN指定とpolicyサイズ制限を確認
  • inputTokenCountだけでは98%のトークンが漏れるためcacheRead/Writeを含めた集計が必要、policyサイズはARN数と構造に依存する