@ML_Bear / 23日前 LLMのトークン効率化で気をつけたいことまとめ 最新モデルを使い、キャッシュを活用してトークンコストを抑える最新モデルは低効率でも性能が高く、キャッシュの有効期限とキャッシュ範囲の設定が重要キャッシュ切れを防ぐためにはセッション内でモデルやeffortを変更しないこと、キャッシュ有効期限を確認すること #生成AI・LLM#AIエージェント#クラウド
@szka07 / 23日前 モブプロにAIを加えたら人間には疲れる仕事だけが残ったので、AI前提の役割分担を模索している AIを含めたモブプロでドライバー交代時のコンテキスト引き継ぎや待ち時間が課題となったAIアカウントのコンテキスト引き継ぎにファイルを活用、AI作業はモブセッション外に回すことで待ち時間を短縮AIアカウントを複数人で共有できない制約により、ドライバーとナビゲーターの役割が曖昧になる #モバイル#クラウド#DevOps・CI/CD
@takeuchi_kazuya / 23日前 別アカウントの API Gateway を Lambda から呼ぶ方法を 2 パターン試してみた AWSのクロスアカウント間でLambdaからAPI Gatewayを呼び出す2つの方法を実装例とともに解説リソースポリシー方式とAssumeRole方式、REST APIとHTTP APIの違いHTTP APIではリソースポリシーが使えないためAssumeRole方式が必要で、呼び出し元のアカウント情報が異なる #クラウド#インフラ#DevOps・CI/CD
@Marina Temkin / 23日前 Cognition、480億ドルの評価額で20億ドルを調達、AIコード生成市場に複数の企業が参入 Cognitionが20億ドルを調達し480億ドルの評価額を達成したDevinというコードアシスタントを開発し、Nvidiaサーバークラスタを借りて運用、オープンソースモデルに依存を減らす年間収益が40億〜50億ドルに達する見込みだが、計算リソースの制約が続く可能性がある #生成AI・LLM#AIエージェント#クラウド
@Anna Heim / 23日前 The Exploration Companyが4億5000万ドルを調達し、スペースXに挑戦 The Exploration Companyが4億5000万ドルを調達し、スペースXに挑戦するリカバリ可能な宇宙船の開発と、フルフロー段階燃焼エンジン技術を採用資金は主に打ち上げ施設とロケットの建設に使われ、2028年までに国際宇宙ステーションへの飛行を目標にしている #クラウド#インフラ#AIエージェント
@Amanda Silberling / 23日前 Appleの折り畳みiPhone発表はどこで見られる? Appleが折り畳みiPhoneを発表する折り畳みiPhone UltraとiPhone 18 Proシリーズ、HomePodやAirPodsの新機種が登場標準iPhone 18は来年発売予定で、今すぐ買い替えを検討する人はProシリーズをチェックすべき #モバイル#プロダクト開発#クラウド
@kkkkkou / 23日前 Terraform で AWS に「うっかり全公開」しないための最低限のセキュリティ設計 TerraformでAWSの「うっかり全公開」を防ぐためのセキュリティ設計を実装するS3のアカウントレベル公開ブロックとバケット設定、Security GroupのCIDRではなくSG参照、IAMのActionとResourceの両方限定、tfstateの暗号化S3バックエンドSecurity Groupのingressで0.0.0.0/0を書くとレビューで止めること、egressは明示的に書かないと閉じる、tfstateは暗号化S3に置くこと #クラウド#インフラ#DevOps・CI/CD
@carol0226 / 23日前 パスキーでも被害に遭うデバイスコードフロー攻撃とは? ~ Entra ID での防御と検証方法を解説 デバイスコードフローがフィッシング攻撃に悪用されるリスクがあるデバイスコードフローは別のデバイスで認証を完了し、その結果を共有する仕組みで、条件付きアクセスでブロックできる組織ではサインインログで利用実態を確認し、条件付きアクセスを活用して制御する #セキュリティ#クラウド#DevOps・CI/CD
@Oyu3m / 23日前 Copilot Studio の課金体系の真相を探る ── なんでもCopilot(プレビュー)第10回レポート Copilot Studioのハーネスごとの課金体系が変更され、作成・テスト・実行時にクレジットが消費されるGitHub Copilotハーネスはクレジット消費対象、StandardハーネスはM365 Copilotライセンスに依存、作成時・テスト時・実行時にクレジットが減るハーネスの選択は作成前に確定し、環境ごとのクレジット割り当て設定でテナント残高使用をオフにすること #AIエージェント#クラウド#DevOps・CI/CD
@Rebecca Bellan / 23日前 Google Cloud、Accentureとの提携でAI導入支援強化 Google CloudとAccentureがAI導入支援のための新ユニットを設立したFDE(前線配置エンジニア)を活用した企業向けAIツール導入支援と、Gemini Enterpriseプラットフォームでのカスタムアプリ開発企業がAI導入でROIを確保するための実務的な支援体制が強化される #AIエージェント#クラウド#インフラ
@hato-se / 23日前 Amazon Bedrock 料金が一定額を超えたら使用不可にする仕組みを作ってみた Amazon Bedrock の利用料金が一定額を超えると IAM ポリシーを自動で付与する仕組みを AWS Budgets Actions で実装AWS Budgets Actions で予算上限に達したら IAM ポリシーを付与、CloudFormation テンプレートでリソースを定義予算上限に達した際のメール通知と、翌月に自動で拒否ポリシーが外れる仕組みがある #クラウド#インフラ#DevOps・CI/CD
@Sarah Perez / 23日前 Chrome、AIがセキュリティ環境を変える中で2週間ごとのアップデートを開始 Chromeが2週間ごとのリリーススケジュールに変更したセキュリティパッチの管理効率化とN日間ギャップの短縮、AIによる脅威の増加セキュリティパッチのN日間ギャップを最小限に保つための対応が必要 #クラウド#インフラ#セキュリティ
@aktsmm / 23日前 AI に公式ドキュメントを調べてもらう: ドキュメント検索 MCP 8 選と使い分け 公式ドキュメント検索用のMCPサーバーが8系統あるMicrosoft Learn MCP Server、Google Developer Knowledge MCP Server、AWS Knowledge MCP Server、Claude Code Docs MCPなど、認証方式や接続方法が異なる認証方式や接続方法を確認し、代表クエリが動くか試すことが重要 #クラウド#DevOps・CI/CD#インフラ
@Anna Heim / 23日前 Mistral、30億ユーロを調達し、国際的なAI戦略を強化 Mistral AIが30億ユーロを調達し、欧州の技術独立性を強調30億ユーロの資金調達、欧州での1ギガワットの計算能力構築、中国モデルのホスティング欧州の技術依存を減らす戦略と、国際的な投資家ネットワークの構築が成功の鍵 #生成AI・LLM#AIエージェント#クラウド
@Zack Whittaker / 23日前 ハッカーが340億円規模の暗号資産を盗難、一部返還 ブロックチェーンネットワークの脆弱性を悪用された340億円規模の資産盗難が発生ブロックストリームのLiquid Networkでバグを悪用したハッカーによる資産流出、バグ修正後に一部返還セキュリティ対策の不備が重大な損失につながる可能性がある #クラウド#セキュリティ
@taka_yayoi / 23日前 DatabricksのFMAPI直叩きとai_query、大きな違いはレート制御を誰が担当するか Databricksで基盤モデルを呼び出す方法はFMAPI直接呼び出しとai_queryの2種類で、レート制御の責任範囲が異なるFMAPI直接呼び出しは呼び出し側で同時実行制御と再試行の間隔調整が必要、ai_queryはエンジン側が自動管理実験でFMAPI直接呼び出しでは57件が429エラーになるが、自前バックオフを実装すると200件すべて処理可能 #クラウド#インフラ#DevOps・CI/CD
@Tim Fernholz / 23日前 Stoke Space、10億ドルを調達し、スペースXに挑む再利用ロケット開発を推進 Stoke Spaceが10億ドルを調達し、再利用可能なロケット開発を推進燃料はメタンや酸素ではなく資金、熱防護システムに超冷却水素を採用、Nova PathfinderとNova Block 2の開発計画再利用可能なロケットの開発には巨額の資金が必要で、熱防護技術が鍵となる #クラウド#インフラ#バックエンド
@ASUNI-NARE / 23日前 AIエージェントが「PCに入っている」時代へ。NVIDIA「RTX Spark」が変えるローカルAI NVIDIAがRTX Spark搭載PCを10月に発売し、ローカルAIとAIエージェントの導入を容易にするRTX SparkはGrace CPUとBlackwell RTX GPUを統合したSoCで、最大128GBのユニファイドメモリを搭載。Hermes AgentやOpenClawのローカルモデル導入を支援AIエージェントをワンクリックで導入できる仕組みが整い、ローカルAIの利用が一般化しやすくなる #AIエージェント#生成AI・LLM#クラウド
@morii / 23日前 1,500人のカメラマンに社内NotionのQAエージェントを提供した話 Notionのナレッジを構造化し、高速・高精度なQAエージェントを構築したBM25を採用し、画像のVLM解析と増分クロールを実装画像のキャッシュとページ数が増えるとコストが増えるため、ページ数と画像枚数を管理する #バックエンド#クラウド#DevOps・CI/CD
@Yutaka Kashiwabara / 23日前 Gateway不要でBedrockの高額モデルを自動Denyする構成を実測 — IAM反映は約11秒 IAM customer managed policyでBedrockの高額モデルを段階的にDenyする構成を実測invocation logの配信遅延(T1)とIAMのDeny反映時間(T3)を測定、cross-Region inference profileのARN指定とpolicyサイズ制限を確認inputTokenCountだけでは98%のトークンが漏れるためcacheRead/Writeを含めた集計が必要、policyサイズはARN数と構造に依存する #クラウド#インフラ#セキュリティ