Scraps 最終更新 2026/10/02 03:40

記事一覧 新着順

@Mirai Translate TECH BLOG /

執筆者もレビュアーも AI を使う時代の、技術ブログレビューの設計

  • 技術ブログのレビューをAIと人間で分担する運用を設計した
  • 執筆者のAIレビューで文章品質を担保、編集部は4つの観点のみ確認。指摘の条件に根拠の提示と質問形式を導入
  • AIの指摘は根拠を伴わないと修正要求にならない。確認した項目を記録に残すことで二重チェックを確実にする

@hayao_k /

Lambda 関数 URL で Condition 句による IP アドレス制限が可能になったか検証する

  • Lambda 関数 URL のリソースベースポリシーに IP アドレス制限が可能になった
  • PutResourcePolicy API で完全な JSON ポリシーを設定し、NotIpAddress 条件付き Deny ステートメントで制限を実装できる
  • PutResourcePolicy でポリシーを上書きするため、既存のポリシーは事前に GetResourcePolicy で取得しておく必要がある

@ikedan /

AIのテスト設計、90点未満は差し戻す

  • AIが生成したテスト設計はルールベースの検証では不十分で、多段パイプラインで採点と敵対レビューを組み合わせて品質を確保する
  • 採点器(100点満点で90点未満は差し戻し)と、生成文脈を知らない敵対レビュアーを組み合わせ、調査・観点シート・テストケースの展開を分離する
  • 90点未満のテスト設計は減点理由とともに再生成されるが、敵対レビューで採点器が見逃した欠陥も検出する

@rikachiii /

POPOPO と AI 開発 - 01. POPOPO の AI 開発概要

  • POPOPOのバックエンド開発でDevinを活用し、約289,000行のコードを2.6人チームで管理した
  • Devinによるコード生成とClaude Codeの併用、Firestoreを前提とした設計、統合テストとlintの基盤
  • AI導入後の70%のPRがDevinによるもので、コード量の85%がAIで追加されたが、開発効率の向上にはAI以前の基盤も影響している

@株式会社ソニックムーブのフィード /

HTTP/3 を知ったので Docker で動かして仕組みを確かめた

  • HTTP/3はTCPの制約を解消するためにQUICプロトコルに移行した
  • QUICはストリームごとの独立した順序管理とConnection IDによる接続識別、TLS1.3内蔵による1往復接続確立を実現
  • HTTP/3はUDPポート443を必要とし、Alt-Svcヘッダでクライアントに接続方法を通知する

@RyoskDara_ /

Agent MetadataでDatabricks Genieの挙動はどう変わるか?

  • Databricks GenieのAgent Metadataのsynonymsに社内略語を記載すると、ユーザーの質問に正しい指標を返せるようになる
  • synonymsに「解約率」と記載すると取引先ベースの指標を、別名に「ACV」と記載すると受注金額の指標を引き当てられる
  • 同じ言葉で複数の指標がある場合はsynonymsを記載しないと意図しない指標が返ってくる可能性がある

@Yasuhito Morimoto /

国内AIエージェント動向(2026/9/25号)

  • 国内AIエージェントが業務システム操作や施策実行まで行う段階へ移行
  • RUFU AIはEC・業務ツール横断操作、ECPRO BRAINは分析から実行・検証まで一体化、GMOグローバルサイン・HDとVESS LabsはAIエージェント間取引の信頼基盤実証
  • AIエージェントの権限管理や監査ログ、人による承認が導入の成否を左右する

@今岡陵 /

【セキュリティ】AIコードアシスタント「Aikido」が発見──GitLabのメール取込機能の脆弱性を突く「Push to Main」攻撃の手口

  • GitLabのメール取込機能を悪用した「Push to Main」攻撃が発見された
  • メール送信者検証の不備と保護ブランチへの直接プッシュが可能になる仕組み
  • メール経由のコードコミット機能は不要な場合は無効化し、送信元検証を厳格に設定するべき

@rw21 /

情シス依頼の一次受付をAI Agentに任せるっきゅ!

  • Slackで依頼の一次受付をAIエージェントが行う仕組みを実装した
  • Claude Agent SDKとOpenClawを活用し、キャラクター性をプロンプトに組み込み、フィードバック収集用のツールを導入
  • 非エンジニアも改善に参加できるようにHermesエージェントを活用し、フィードバックを収集して改善サイクルに反映

@ryosuke_ohori /

Jev完全ガイド:GPTやClaudeとは違う「判断するAI」は何を変えるのか!?

  • Jevは文章生成ではなく型付き確率的判断を返すAIモデル
  • 型付き質問とstateを一度の並列処理で評価、Choice/Score/Noulの3種類の質問形式、キャリブレーションされたConfidence値を返す
  • 判断結果の信頼度(Confidence)で自動処理/人間確認のバランスをコードで制御可能

@koki takeishi /

Physical AI、この1年で何が変わった? VLA・世界モデル・小型化をざっくり整理

  • Physical AIのVLA・世界モデル・小型化が進化し、実用化に向けた実装が進んでいる
  • VLAは経験と記憶を活用する仕組みが追加され、世界モデルは行動予測と映像生成を組み合わせる。SmolVLAは4.5億パラメータの小型VLAが登場
  • ロボット学習ではエピソードを残すことで後から振り返りが可能で、データの再現性と比較が重要

@ik-fib /

文章を返さないAI「Jev」を試してみた ── 社内問い合わせのエスカレーション先は判定できるか

  • Jevを用いて社内問い合わせのエスカレーション先を判定する仕組みを実装した
  • Jevは確率やスコアを返す型付き質問に対応、分岐ルールはコードで明示的に設計
  • 分類の確信度が低い問い合わせは自動判定せず人間に回す仕組みが必要

@nanora /

/claude-api prompt-audit で棚卸ししたら、Claude Opus 5.5 化で外れた設定がぞろぞろ出てきた

  • Claude Opus 5.5 にアップグレードしたことで、古いモデル向けの設定が動作しなくなった
  • モデルエイリアスが変更されていて、effort 設定が実際のモデル ID に一致しなかった、CLAUDE.md のパス設定が古いファイルを指していた
  • モデルのバージョン変更時に設定ファイルのモデル ID を確認し、セッション記録から effort 設定の有効性を確認する必要がある

@akito8639 /

Claude Code の週間リミット、気づいたら尽きてない? →「いつ尽きるか」を予測する macOS ウィジェットを作った

  • Claude Codeの使用状況をmacOSウィジェットで予測表示するアプリ「Orbit for Claude Code」が公開された
  • OAuthトークンで非公式APIを呼び出し、週間リミットや5時間枠の予測時間を表示。ペースマーカーと上限切れの予測ロジックを実装
  • キーチェーンのアクセストークンを更新しないとClaude Code側が古いトークンを使い続ける可能性がある