Scraps 最終更新 2026/10/04 18:40

記事一覧 新着順

@jqit_suwa /

AIにテストを書かせると、決まって同じ場所が抜ける

  • AIが生成したテスト仕様書は78件のテストケースを自作し、要件の矛盾も指摘したが、規格で測ると平均63.12%の網羅性だった
  • 同値分割(EP)のvalidのみでinvalidを抜ける、境界値分析(BVA)の下限を無視、決定表(DT)の条件を1つずつしか動かさない
  • テストケースの網羅性は基準によって100%から25%まで変化し、同じ文書でも異なる結果になることが分かった

@ihiratch /

状態空間モデルにおけるFilteringとSmoothingの違いを理解する

  • Filteringは過去の観測から現在の状態を推定し、Smoothingは未来の観測も使って過去の状態を推定し直す
  • Filteringはp(x_t|y_{1:t})を計算し、Smoothingはp(x_t|y_{1:T})を計算する。予測ステップとベイズ更新、後ろ向きの尤度計算が主な手順
  • SmoothingはFilteringより19%高い推定精度を示し、信用区間も狭くなるが、両者のアンサンブルでさらに精度向上が可能である。

@Takahiro Kume / 久米隆大 /

【AWS】Aurora MySQLのメトリクスを読み解く ― 第1回 BufferCacheHitRatioとMySQLキャッシュヒット率

  • Aurora MySQLのBufferCacheHitRatioはInnodb_buffer_pool_read_requestsとInnodb_buffer_pool_readsから計算されるキャッシュヒット率とほぼ一致
  • MySQLのキャッシュヒット率はInnodb_buffer_pool_read_requestsとInnodb_buffer_pool_readsの比で算出され、AuroraのBufferCacheHitRatioも同じ計算式で求められる
  • 過渡的な負荷状態ではメトリクスに数ポイントの差が生じるが、定常状態ではほぼ一致するため、キャッシュミスの状況を反映している

@sasakuna /

敵対的検証をLLMコードレビューで試すと何が起きるのか

  • 敵対的検証に反論役を追加したAdversarial Reviewがコードレビュー精度を3ポイント向上させる
  • Reviewerが問題点を指摘しCriticが証拠付きで反論し合意までやり取りする、AGREE/DISAGREE_EVIDENCE/DISAGREE_CONCERNの3分類
  • トークン消費が4.5倍になるためコストと精度のバランスを考慮する必要がある

@クロスマート Tech Blog /

Claude Codeのメモリ機能で、何を覚えさせて何を覚えさせないか

  • Claude Codeのメモリ機能で、フィードバックや好みを記憶させることで作業効率を向上させる
  • フィードバックタイプの記憶で理由まで記録し、userタイプで使い手の好みを保存する。変化する情報は現状ファイルに集約する
  • 変化する予定や進行状況はメモリに保存せず、常に現状ファイルを確認する必要がある

@Takuma Kuga /

Snowflake CoCoでdbtモデル生成を試す:自然言語・設計情報・実装ルールで何が変わるか

  • Snowflake CoCoで自然言語や設計情報を入力した際、dbtモデルの生成結果に実装ルールが反映される
  • パターン③ではCTE構成や命名規則が生成コードに反映され、パターン②ではdbt設定やテスト定義がYAMLに含まれた
  • キー項目の扱いがJOIN条件と出力項目で不一致になる可能性があり、実データとの照合が必要

@kane_ryu /

PostgreSQL→Spanner移行後に248テーブルのER図(A5:SQL Mk-2)を効率的に再構築した話

  • PostgreSQLからCloud Spannerへの移行後、248テーブルのER図をA5:SQL Mk-2形式で効率的に再構築した
  • gcloudコマンドのフラグ指定ミス、.a5erファイルのPosition/ZOrder設定、Pythonスクリプトによる差分マージを実施
  • 新規テーブルの配置座標を既存テーブル範囲内に設定し、リネームカラムのコメントを引き継ぐことで作業量を削減した

@平木 佳介 /

[社内勉強会資料公開] Claude Code 入門 #7 — プラグインとマーケットプレイスで一気に拡張する

  • Claude Codeでプラグインを導入して機能を拡張する方法が説明されている
  • プラグインはスキル・サブエージェント・スラッシュコマンドをまとめて配布し、マーケットプレイスからインストールする
  • 導入前に出所・中身・更新状況を確認する習慣がセキュリティ面で重要

@wfukatsu /

【チームによるAI駆動開発の勘所:第7回】AIに、二度、同じ指摘をしない

  • レビュー指摘の資産化率を測る指標を定義し、還元不要の判定基準を示した
  • 資産化率は還元済み件数÷還元対象件数、還元不要には4つの理由コードが設定されている
  • 還元不要の判定にはリーダーの承認が必要で、分母の操作を防ぐための仕組みが導入されている

@よさ /

TanStack Start + Hono + oRPC + Cloudflare Workersで社内ERPを作った設計と学び

  • Cloudflare Workers上でTanStack Start + Hono + oRPC + PostgreSQLを組み合わせて社内ERPを開発した設計と学びを共有
  • API契約と実装の分離、EVM計算の純粋関数化、Hyperdriveによるキャッシュと正しさの分離
  • API契約を独立したパッケージにすることで、実装変更とAPI変更を明確に分離できるが、DTO定義の保守コストが増えることに注意

@KAKEHASHI Tech Blog /

ユーザーからSREとして「中の人」へ、薬局での体験から繋がるカケハシの開発者体験

  • カケハシではオンボーディングが充実し、1on1の文化やカンファレンス支援制度が特徴的
  • オンボーディングコンテンツが豊富で、SSOやIaC化が整っており、隣のチームとの1on1やカンファレンス参加を支援する制度がある
  • 社内でのコミュニケーションやスキルアップの機会が豊富で、生成AIを活用した開発が推進されている

@ryu-ki /

【AgentCore】Runtime の命名で混乱したのでルールを整理する

  • AgentCore Runtimeの命名ルールをAPI、CLI、CDKから整理した
  • agentRuntimeNameは英字始まり・英数字とアンダースコア・最大48文字、CLIのエージェント名はハーネスプロジェクトで40文字
  • CLIのプロジェクト名は23文字まででアンダースコア不可、CDKのruntimeNameはAPIと同一で変更すると再作成される

@せとぅ /

Fabric Warehouse の queryinsights でクエリを監視&分析する

  • Fabric Warehouseのqueryinsightsでクエリ履歴と集計情報をT-SQLから参照できる
  • exec_requests_historyとlong_running_queriesなどのビューで履歴と集計を確認、クエリ形状単位の集計が可能
  • クエリ形状が同じ場合はフィルター条件に関係なく同一クエリとして扱うため、傾向分析に適している

@カミナシ エンジニアブログ /

SaaSの技術的難しさはホリゾンタルとバーティカルで異なる

  • SaaSの技術的難しさはホリゾンタルとバーティカルで戦い方が異なる
  • ホリゾンタルは95点の答えを高速に実装し、バーティカルは30点の解を70点に高める
  • テーマごとに90点か70点かを判断し、品質水準や検証プロセスを変える必要がある

@shirok /

Oracle AI Database Private Agent Factory 26.4 を 26.7 へ Upgrade してみてみた

  • Oracle AI Database Private Agent Factory 26.4 を 26.7 へアップグレードした手順と結果
  • エージェント間コラボレーション、エージェントメモリ、IAM、モデルプロバイダ拡張、キャンバス機能強化が主な新機能。既存環境を維持したままアップグレードする手順が記載されている
  • SELinuxの設定やPodmanのカスタムグラフルートの確認が必要で、アップグレード失敗時はDiagnostics Bundleを取得して原因を特定する

@songchong /

【2026年8月調査】「APIあります」の実態を調べてみた|日本の業務システム56件を2軸(公開度 × 契約条件)で分類した

  • 日本の業務システム56件のAPI公開状況を公開度と契約条件の2軸で分類した
  • 公開度は第三者に開かれた27件、契約条件が不明な28件、上位プランが必要な5件が判明
  • APIの利用には契約プランの確認と仕様書の公開状況を事前に確認する必要がある