@むーさん / 32日前 OLTP脳でBigQueryに入門してみた(PostgreSQL・DynamoDB経験者向け) BigQueryは列指向ストレージと並列分散処理で高速集計を実現している列指向ストレージで必要な列のみ読み込み、ツリー構造で並列処理する仕組み、パーティショニングでスキャン量を減らす設計SELECT *はコストが跳ね上がるため、必要な列のみ指定するクエリ書き方が重要で、パーティショニングを活用する設計が必要 #クラウド#データベース#DevOps・CI/CD
@jun110 / 33日前 Oracle Autonomous AI Database に Rerank モデルを組み込んで、Rerank 処理を In-DB で行う Oracle Autonomous AI DatabaseにRerankモデルをIn-DBで実行できるようにしたONNXフォーマットのモデルをデータベースに取り込み、外部APIを使わずRerank処理を実行、ベクトル化とRerank処理をデータベース内で完結大量の処理でCPUリソースを消費する可能性があるためリソース管理が必要 #AIエージェント#生成AI・LLM#データベース
@Nakada Hiroaki / 34日前 Google CloudでExadataを動かしてみた Oracle Database@Google CloudでExadataを動かす構築方法と注意点が紹介されたODB NetworkとOCIのNSG、Google CloudのCloud RouterとVLANアタッチメントの設定が重要Google Cloudのネットワークリソースクォータに注意し、事前にサポートに相談する必要がある #クラウド#データベース#インフラ
@yu_asa / 36日前 【初心者メモ】DB設計の正規化を第1〜第5正規形まで、注文テーブルで整理してみた 注文テーブルを例に第1〜第5正規形までの正規化手順を説明している1NFは1セル1値、2NFは複合キーの部分依存除去、3NFはキー以外の依存除去、4NFは無関係な多対多の分離、5NFは結合従属の除去が主なポイント実務では3NFまでで十分な場合が多く、4NF・5NFは理論的な概念として理解しておくのが現実的である #データベース#アーキテクチャ#DevOps・CI/CD
@ssc-ksaitou / 36日前 mysqldump のダンプをPIIマスクしつつ高速ロードしよう 〜 AIに複雑なツールを作らせる mysqldumpのダンプをAIで高速ロードしPIIマスクする手法を実装LOAD DATA文に変換し、INSERT文のパースとタブ区切りデータへの変換をAIに任せたストリーミング処理でINSERT文をパースし、タブ区切りデータに変換する実装が必要 #バックエンド#クラウド#データベース
@ENGINEER TECH BLOG / 36日前 「SQLite + xangi」で始める軽量RAG:個人利用から仕事利用へ広げるアプローチ SQLiteとキーワード・ベクトル検索のハイブリッド方式でRAGを構築可能ベクトル検索とキーワード検索を組み合わせ、差分インデックスで効率化個人からチーム利用へ広げる際はセキュリティと運用ルールを事前に確認する必要がある #AIエージェント#RAG#データベース
@mo__mo / 36日前 分散DBってなんだっけ、レプリケーション・シャーディング・分散SQLの解像度をあげたい人のメモ レプリケーション・シャーディング・分散SQLが分散DBの主要な設計手法として紹介されているレプリケーションはデータのコピーを複数場所に保つ、シャーディングはデータを分けて持つ、分散SQLは複数ノードにまたがるSQLを扱う分割キーの選定や、処理の振り分け、障害時のデータ整合性の判断が設計の重要ポイントとなる #データベース#アーキテクチャ#DevOps・CI/CD
@tirkw / 37日前 TiDB Cloudへの移行記録 TiDB Cloudに移行する際のAUTO_INCREMENTの設定ミスやTTLの活用が説明されているMySQL互換モードのAUTO_INCREMENTで4000飛ぶ現象とTTLによる自動削除の仕組みMySQLクライアントで--commentsオプションを指定しないとTiDB固有のコメントが無視される点に注意が必要 #データベース#クラウド#DevOps・CI/CD
@Takahiro Kume / 久米隆大 / 37日前 【AWS】Aurora MySQLのメトリクスを読み解く ― 第1回 BufferCacheHitRatioとMySQLキャッシュヒット率 Aurora MySQLのBufferCacheHitRatioはInnodb_buffer_pool_read_requestsとInnodb_buffer_pool_readsから計算されるキャッシュヒット率とほぼ一致MySQLのキャッシュヒット率はInnodb_buffer_pool_read_requestsとInnodb_buffer_pool_readsの比で算出され、AuroraのBufferCacheHitRatioも同じ計算式で求められる過渡的な負荷状態ではメトリクスに数ポイントの差が生じるが、定常状態ではほぼ一致するため、キャッシュミスの状況を反映している #クラウド#データベース#DevOps・CI/CD
@せとぅ / 37日前 Fabric Warehouse の queryinsights でクエリを監視&分析する Fabric Warehouseのqueryinsightsでクエリ履歴と集計情報をT-SQLから参照できるexec_requests_historyとlong_running_queriesなどのビューで履歴と集計を確認、クエリ形状単位の集計が可能クエリ形状が同じ場合はフィルター条件に関係なく同一クエリとして扱うため、傾向分析に適している #バックエンド#クラウド#データベース
@mo__mo / 38日前 ExaDB-XSの新機能「Automatic Failover(FSFO)」を試す - その2:フェイルオーバー ExaDB-XSのData Guard GroupでAutomatic Failoverを試し、プライマリ障害時にスタンバイが自動昇格することを確認FSFOとOCI管理Observerによる自動フェイルオバーや、ASYNCでのRedo転送によるデータ損失リスク、Physical Standbyの再参加手順障害時のデータ損失が発生する可能性があり、再参加には手動の再構築が必要な点に注意 #データベース#クラウド#インフラ
@nt_matsuda56 / 41日前 SQL初心者向け~参画までに覚えたいSQL構文10選~ SQL初心者が案件に参画するまでに覚えておきたい基本構文10選を紹介SELECT・WHERE・ORDER BY・JOIN・GROUP BY・HAVING・INSERT・UPDATE・DELETE・COUNT・SUM・AVGの構文を解説SELECTとWHEREはSQLの基本なので最優先で覚えること、JOINやGROUP BYも実務で頻繁に使う構文であること #バックエンド#データベース#DevOps・CI/CD
@nt-izumi / 41日前 【SQL入門④】SSMSとは?SQL Serverを操作するための管理ツールを初心者向けに解説 SSMSはSQL Serverを操作するための管理ツールで、データベース確認やSQL実行が可能SQL Serverへの接続、データベース確認、SQL作成・実行、実行結果確認が可能、インスタンス名で接続するインスタンス名を指定して接続する際はサーバー証明書を信頼する設定が必要で、環境に応じて変更する #バックエンド#データベース#DevOps・CI/CD
@ara_ara09 / 41日前 【SQL】「文」ではなく「式」として理解するCASE式の真価(達人に学ぶSQL徹底指南書 第2版より) CASE式を「式」として理解することでSQLの表現力が向上するCASE式は値を返す式で、SELECTや集約関数に直接使える、検索CASE式が条件指定に柔軟ELSEを省略すると予期せぬNULLが返って集計エラーの原因になる #バックエンド#データベース#DevOps・CI/CD
@s_horikoshi / 42日前 RDS for PostgreSQL初期設計 マスターユーザーを避けRoleを用途別に分ける RDS for PostgreSQLでマスターユーザーを避け、Roleを用途別に分ける設計を推奨マスターユーザーは初期設定に限定し、app_owner・app_user・app_readonlyなどのRoleを分離、sslmode=verify-fullでTLS検証を強制RDSのパブリックアクセスを無効にし、セキュリティグループで通信元を制限、パスワードをSQLファイルに残さない #バックエンド#クラウド#データベース
@umekikazuya / 42日前 【MySQL】「UUIDv7にすると速くなる」は本当。でも条件付きでテーブルサイズが大きくなる ~ InnoDB 1000万行を29回実測 UUIDv7のミリ秒内が単調かどうかで挿入速度とテーブルサイズに大きな差が出るUUIDv7(ミリ秒内がランダム)はUUIDv4より速度は2.6倍だがテーブルサイズが2.88GBと悪化、UUIDv7(ミリ秒内が単調)はAutoIncrementに近い速度と1.55GBのサイズになるUUIDv7を使用する際はミリ秒内を単調に生成する実装であるか確認し、カウンタのオーバーフロー対策を必ず行うことが重要である。 #データベース#バックエンド#DevOps・CI/CD
@木村 駿介 / Shunsuke KIMURA / 44日前 Markdownノートを日本語で全文検索できるCLI「mikke」を作った 日本語対応のMarkdownノート検索CLI「mikke」が公開されたSQLite FTS5のtrigram tokenizerで日本語検索、ローカルembeddingによる意味検索、単一バイナリで即起動全文検索はBM25で関連度順、意味検索はローカルで実行し機密ノートにも対応する #データベース#バックエンド
@ぽこひで / 45日前 RDS Proxyを導入して、数ヶ月で撤去した話 RDS Proxyを導入したが、Prismaが生成する16KB超のSQLテキストによりセッションピン留めが発生し、数ヶ月で撤去した16KB制限はAWS全エンジン共通で設定では回避不可、Prisma7で接続プールがアプリ側に移行した16KB超のSQLテキストがピン留めの主因で、RDS Proxyのコストと障害リスクが運用上問題になったため撤去した。 #クラウド#データベース#インフラ
@nt-izumi / 48日前 【SQL入門①】初めて学ぶSQL!データベースの基礎からわかりやすく解説 SQLはデータベースを操作するための言語として公開されたSELECT/INSERT/UPDATE/DELETEの4つの命令でデータ操作、Excelとデータベースの比較が説明されているデータベースの仕組みを理解するための第一歩としてSQLを学ぶことが推奨される #バックエンド#データベース#学習