DP-900:Microsoft Azure Data Fundamentals 問題一覧

388問 · 9カテゴリ · タップで開閉

練習を始める

データの基礎63

1

ある製造工場がQC検査ラインで以下4種類のデータを収集しています。「半構造化データ」に分類されるのはどれか?

定義
2

ある銀行が2つのシステムを運用しています。①ATM出金処理(毎秒数千件・ACID保証必須・即時応答)と②全支店の月次収益分析(数億行・複雑な集計クエリ)。それぞれのシステムタイプの正しい組み合わせはどれか?

定義
3

あるECサイトが「注文を受けた瞬間に在庫を引き当て、15秒以内に在庫不足アラートを送信する」要件を持っています。最も適したデータ処理方式はどれか?

定義
4

データパイプラインの設計で「生データのままAzure Synapse Analyticsへロードし、Synapseの大規模並列処理エンジンで変換する」アプローチはETLとELTのどちらか?

定義
5

ネット銀行が「A口座から1万円引き落とし」と「B口座に1万円入金」を同一トランザクション内で実行中にシステム障害が発生し、引き落としだけ成功した状態になりました。システムは引き落としを自動的に取り消して両口座を変更前の状態に戻しました。これはACIDのどの特性によって保証されているか?

定義
6

注文管理テーブルに「注文ID・顧客名・顧客住所・商品名・商品単価・数量」が1テーブルに入っており、同一顧客が別注文をすると顧客名と住所が重複格納されます。この冗長性を解消するために行うデータ設計の手法はどれか?

定義
7

「注文テーブル」に「顧客ID」列があり、「顧客テーブル」の主キーを参照しています。存在しない顧客IDの挿入を防ぐこの列を何というか?

定義
8

小売業のデータウェアハウスが「売上ファクトテーブル」と「時間・商品・店舗・顧客ディメンション」で構成されています。「第3四半期・北海道エリアの商品カテゴリ別売上」を分析する際の操作を何というか?

定義
9

1億行の注文テーブルで「顧客ID = 'C00123'」を検索するクエリが遅い。クラスタ化インデックス(Clustered Index)と非クラスタ化インデックス(Non-clustered Index)の違いとして正しいのはどれか?

定義
10

データベース管理者が「特定部署の社員情報のみ見えるように、実際のデータを複製せずに仮想的なテーブルを作成したい」と考えています。最適なデータベースオブジェクトはどれか?

定義
11

あるIT部門が「あらゆる形式のデータを生のまま一元的に蓄積し、後でどう活用するか決める」戦略を取ろうとしています。この戦略に対応するデータ蓄積アーキテクチャはどれか?

定義
12

グローバルSNSが世界複数リージョンに「いいね数」を分散して保持しています。いいね後にすぐ全リージョンで同じカウントが見える保証はないが、しばらくすれば全リージョンで同じ値になります。このデータ整合性モデルはどれか?

定義
13

以下のデータモデルとユースケースの組み合わせで「最も適切」なのはどれか?

定義
14

IoTセンサーから毎秒データが届き「直近5分間の平均温度を1分ごとに計算して異常を検知したい」という要件があります。このストリーム処理のウィンドウ種別はどれか?

定義
15

小売チェーンのデータウェアハウスにある「売上ファクトテーブル」の特徴として正しいのはどれか?

定義
16

Power BIダッシュボードで「年 → 四半期 → 月 → 日」と段階的に詳細データへ移動する操作を何というか?

定義
17

データウェアハウス設計でOLTPとは逆に「非正規化(Denormalization)」を意図的に行う主な目的はどれか?

定義
18

データパイプラインで「オンプレミスのSQL Serverから1時間ごとに更新されたレコードのみを抽出してAzureに転送する」仕組みを何というか?

定義
19

大企業のデータエンジニアリング部門が「Azure全体に分散する数百のデータセットのメタデータを一元管理し、データの血統(どこから来てどこへ行ったか)を追跡し、機密データを自動分類したい」という要件を持っています。最も適したAzureサービスはどれか?

定義
20

「データベース内に複数のSQL文をまとめてサーバー側で定義し、アプリケーションから名前とパラメータを指定して呼び出す」仕組みを何というか?

定義
99

以下の4つのデータのうち「半構造化データに分類されない」のはどれか?

定義
100

次の4つのシナリオのうち「ACIDトランザクションの保証が最も重要」なのはどれか?

定義
101

「社員ID・社員名・部署名・部署電話番号・プロジェクト名」を1テーブルに持つ設計の最大の問題点はどれか?

定義
102

以下の要件のうち「バッチ処理が適切で、ストリーム処理は過剰」なのはどれか?

定義
103

「ELTがETLより有利になる条件」として正しいのはどれか?

定義
104

データウェアハウスの「スノーフレークスキーマ」と「スタースキーマ」の違いとして正しいのはどれか?

定義
105

OLAPの操作で「日別の売上データを月別・年別と段階的により高い粒度に集約する」操作を何というか?

定義
106

全社規模のデータウェアハウスから「マーケティング部門専用の分析環境」を切り出して構築したものを何というか?

定義
107

リレーショナルDBの「主キー(Primary Key)」の制約として正しいのはどれか?

定義
108

データベースのインデックスが「逆にパフォーマンスを低下させる」ケースはどれか?

定義
109

「スキーマオンリード(Schema-on-Read)」の説明として正しいのはどれか?

定義
110

データウェアハウスの「SCD Type 2(緩やかに変化するディメンション タイプ2)」の特徴はどれか?

定義
111

データ品質の「完全性(Completeness)」を確認する検証として適切なのはどれか?

定義
112

「メダリオンアーキテクチャ(Medallion Architecture)」の正しい説明はどれか?

定義
113

「参照整合性制約(Referential Integrity)」について正しい説明はどれか?

定義
114

大規模なテーブルに「パーティショニング」を適用する主な目的はどれか?

定義
115

「コミットされていないデータを他のトランザクションが読み取れる(ダーティリード)」が発生する可能性があるトランザクション分離レベルはどれか?

定義
116

「ユーザーIDを基にデータを複数のDBサーバーに分散させる」アーキテクチャを何というか?

定義
117

「顧客テーブルの全レコードを取得し、注文テーブルに一致するレコードがない場合はNULLを返す」JOIN種別はどれか?

定義
118

NULL値の比較について正しいのはどれか?

定義
174

リレーショナルデータベースの「複合インデックス(Composite Index)」と「カバリングインデックス(Covering Index)」の説明として正しいのはどれか?

比較
175

データウェアハウス設計における「トランザクションファクトテーブル」と「スナップショットファクトテーブル」の違いとして正しいのはどれか?

比較
176

OLTPシステムとOLAPシステムの処理特性の違いとして最も適切なのはどれか?

比較
177

「ETL」と「ELT」のデータ処理順序とそれぞれが有利な状況の違いはどれか?

比較
178

「強い一貫性(Strong Consistency)」と「結果整合性(Eventual Consistency)」の違いとして最も正確なのはどれか?

比較
179

「バッチ処理」と「ストリーム処理」の最適な用途の違いはどれか?

比較
180

以下の記述のうち、誤っているものはどれか?

誤り発見
181

以下の記述のうち、誤っているものはどれか?

誤り発見
182

以下の記述のうち、誤っているものはどれか?

誤り発見
183

以下の記述のうち、誤っているものはどれか?

誤り発見
184

以下の記述のうち、誤っているものはどれか?

誤り発見
185

以下の記述のうち、誤っているものはどれか?

誤り発見
186

あるeコマースプラットフォームが1日に以下のデータを記録しています:注文数3,450件、各注文の平均商品点数2.8点、商品の平均単価3,200円、配送料は注文1件につき800円固定です。この日の配送料収入の合計金額として最も近いのはどれか?

計算
187

ある製造工場が品質管理データを収集しています。月間生産個数18,000個、不良品率2.5%、良品の検査合格率98.2%です。月間で最終的に合格できた製品個数(小数点第1位で四捨五入)として最も近いのはどれか?

計算
189

データウェアハウスのディスク容量計画について、現在のテーブルサイズ2,680GB、月間増加率1.8%、バックアップに元データの3倍の容量が必要です。3ヶ月後の必要総容量(GB、小数点第1位で四捨五入)はいくらか?

計算
190

ストリーム処理システムでリアルタイム分析を行っています。秒間イベント数12,500件、1イベント当たりの平均データサイズ4.2KB、処理遅延許容時間180秒です。この許容時間内に処理できる最大バッファサイズ(MB、小数点第1位で四捨五入)はいくらか?

計算
191

データベースのパフォーマンス分析で、クエリ実行時間が平均42ミリ秒、1日の実行回数8,940回、平均CPU使用率により削減後は36ミリ秒に改善予定です。1日の総実行時間短縮(秒、小数点第2位で四捨五入)はいくらか?

計算
192

あるECサイトが既存のRDBMS(SQL Server)から、1日10億件のセンサーイベントデータを毎秒取り込む要件に変更されました。既存のトランザクションログ(トランザクション分離レベル: READ COMMITTED)でDirty Readを防いでいたこのシステムが、新要件下で大量のロック競合が発生して書き込み性能が急落した場合、最も効果的な対策はどれか?

応用
193

データエンジニアが「オンプレミスの営業管理DB(正規化済み・トランザクション性重視)」から「Azureのデータウェアハウス(複雑な分析クエリ対応)」への切り替えを検討しています。元DBの「社員テーブル・営業成績テーブル・顧客テーブル」を非正規化して1つのディメンション結合テーブルにまとめることにしました。このアプローチが招く最大のリスクはどれか?

応用
194

小売企業が「注文データ(毎日1GB)をAzure Data LakeにELT方式で毎日深夜0時にロードし、Azure Synapse Analyticsで変換処理を実行」するパイプラインを運用しています。ある日、ソースシステムの不具合により「重複した注文レコード(同一注文ID、顧客ID、タイムスタンプが完全一致)が500件含まれた状態」でロードされてしまいました。どのような影響が最も懸念されるか?

応用
195

銀行が「顧客ID・口座番号・口座種別・残高」を持つ口座テーブルを設計しており、同一顧客が複数口座を保有する場合があります。新しい前提として「顧客は最大3つの普通預金口座しか保有できない」という業務ルールが追加されました。このルールをデータベース制約で直接実装することはできないため、アプリケーションロジックで検証していますが、管理者が直接SQLで新規口座を挿入する際にこのルールを迂回される恐れがあります。データベースレベルでこのルールを自動的に強制する最適な仕組みはどれか?

応用
196

製造企業が「5年分のセンサー計測データ(500GB、1000万行のセンサーID列あり)」を履歴管理テーブルに保有しており、「直近7日間のセンサーID='SENSOR_12345'のデータ検索」が頻繁に実行されます。現在、全データに対してセンサーID列の非クラスタ化インデックスが設定されていますが、クエリ時間が30秒かかっています。このテーブルに「計測日時によるレンジパーティショニング(月単位)」を適用した場合、最も期待される改善効果はどれか?

応用
197

小売チェーンが「売上ファクトテーブル(毎日1000万行)」と「商品ディメンション(商品ID・商品名・カテゴリ・単価・仕入先)」を持つスタースキーマを運用しています。ある商品の仕入先が6ヶ月前に変更されたとき、当該商品ID='P99999'について「6ヶ月間、新仕入先での売上が本当は100万円だったが、旧仕入先の100万円として集計されていた」ことが判明しました。このシナリオで、正規化スキーマではなく、SCD Type 2(緩やかに変化するディメンション タイプ2)を採用していた場合、対応効率にどのような利点が期待されるか?

応用

Azureリレーショナル44

21

あるSIerがオンプレミスSQL Server 2019をAzureに移行します。アプリは「SQL Server Agentによる夜間バッチ」「複数DBにまたがるクロスデータベースクエリ」「CLR統合によるカスタム関数」「データベースメール(エラー通知)」を使用しています。インフラ管理の負担を最小化しながらアプリ改修なしで移行できるのはどれか?

定義
22

ある企業がオンプレミスSQL Server 2022の本番DBをAzureへ移行します。「インスタンスレベルの機能(SQL Agent・リンクサーバー・Service Broker)は不要」「最大4TBまでのストレージで十分」「OSやパッチ管理を一切したくない」という条件の場合、最もコスト効率の高い選択肢はどれか?

定義
23

ある医療システムがAzure SQL Databaseで患者データを管理しています。「障害時のフェイルオーバーを自動化し、接続文字列を変更せずに別リージョンへ切り替えたい」という要件があります。最適な機能はどれか?

定義
24

ある小売企業のAzure SQL Databaseに数十億行の販売トランザクションが蓄積しており、ストレージが急増しています。「接続文字列を変えずに100TB以上へのスケールアップが必要」かつ「OLTPトランザクションも継続が必要」という条件を満たすのはどれか?

定義
25

あるスタートアップが新サービスの開発環境用にAzure SQL Databaseを利用しています。「開発中は数時間使って数日間放置する」という断続的なワークロードで、「使っていない時間の課金を最小化したい」という要件があります。最適なティアはどれか?

定義
26

ある企業が40個のSaaSテナント向けに個別のAzure SQL Databaseを保有しています。各テナントの使用率は予測困難で「ピーク時は高負荷・通常時はほぼアイドル」の繰り返しです。個別にDTUを確保すると全体コストが高くなる問題があります。最適な解決策はどれか?

定義
27

あるアプリ開発チームがAzure SQL Databaseのデータを「暗号化したまま」クエリを実行したい(データベースエンジンにも平文を見せたくない)要件があります。該当する機能はどれか?

定義
28

コールセンターのオペレーターがCRMシステムで顧客の電話番号を照会しています。「オペレーターには電話番号の下4桁のみ表示し(例: ****-****-1234)、フルの番号は参照できないようにしたい」という要件があります。最適な機能はどれか?

定義
29

マルチテナントのSaaSアプリがAzure SQL Databaseを使用しています。「各テナントは自分のデータのみ参照できる」という要件を、アプリケーションロジックではなくデータベース側で強制したい場合、最適な機能はどれか?

定義
30

Azure SQL DatabaseをパブリックインターネットからではなくVNET内のAzure VMからのみアクセスさせたい場合、最も推奨されるネットワーク構成はどれか?

定義
31

Azure Database for PostgreSQLとAzure SQL Databaseの選択について、「オープンソースのPostgreSQLドライバを使用する既存のPythonアプリ(psycopg2)をコード変更なしでクラウドに移行したい」場合に適切なサービスはどれか?

定義
32

Azure SQL Databaseのクエリで「各顧客の過去12ヶ月の注文を直近3ヶ月分ずつローリング集計したい」という要件があります。ウィンドウ関数のどの構文を使うか?

定義
33

オンプレミスのSQL Server 2016からAzure SQL Managed Instanceへの大規模移行を計画しています。移行のリスク評価・互換性チェック・移行実行を一貫してサポートするAzureの専用ツールはどれか?

定義
34

Azure SQL Databaseのバックアップについて正しい説明はどれか?

定義
35

Azure SQL Databaseで「全顧客の購買金額ランキングを計算し、同一金額の場合は同じランクを付与したい(スキップなし)」という要件があります。使用すべきウィンドウ関数はどれか?

定義
36

Azure SQL DatabaseのBusiness Criticalティアの主な追加機能として正しいのはどれか?

定義
37

Azure SQL Databaseのファイアウォール設定で「Azureサービス(Azure Data Factory・Power BIなど)からのアクセスを許可するが、インターネットからの直接アクセスは遮断したい」場合の設定はどれか?

定義
38

Azure SQL DatabaseにおいてT-SQLのCTE(Common Table Expression)の主な利点はどれか?

定義
39

Azure SQL Database で「特定のユーザーにはSELECT権限のみを付与し、INSERT/UPDATE/DELETEは許可しない」という最小権限原則を適用するための正しい方法はどれか?

定義
40

Azure SQL Managed InstanceとAzure SQL Databaseの主な違いとして正しいのはどれか?

定義
198

Azure SQL DatabaseとAzure SQL Managed Instanceの最大の違いはどれか?

比較
199

Azure SQL DatabaseのProvisioned Compute TierとServerlessの主な違いはどれか?

比較
200

Azure SQL DatabaseのSingle DatabaseとElastic Poolの適用シーン、それぞれの違いはどれか?

比較
201

Azure Database for MySQLとAzure Database for PostgreSQLの主な機能差はどれか?

比較
202

Azure SQL DatabaseのPremiumティアとBusiness Criticalティアの主要な違いはどれか?

比較
203

Azure SQL Databaseの「Transparent Data Encryption(TDE)」と「Always Encrypted」の主な違いはどれか?

比較
210

ある企業がAzure SQL Databaseで月間720,000件のトランザクションを処理しています(1日24時間稼働・月30日)。平均クエリ実行時間は1回あたり500ミリ秒です。ピーク時間帯では通常の3倍のトランザクション数が発生します。ピーク時の1時間あたりの総クエリ処理時間は何秒か?

計算
211

あるSaaSプロバイダーがAzure SQL Databaseで複数テナントのデータを管理しています。現在のストレージ使用量は200GB、月間の増加率は5%です。6ヶ月後のストレージ必要容量は何GBか?(小数点第1位で四捨五入)

計算
212

ある金融機関がAzure SQL Databaseで日次バッチ処理を実行しています。データセットAは毎日50万行を処理(1行あたり2msの処理時間)、データセットBは毎日80万行を処理(1行あたり1.5msの処理時間)します。両データセットを並列実行した場合、全体の処理完了時間は何秒か?

計算
213

ある小売企業がAzure SQL Databaseのストレージコストを分析しています。現在4TBのデータを保有し、月間コストは1,000ドルです(ストレージコストのみ、比例計算)。不要なデータを削除して3TBに削減した場合、削減後の月間コストは何ドルか?

計算
214

ある企業がAzure SQL Managed Instanceへの移行を検討しています。オンプレミスのSQL Server 2019では月間のデータベース管理作業に180時間を要しています。移行後、管理作業は月間45時間に削減される見込みです。年間の管理工数削減時間は何時間か?

計算
215

ある企業がAzure SQL DatabaseのRead Replicaを利用しています。プライマリリージョンのデータベースサイズは200GBで、毎月15%の成長率があります。同じ成長率でRead Replicaも拡大する場合、3ヶ月後のプライマリ+レプリカの総ストレージ合計は何GBか?(小数点第1位で四捨五入)

計算
216

ある金融機関がAzure SQL Databaseで顧客資産データを管理しており、突然のリージョン障害が発生しました。現在、同期レプリケーション機能を使用しており、フェイルオーバー中に読み取り操作が一時的に失敗している状況です。この問題を解決するため、接続文字列を変更せずに読み取り操作の可用性を向上させるには、どの機能を追加で導入すべきですか?

応用
217

ある分析企業がAzure SQL Databaseで1ヶ月間に1TB以上のセンサーデータを取り込んでいます。データサイズの急増によるストレージコスト増加と、クエリパフォーマンスの低下が問題となっています。「過去1年間のデータはすべて保持が必要」「直近3ヶ月のデータへのクエリが9割」という特性がある場合、最適な対策はどれですか?

応用
218

ある製造企業がAzure SQL Databaseで供給チェーン管理システムを運用しています。複数の工場から取得した在庫データが「異なるタイムゾーンで同じ時刻に記録される」という特性があります。本社のレポートで「UTC基準の統一時刻」ですべてのデータを並べ替える場合、アプリケーションコードに対する影響を最小化するための対策はどれですか?

応用
219

ある決済企業がAzure SQL Databaseで取引トランザクションを管理しており、ACID特性を厳密に保証する必要があります。ただし、「決済完了直後の数秒間は読み取り遅延が生じても構わない」という非機能要件が追加されました。トランザクション性能を維持しながら読み取りの同時実行性を向上させるために、どの分離レベルを採用すべきですか?

応用
220

ある教育機関がAzure SQL Managed Instanceで学生成績管理システムを構築しています。「特定の科目の担当教員には、その科目の学生成績のみ参照可能」という行レベルセキュリティ(RLS)を実装する必要があります。同時に、「管理者だけは全学生データを参照可能」という要件があります。この要件を満たすための最適な実装方法はどれですか?

応用
221

ある e-コマース企業がAzure SQL Databaseで注文データを管理しており、「毎月末に月間売上報告書を生成するバッチ処理」を実行しています。バッチ処理中にOLTP取引が遅延し、顧客体験が悪化しています。リソース競合を緩和し、バッチと取引の分離を図るために、最適なアーキテクチャはどれですか?

応用
204

Azure SQL Databaseのデプロイメント層とその特性について述べた次の記述のうち、誤っているものはどれか?

誤り発見
205

Azure SQL Databaseのバックアップとリカバリについて述べた次の記述のうち、誤っているものはどれか?

誤り発見
206

Azure SQL Databaseのセキュリティ機能について述べた次の記述のうち、誤っているものはどれか?

誤り発見
207

Azure SQL Databaseのスケーリング機能について述べた次の記述のうち、誤っているものはどれか?

誤り発見
208

Azure SQL Databaseのネットワーク接続について述べた次の記述のうち、誤っているものはどれか?

誤り発見
209

Azure SQL DatabaseとAzure SQL Managed Instanceの比較について述べた次の記述のうち、誤っているものはどれか?

誤り発見

Azure非リレーショナル43

41

あるSNS企業がユーザー同士の「フォロー」「フレンド」関係を管理するDBを設計しています。主な操作は「友達の友達を3ホップ以内で検索」「共通の知人を持つユーザーのレコメンデーション」「最短経路探索」です。最適なCosmos DBのAPIはどれか?

定義
42

あるIoT企業が10,000台のスマートホームデバイスから温度・湿度・電力消費量を毎秒収集・保存しています。「デバイスIDと時刻をキーに毎秒10,000件の高頻度書き込み」「特定デバイスの過去30日分の時系列データ取得」が主な操作で、既存の開発チームはApache Cassandraに精通しています。最適なCosmos DBのAPIはどれか?

定義
43

あるECサイトがAzure Table Storageで商品カタログ(5億件)を管理しています。「クエリレイテンシが増加」「欧米・アジアへの低遅延配信が必要(マルチリージョン)」「既存.NETアプリのコード変更は最小限」という課題が発生しました。最適な移行先はどれか?

定義
44

あるスタートアップがオンプレミスのMongoDBアプリケーションをAzureに移行します。「既存のMongoDBドライバ(PyMongo)を使い続けたい」「コードの書き直しを最小限にしたい」「グローバル分散と高可用性が必要」という要件があります。最適なサービスはどれか?

定義
45

あるゲーム会社が1億人のプレイヤープロファイルを管理するDBを設計しています。「プレイヤーごとに所持アイテムが異なる(スキーマが可変)」「player_idによるルックアップで10ms以内の応答が必要」「書き込みが毎秒数百万件」という要件があります。最適なサービスはどれか?

定義
46

Cosmos DB(Core SQL API)でコンテナを設計する際、「パーティションキーの選択」として最も適切なのはどれか?

定義
47

Cosmos DB(Core SQL API)とCosmos DB(MongoDB API)を比較したとき、「完全に新規のプロジェクトでMongoDBの既存スキルがなく、AzureネイティブなSQLライクなクエリを使いたい」場合に適切なAPIはどれか?

定義
48

あるメディア企業がAzure Blob Storageに大量の動画ファイルを保存しています。「公開直後の30日間は高頻度でアクセスされ、その後1年間はほぼアクセスがなく、1年後は完全に削除したい」という要件があります。コストを最適化するための設定はどれか?

定義
49

ビッグデータ分析チームがAzure DatabricksとAzure Synapse Analyticsを使って大規模なデータを処理します。「フォルダー階層で整理した/year=2024/month=01/形式のデータ管理」「フォルダー単位のPOSIX準拠ACL」「Hadoopエコシステム(ABFSプロトコル)との互換性」が必要です。最適なストレージはどれか?

定義
50

Azure Blob StorageとAzure Data Lake Storage Gen2(ADLS Gen2)について正しい説明はどれか?

定義
51

Cosmos DBの「要求ユニット(RU:Request Unit)」について正しい説明はどれか?

定義
52

Cosmos DBが提供する5つの整合性レベルのうち、「スループットと可用性を最大化し、同じセッション内での書き込みはすぐに読み取れるが、グローバルな順序保証はない」というレベルはどれか?

定義
53

Azure Table StorageとCosmos DB Table APIの主な違いとして正しいのはどれか?

定義
54

あるシステムがAzure Queue StorageとAzure Event Hubsのどちらを使うか検討しています。「毎秒100万件のIoTイベントを複数のコンシューマー(リアルタイム分析システムとデータウェアハウス)が独立したペースで読み取り、7日間イベントを保持したい」という要件に適切なサービスはどれか?

定義
55

Azure Blob StorageのArchiveアクセス層について正しい説明はどれか?

定義
56

Cosmos DBでアイテムに「TTL(Time to Live)」を設定する主な目的はどれか?

定義
57

Cosmos DBのマルチリージョン書き込み(Multi-region Writes)の主なユースケースはどれか?

定義
58

Azure FilesとAzure Blob Storageの違いとして正しいのはどれか?

定義
59

Cosmos DBのGremlin APIとMongoDB APIを比較したとき、「e-コマースの商品レコメンデーションエンジンで、ユーザーAが購入した商品を購入したユーザーBが次に購入した商品を探す多段トラバーサル」に最適なのはどれか?

定義
234

あるIoTデバイスメーカーがCosmos DBを使用して、15,000台のセンサーから毎秒温度データを収集・保存しています。各レコードは約800バイトで、1日に削除対象となるレコード数は6億件です。Cosmos DBのTTL(Time to Live)機能により、自動削除されるレコードが消費する計算リソースを削減したいと考えています。1日あたりの削除対象レコード総データ量(GB)を計算してください。

計算
235

あるオンラインゲーム企業がCosmos DB(Core SQL API)を使用してプレイヤープロファイルを管理しています。1日あたり250万人のアクティブプレイヤーが平均12回のデータ操作(読み取りと書き込みが混在)を実行します。各操作は平均2.5RU(Request Unit)を消費します。1日あたりの総RU消費量は何RUか計算してください。

計算
236

あるデータアナリティクス企業がAzure Blob Storageを使用して分析データを保存しています。1月に保存したデータは800GB、その後毎月前月の1.15倍のデータを追加します。ホットアクセス層は月額$0.0184/GB、クールアクセス層は月額$0.0092/GBです。3月末のデータについて、1月分をクール層に、2月分をホット層に、3月分もホット層に保存した場合、この3ヶ月分の保存コスト合計(USD)はいくらですか?

計算
237

あるSaaS企業がAzure Queue Storageを使用してメッセージキューを管理しています。1時間あたり180万件のメッセージが転送されます。各メッセージは平均3.2KBで、キューの保持期間は7日間です。キューに保存されている総データ量(GB)を計算してください。(1GB=1,073,741,824バイトとして計算)

計算
238

あるマーケティング企業がCosmos DB(Core SQL API)を使用してカスタマージャーニーデータを管理しています。読み取り操作は毎月2,400万回発生し、各読み取りは平均1RUを消費します。書き込み操作は毎月600万回で、各書き込みは平均3RUを消費します。1ヶ月間の総RU消費量を計算してください。

計算
239

あるストリーミングサービスがAzure Event Hubsを使用してユーザーアクティビティイベントを処理しています。毎秒200件のイベントが到着し、各イベントは約5KBです。Event Hubsは24時間のメッセージ保持期間を設定しています。必要なスループットユニット数(TU)と24時間の総保持ストレージ容量(GB)を計算してください。(1TUあたり毎秒1MBのスループット、1GB=1,000MBとして計算)

計算
222

Cosmos DB Core SQL APIとCosmos DB MongoDB APIの主な違いはどれか。

比較
223

Azure Blob StorageのHotアクセス層とColdアクセス層の違いで正しいのはどれか。

比較
224

Cosmos DBの「セッション整合性」と「強整合性」の主な違いはどれか。

比較
225

Azure Queue StorageとAzure Event Hubsの主な違いで正しいのはどれか。

比較
226

Azure Data Lake Storage Gen2(ADLS Gen2)とAzure Blob Storageの主な違いで正しいのはどれか。

比較
227

Cosmos DBのGremlin APIとSQL APIの主な違いで正しいのはどれか。

比較
240

あるリアルタイムチャットアプリケーションがCosmos DB(Core SQL API)を使用して、メッセージを管理しています。ユーザーが新しいメッセージを送信する際、「送信者ID」「受信者ID」「タイムスタンプ」をパーティションキーとして設定しました。このパーティション戦略のために、「特定の2人のユーザー間の過去30日間のメッセージを時系列で取得」というクエリ性能が低下しました。最も根本的な原因と改善案はどれか?

応用
241

あるグローバルECサイトがCosmos DBのマルチリージョン読み取り構成(プライマリリージョン:米国東部、セカンダリリージョン:ヨーロッパ西部・東アジア)を使用しています。ヨーロッパのユーザーが商品を注文した直後、その注文データを読み取ろうとしたとき、「データがまだ到着していない」というエラーが発生しました。原因として最も可能性の高いものはどれか?

応用
242

あるIoTシステムがAzure Blob Storageの階層型アクセスポリシーを設定しています。「直近30日間はHotアクセス層、31~90日はCoolアクセス層、91日以上はArchiveアクセス層」という自動移行を構成しました。運用開始から3ヶ月後、古いセンサーデータ(Archiveアクセス層に移行済み)を分析する必要が生じました。このデータにアクセスする際、想定される遅延と追加コストについて、最も正確な説明はどれか?

応用
243

あるSaaS企業がCosmos DBで顧客テナントのメタデータ(テナントID、契約情報、使用量統計)を管理しています。テナントごとに異なるデータ量があり、一部の大規模テナントのクエリが頻繁にホットパーティション化しています。企業が「パーティションキーを変更することなく」スケーラビリティを向上させたいと考えています。最適なアプローチはどれか?

応用
244

あるビジネスインテリジェンスチームがAzure Synapse Analytics(データウェアハウス)でAzure Data Lake Storage Gen2(ADLS Gen2)に保存されたパーケット形式のデータを分析しています。「日次バッチ処理で毎晩10TB のデータをロード」「クエリのスキャン効率が徐々に低下」という課題が発生しました。原因として最も可能性の高いものと改善案はどれか?

応用
245

あるリアルタイムゲームレーダーがAzure Event Hubsで毎秒50万件のプレイヤーアクティビティイベント(移動、射撃、被弾)を取り込んでいます。現在の整合性レベルがセッション一貫性に設定されており、「プレイヤーAが敵を射撃してから敵が被弾するまでの順序」を全プレイヤーが同じ順序で認識する必要があります。整合性レベルをより強い「前置き写真一貫性(Linearizability)」に変更する際、主な影響はどれか?

応用
228

以下のCosmos DBのAPIに関する記述のうち、誤っているものはどれか?

誤り発見
229

Azure Blob StorageとAzure Data Lake Storage Gen2(ADLS Gen2)に関する記述のうち、誤っているものはどれか?

誤り発見
230

Cosmos DBの「要求ユニット(RU:Request Unit)」に関する記述のうち、誤っているものはどれか?

誤り発見
231

Cosmos DBのアクセス層と保持に関する記述のうち、誤っているものはどれか?

誤り発見
232

Azure Queue StorageとAzure Event Hubsの特性に関する記述のうち、誤っているものはどれか?

誤り発見
233

Cosmos DBのマルチリージョン配置と整合性に関する記述のうち、誤っているものはどれか?

誤り発見

Azureデータ分析43

60

あるデータアナリストチームがADLS Gen2上のParquet形式ログデータ(総容量10TB)に対して月20回程度のアドホックSQLクエリを実行します(各クエリ5〜30分)。コスト最適化を最優先とした場合、最適なサービスはどれか?

定義
61

あるグローバル製造企業がデータ分析環境を構築します。「PythonとScalaでETLとMLモデルを開発するデータエンジニア」「R・Pythonで実験的モデリングをするデータサイエンティスト」「Notebookベースのコラボレーションを重視」「GitLab CIとの統合でML CI/CDを実現」「GPUでのディープラーニング訓練が必要」という要件があります。最適なサービスはどれか?

定義
62

ある金融企業が「オンプレミスOracleからの日次スナップショット抽出」→「日次集計・通貨換算・NULLクレンジング変換」→「Azure Synapse Analytics Dedicated SQL Poolへのロード」というパイプラインを構築します。Oracle抽出が成功した場合のみ変換・ロードを実行する依存関係も必要です。パイプラインのオーケストレーションに最適なサービスはどれか?

定義
63

ある物流会社が配送トラック1,000台のGPSデータをリアルタイムで処理し、「配送遅延を発生から30秒以内に検知してアラートを送信する」要件があります。最も適したAzureサービスはどれか?

定義
64

ある小売企業のCFOがAzure SQL Databaseの売上データを使ったダッシュボードを要求しています。「常に最新データを表示」「150名が同時Webアクセス」「営業担当者がIT承認なしで自分でグラフを作成・共有」「スマートフォンからもアクセス可能」という要件で、最適なPower BI構成はどれか?

定義
65

Power BIのImportモードとDirectQueryモードを比較したとき、「大規模データセット(1億行)に対してレポートの応答速度を最大化したい」場合に適切なのはどれか?

定義
66

ある企業が毎秒100万件のIoTイベントを複数のシステムから受信する必要があります。「同じイベントをAzure Stream AnalyticsとAzure Synapseの両方が消費」「イベントは7日間保持(再処理のため)」「各システムが独立したペースで読み取りたい」という要件に最適なサービスはどれか?

定義
67

Azure Synapse Analytics Dedicated SQL PoolとServerless SQL Poolの違いとして正しいのはどれか?

定義
68

Azure Data FactoryとAzure Synapse Analytics Pipelinesの関係について正しい説明はどれか?

定義
69

Power BI Desktop(ローカルツール)とPower BI Service(クラウドサービス)の違いについて正しいのはどれか?

定義
70

Azure Stream Analyticsのストリーム処理で「各センサーのイベントが到達しない「無活動期間」を自動的に検出してウィンドウを区切りたい」ユースケースに適したウィンドウ種別はどれか?

定義
71

Microsoft Purviewのデータカタログ機能で「データリネージュ(Data Lineage)」が追跡できる情報はどれか?

定義
72

Power BIでAzure Synapse Analytics Dedicated SQL Poolに接続する際、「毎時間データが更新されるため、レポートには常に1時間以内の最新データが必要。ただしSynapse側への過度なクエリ負荷は避けたい」という要件に最も適した接続モードはどれか?

定義
73

Azure Data FactoryのSelf-hosted Integration Runtime(SHIR)の主な役割はどれか?

定義
74

Azure Databricksが「Azure HDInsight(Spark)」より優れている点として最も正確なのはどれか?

定義
75

Azure Synapse Analytics Linkの主な機能はどれか?

定義
76

Power BIのライセンス体系で「100名のユーザーが会社全体のレポートダッシュボードを閲覧する(自分では作成しない)」という要件に最もコスト効率が高いライセンスはどれか?

定義
77

Azure Stream Analyticsで「過去1時間の平均値を5分ごとに更新する集計」を実現するT-SQLライクな構文のウィンドウはどれか?

定義
78

Azure Data FactoryのData Flow(データフロー)とPipeline(パイプライン)の違いとして正しいのはどれか?

定義
264

ある企業がAzure Synapse Analytics Dedicated SQL Poolで日次ETLパイプラインを実行しています。現在、毎日深夜2時から2時間かけてデータをロードしています。負荷テスト結果から、DW500(500 DWU)では完了に2時間かかりますが、DW1000(1000 DWU)では1時間で完了することが判明しました。ただし、営業時間中(午前9時~午後6時)は毎秒500クエリの分析クエリが実行されます。この状況で、DW500からDW1000にスケールアップした場合、最も可能性が高い影響はどれか?

応用
265

ある企業がAzure Data FactoryとAzure Stream Analyticsを組み合わせて使用しています。Data Factoryは毎日午前1時に過去24時間分のバッチデータをクラウドストレージにダンプします。一方、Stream Analyticsは同じストレージをソースとして、1時間ごとの集計結果を出力しています。今月から、Data Factoryのダンプジョブが午前3時に遅延するようになりました。この遅延が生じた場合、Stream Analyticsの出力にはどのような影響が起こるか?

応用
266

ある金融企業がPower BIで1,000万行の顧客トランザクションデータを使用したレポートを作成しています。現在、Importモード(ローカル圧縮キャッシュ)を使用しており、レポートファイルサイズは250MBです。同社が「レポートの応答時間を現在の2秒から0.3秒以下に短縮したい」という要件を提示しました。DirectQueryモードへの切り替えを検討していますが、このシナリオでDirectQueryを採用した場合の最も可能性が高い結果はどれか?

応用
267

ある製造企業がAzure Synapse Analytics Serverless SQL Poolを使用して、Azure Data Lake Storage (ADLS) Gen2に保存されたParquet形式データ(月300GB増加)をクエリしていました。SQL検索性能が低下したため、コンピュートを「Serverless」から「Dedicated SQL Pool (DW500)」に変更しました。この変更後、予想外の現象が発生する可能性が最も高いのはどれか?

応用
268

ある企業がAzure Data FactoryでADLS Gen2の日次バックアップパイプラインを実行しています。パイプラインは「Blob Source(ソース読み取り)→ Copy Activity(複製)→ADLS Sink(書き込み)」という構成です。ある日、Sourceブロブストレージの認証キーが定期更新される予定でしたが、Data Factoryのリンクサービス設定が旧キーのままでした。この状況で、パイプライン実行時に最も可能性が高い動作はどれか?

応用
269

ある小売企業がAzure Synapse Analytics Dedicated SQL Poolで月次売上分析レポートを実行しています。レポートはPower BIのImportモード(月1回の完全更新)で構成されています。来月、ソースデータベースのスキーマが変更され、「sales_amount」カラムが「net_amount」と「tax_amount」に分割されます。ETLプロセスはこの変更に対応していますが、Power BIレポートの定義は更新されていません。この状況で、月1回の定期更新実行時に最も可能性が高い事象はどれか?

応用
252

以下のAzure Synapse Analyticsに関する記述のうち、誤っているものはどれか?

誤り発見
253

以下のAzure Stream Analyticsに関する記述のうち、誤っているものはどれか?

誤り発見
254

以下のPower BIに関する記述のうち、誤っているものはどれか?

誤り発見
255

以下のAzure Data Factoryに関する記述のうち、誤っているものはどれか?

誤り発見
256

以下のMicrosoft Purviewに関する記述のうち、誤っているものはどれか?

誤り発見
257

以下のAzure Databricksに関する記述のうち、誤っているものはどれか?

誤り発見
258

ある医療機関が毎月2.5TBの患者診療レコードをAzure Blob Storageに保存しています。過去12ヶ月間のデータに対してPower BI Desktopで月1回の分析を実施予定です。このシナリオでデータを加工・集計するには、月次クエリが約15分で完了し、クエリ実行時のコンピュートリソース費用が月額$80の場合、年間コンピュート費用はいくらになりますか?

計算
259

あるe-コマース企業がAzure Stream Analyticsで毎秒500,000件のトランザクションイベントを処理しています。各イベントは平均2.4KBのデータサイズです。24時間連続運用した場合、処理されるイベント総数と消費データ容量はそれぞれいくらになりますか?

計算
260

ある分析チームがAzure Synapse Analytics Dedicated SQL Poolで、毎日3回のデータ更新処理を実施しています。各更新処理に平均12分間の計算リソース使用が発生し、月間営業日が22日の場合、月間の総リソース使用時間はいくらになりますか?

計算
261

ある企業がPower BI Premiumで200名のユーザーに対してダッシュボードを展開しています。Power BI Premium P1ライセンス(月額$5,000)で最大250名までサポート可能な場合、1ユーザーあたりの月額コストはいくらになりますか?

計算
262

ある企業がAzure Data FactoryでパイプラインAを1日に2回実行し、各実行に平均8分を要します。一方、パイプラインBを1日に5回実行し、各実行に平均3分を要します。30日間の月間運用で、両パイプラインの合計実行時間はいくらになりますか?

計算
263

ある製造企業がAzure Databricksで機械学習モデルを訓練しています。訓練に使用するデータセットは4.8TBで、1台のGPUクラスター(単価$2.40/時間)で平均18時間要します。同一の訓練を月に4回実施する場合、月間計算コストはいくらになりますか?

計算
246

Azure Synapse Analytics Dedicated SQL PoolとServerless SQL Poolの違いについて、最も正確な説明はどれか?

比較
247

Power BI DesktopのImportモードとDirectQueryモードの違いについて、最も正確なのはどれか?

比較
248

Azure Data FactoryのData Flow(マッピングデータフロー)とPipeline(パイプライン)の違いについて、最も適切な説明はどれか?

比較
249

Microsoft Purviewのデータカタログ機能とAzure SQL Database監査ログの違いについて、最も正確なのはどれか?

比較
250

Azure Event HubsとAzure Service Busの違いについて、最も適切な説明はどれか?

比較
251

Azure Data LakeStorage (ADLS) Gen2とAzure Blob Storageの違いについて、最も正確なのはどれか?

比較

実戦シナリオ44

79

あるグローバル旅行プラットフォームが以下4種類のデータを管理します。①ホテル在庫(日付×部屋タイプ×ホテルIDの空き状況、毎秒高頻度読み書き)②予約トランザクション(顧客・日程・金額・決済情報、ACID保証必須・複数テーブル)③ユーザー行動ログ(クリック・検索履歴JSON、書き込み特化・後で分析)④ホテル間の距離・経路(観光地とホテルの関係、最短経路・近隣検索)。最も適切なサービス組み合わせはどれか?

定義
80

ある製造企業が「①工場のPOSシステム(オンプレミス)からADLS Gen2へのデータ転送」→「②ADLS Gen2のデータを探索・アドホッククエリ」→「③ADLS Gen2のデータをSynapse Dedicated SQL Poolへロード」→「④Power BIでダッシュボード作成」という分析基盤を構築します。各フェーズに最適なサービスの組み合わせはどれか?

定義
81

あるヘルスケアスタートアップが患者データ管理システムをAzureに構築します。「患者基本情報(氏名・生年月日・住所)と診療記録の間に外部キー制約が必要」「MRI画像(500MBのDICOMファイル)を保存」「医療機器から毎秒数百件のセンサー値をリアルタイムで複数システムが消費」という3要件があります。正しい組み合わせはどれか?

定義
82

あるソーシャルゲーム企業が以下のシステムを設計しています。「①ゲームサーバーからのプレイログ(毎秒500万イベント)をリアルタイム処理して不正行動を検知」「②検知された不正をゲームオペレーターにリアルタイムで通知」「③全プレイログを長期保存して月次の傾向分析を実施」。最も適切なアーキテクチャはどれか?

定義
83

あるECサイトが「商品ページの閲覧履歴・カートに入れた商品・購入履歴を組み合わせて、各ユーザーにパーソナライズされた商品レコメンデーションを表示する」機能を開発します。データ量は1億ユーザー×数千商品、リコメンド応答は100ms以内が要件です。最適なデータストアはどれか?

定義
84

ある銀行がAzure SQL Databaseで取引データを管理し、「監査のために過去7年間の全取引を保持する必要がある(コンプライアンス要件)」「日常の取引クエリは直近3ヶ月のデータのみ参照」「7年分のデータをすべてHotティアで保持するとコストが高すぎる」という課題があります。最適な解決策はどれか?

定義
85

あるグローバルECサイトがデータパイプラインを設計します。「毎日深夜にオンプレミスのSAP ERPシステムから売上データをAzureに転送(バッチ)」「ADLS Gen2に蓄積されたデータをAzure Databricksで機械学習用に前処理」「学習済みモデルをAzure Machine Learningに登録・デプロイ」という3段階のパイプラインのオーケストレーションに最適なサービスはどれか?

定義
86

ある多国籍企業が「各国のデータアナリストが自国の販売データのみ参照できる」というセキュリティ要件を持つPower BIレポートを構築しています。アナリストは自分でフィルタを変更できないよう、DB側またはPower BI側でデータアクセスを制限したいです。Power BI Serviceで実現するための機能はどれか?

定義
87

あるLogistics企業が「オンプレミスのデータベース(SQL Server)のテーブル変更をほぼリアルタイムでAzure Event Hubsに送信し、Azure Stream Analyticsで処理したい」という要件があります。SQL Serverの変更データをリアルタイムでEvent Hubsに送信するための最適なアプローチはどれか?

定義
88

あるヘルスケア企業がAzure上にデータガバナンス基盤を構築します。「①全データ資産(SQL DB・Cosmos DB・ADLS Gen2・Power BI)の一元的なカタログ化」「②個人情報・機密データの自動分類と感度ラベリング」「③データの流れ(どのデータがどのレポートに使われているか)の可視化」が要件です。最適なサービスはどれか?

定義
89

ある企業のデータエンジニアが「Azure Synapse Analytics Serverless SQL PoolでADLS Gen2上のParquetファイルをクエリしたい」と述べています。以下のSQL文のうち正しい使い方はどれか?

定義
90

ある企業がCosmosDB(Core SQL API)とAzure Synapse Link(Azure Synapse Analytics for Cosmos DB)を組み合わせています。この組み合わせの主な利点はどれか?

定義
91

あるメディア企業が「毎月の動画視聴レポートを作成するデータアナリスト10名」と「全社の週次KPIダッシュボードを閲覧する1,000名の従業員」のためにPower BI環境を構築しています。最もコスト効率の高いライセンス構成はどれか?

定義
92

あるスタートアップが「ユーザーがアプリ内でアクションを行うたびにイベントを送信し、そのイベントを複数のマイクロサービス(分析・通知・ログ記録)が非同期で消費する。各マイクロサービスは独立したペースで処理し、あるサービスが停止しても他のサービスの処理に影響しない」アーキテクチャを設計しています。最適なメッセージングサービスはどれか?

定義
93

ある企業がオンプレミスのSQL Serverから「スキーマ変換・データ型のマッピング・大量データの移行実行・移行中の本番系への影響最小化(オンライン移行)」を要件として、Azure SQL Managed Instanceへ移行します。移行を一貫してサポートするAzureの推奨ツールはどれか?

定義
94

ある物流会社が全データ分析基盤を刷新します。現状は「250個のオンプレミスSQL ServerDB」から毎週末にデータをAzureに転送しています。「転送をリアルタイムCDCに変更したい」「Azureでデータを処理・変換してレポートを作成したい」「250個のDBを統合して全社KPIを分析したい」という要件があります。最適なアーキテクチャの組み合わせはどれか?

定義
95

あるB2Bプラットフォームが「各クライアント企業が自社のデータのみ見えるようなマルチテナントSaaSダッシュボード」をPower BIで構築しています。「クライアントは自社のKPIダッシュボードをブラウザで閲覧(自分では作成しない)」「100社×平均10名=1,000名の閲覧ユーザー」という要件で、最もセキュアかつコスト効率の高い構成はどれか?

定義
96

あるデータエンジニアが「Azure Synapse Analytics Dedicated SQL PoolにオンプレミスのSQL Serverデータをロードしたい」と考えています。「毎日夜間に差分データのみを転送」「転送中の変換(文字コード変換・NULL置換)も実施」「スケジュール管理と依存関係制御が必要」という要件があります。推奨されるアプローチはどれか?

定義
97

ある小売チェーンのデータチームがCosmosDB(Core SQL API)で店舗の商品レビューデータを管理しています。各レビューには「store_id(店舗ID)」「product_id(商品ID)」「rating(評価)」「review_text(テキスト)」「timestamp(日時)」が含まれます。「特定店舗の商品レビューを効率的に取得する」クエリが多い場合、最適なパーティションキーはどれか?

定義
98

ある金融機関がAzureデータ基盤の設計レビューを行っています。以下の設計の中で「DP-900の観点で最も問題がある」ものはどれか?

定義
288

あるIoT企業が工場の機械から毎秒10,000個のセンサーデータ(温度・圧力・振動)を収集しています。以下の要件があります:①異常値を検出したら3秒以内にアラートを出す、②全データを長期保存・履歴分析する、③複数の分析システムが同時にこのデータを消費する。このシナリオでAzure Event Hubsをデータ入口とした場合、ダウンストリームに接続すべきサービスの組み合わせはどれか?

応用
289

ある企業がオンプレミスのSQL Server(容量8TB、日次バッチ処理で深夜3時間メンテナンス窓)からAzure SQL Database(本番環境)へ移行を計画しています。オンライン移行(本番稼働中の移行)をData Migration Service(DMS)で実施した場合、以下のうち最も懸念すべき影響はどれか?

応用
290

あるメディア企業がADLS Gen2でユーザー行動ログ(毎日500GB増加)を5年間保持しています。同社がホットティア(SSD)からクールティア(低コスト)への自動段階化ポリシーを「作成後30日でクール、作成後90日でアーカイブ」と設定した場合、最初の1年間のストレージコストはどう変わるか?

応用
291

あるヘルスケア企業が「患者データを格納したAzure SQL Database」と「分析用Power BIレポート」を持っています。新入社員AさんをBIアナリストとして雇用し、「患者データベースに対してSELECT権限のみを付与」「Power BIで該当レポートのビューア権限を付与」した場合、Aさんが実行できない操作はどれか?

応用
292

あるeコマース企業が毎日2,000万件の注文トランザクションをAzure SQL Databaseの単一データベース(Standard S2)で処理しています。このシナリオで同社が以下の対応を検討している場合、最も効果的な解決策はどれか?

応用
293

あるSaaS企業がAzure Synapse Analytics Dedicated SQL Pool(DW200c)で顧客データをホストしています。最近のクエリ性能分析で「ピーク時間帯(9時~10時)に複数の分析クエリが並行実行され、キュー待機が30秒を超える」ことが判明しました。この企業が以下の対応を検討している場合、最もコスト効率と性能バランスの良い判断はどれか?

応用
282

あるオンライン小売企業が、毎日50万件の顧客トランザクションをAzure SQL Databaseに記録しています。各トランザクションレコードは平均2KBです。現在、直近90日間のデータ(活動的に参照される「ホットデータ」)をPremium層で管理していますが、過去1年のデータ(年末税務監査用に保持が必須だが参照頻度は低い「コールドデータ」)を同じティアで管理するため、月間コストが過度に増加しています。以下のデータ量を計算し、最も効率的なストレージ戦略を選択してください。 【与えられた条件】 ・毎日のトランザクション:50万件 ・1レコードあたりのサイズ:2KB ・ホットデータ保持期間:90日 ・コールドデータ保持期間:270日(合計1年) ・Premium層のコスト:1GBあたり月額$0.12 ・Archive層のコスト:1GBあたり月額$0.01 【計算問題】 ホットデータ(90日分)の総容量はおよそ何GBか。また、コールドデータ(270日分)をArchive層に移動した場合、月間コスト削減額はおよそ何ドルか?

計算
283

ある医療機関がPHI(Protected Health Information:保護対象医療情報)を含むAzure Blob Storage Standard層で管理しています。現在、月間で300TBの医療画像ファイル(DICOM形式)が生成され、以下のアクセスパターンがあります。 【アクセスパターン】 ・生成直後1ヶ月間:医師が毎日参照(ホット層) ・1~6ヶ月目:週1回程度の参照(クール層への移行対象) ・6~24ヶ月目:月1回以下の参照(アーカイブ層への移行対象) ・24ヶ月以降:準拠性のため保持するが参照なし(アーカイブ層または削除) 【ストレージ価格】 ホット層:1GB月額$0.0184 クール層:1GB月額$0.0092 アーカイブ層:1GB月額$0.0004 月間300TBの医療画像データについて、以下を計算してください。 (1)クール層に保存される6ヶ月分のデータ(150~180日目時点)のコスト (2)アーカイブ層に保存される12ヶ月分のデータ(6~24ヶ月目)の月間コスト

計算
284

ある金融機関がAzure Event Hubs Standardで市場データをリアルタイム処理しています。以下の条件で、必要なスループットユニット(TU)数を計算してください。 【データ入力】 ・1秒あたりのイベント数:80,000件 ・1イベントあたりのペイロードサイズ:1.5KB ・ピーク時の増加率:平時の150% 【スループットユニットの仕様】 ・1TUあたりの受信スループット:1MBps(秒単位) ・1TUあたりの送信スループット:2MBps(秒単位) 平時および**ピーク時**に必要なスループットユニット数を計算し、正確な答えを選択してください。

計算
285

あるEコマース企業がAzure Cognitive Search(検索インデックス)を使用しており、商品データの検索を最適化しています。現在以下のデータボリュームを管理しています。 【現在のデータ量】 ・インデックス化された商品数:200万件 ・1商品あたりの平均メタデータサイズ:8KB(商品名・説明・価格・レビュー等) ・検索インデックスの圧縮率:約40%(実際のストレージは元データの40%) ・月間検索クエリ数:600万クエリ ・現在使用しているティア:Standard S1(1TU) 【Azure Cognitive Searchのティア仕様】 - Standard S1:1TUあたり記憶域25GB、クエリ単価$0.30/1,000クエリ - Standard S2:1TUあたり記憶域100GB、クエリ単価$0.30/1,000クエリ - Standard S3:1TUあたり記憶域200GB、クエリ単価$0.60/1,000クエリ 以下を計算してください。 (1)200万件の商品データをインデックス化したときのストレージ必要量 (2)月間600万クエリ時のクエリコスト (3)現在のS1 1TUで足りるか、どのティアが必要か

計算
286

あるSaaS企業がAzure Cosmos DB(Core SQL API)でマルチテナント顧客データを管理しています。現在の運用状況は以下の通りです。 【テナント数と利用状況】 ・テナント数:500社 ・各テナントの平均ドキュメント数:50,000件 ・1ドキュメントあたりの平均サイズ:2KB ・1日あたりの平均読み取り操作:1,000万回 ・1日あたりの平均書き込み操作:200万回 ・読み取り操作1件あたりのRU消費量:1RU ・書き込み操作1件あたりのRU消費量:5RU 【Cosmos DBの価格体系】 ・プロビジョニングスループット:RU/秒あたり月額$1.44(Standard) ・ストレージ:1GBあたり月額$0.25 以下を計算してください。 (1)全テナント合計のドキュメント総数とストレージ必要量 (2)1日あたりの総RU消費量 (3)1日あたりのRU/秒を計算し、月間のプロビジョニングコスト

計算
287

ある企業がAzure Data Factoryを使用して日次のデータパイプラインを運用しています。以下のパイプライン構成で、月間のコストを計算してください。 【パイプライン実行内容】 ・毎日の実行回数:8回(1日3時間ごと) ・1実行あたりのアクティビティ数:15個(Copy活動12個、SQLクエリ実行3個) ・Copy活動1つあたりの平均処理量:500MB ・各Copy活動の実行時間:平均5分 ・月間営業日:22日 【Azure Data Factoryの価格体系】 ・パイプライン実行:1回あたり$1.00 ・アクティビティ実行:1回あたり$0.50 ・Data Movement(データ移動):1GB/時間あたり$0.25 ・Pipeline Orchestration Compute:含まれる(無料) 以下を計算してください。 (1)月間のパイプライン実行回数とコスト (2)月間のアクティビティ実行回数とコスト (3)月間のData Movement処理量とコスト (4)合計月間コスト

計算
276

あるeコマース企業がAzureを使用してデータ分析基盤を構築しています。以下の記述のうち、誤っているものはどれか?

誤り発見
277

あるグローバル製造企業がAzureデータ分析基盤を導入しています。以下の説明のうち、誤っているものはどれか?

誤り発見
278

あるメディア企業がAzure Synapse Analyticsを使用してコンテンツ視聴分析を実施しています。以下の記述のうち、誤っているものはどれか?

誤り発見
279

あるファイナンステック企業がAzure上でリアルタイム決済分析システムを構築しています。以下の説明のうち、誤っているものはどれか?

誤り発見
280

あるSaaS企業がマルチテナント分析プラットフォームをAzureで運営しています。以下の記述のうち、誤っているものはどれか?

誤り発見
281

あるロジスティクス企業がAzure Cosmos DBを選択してリアルタイム配送追跡システムを構築しています。以下の説明のうち、誤っているものはどれか?

誤り発見
270

あるeコマース企業が顧客データの管理方法を検討しています。Azure SQL DatabaseとAzure Cosmos DBの使い分けについて、最も適切な説明はどれか?

比較
271

ある製造業企業が、オンプレミスのSAP ERPシステムからAzureへの大規模データ転送(初期転送:50TB)を検討しています。Azure Data Factory と Azure Synapse Pipelines の違いについて、最も正確な説明はどれか?

比較
272

ある金融機関がリアルタイムデータ処理システムを構築します。Azure Stream Analytics と Azure Event Hubs の役割分担について、最も正確な説明はどれか?

比較
273

あるデータサイエンスチームがPower BI Desktop と Power BI Service の使い分けについて議論しています。最も正確な説明はどれか?

比較
274

ある企業がADLS Gen2(Azure Data Lake Storage Gen2)と Azure Blob Storage の使い分けについて検討しています。大規模分析基盤構築での違いについて、最も適切な説明はどれか?

比較
275

あるグローバル企業がAzure Synapse Analytics の Dedicated SQL Pool と Serverless SQL Pool の使い分けについて検討しています。最も正確な説明はどれか?

比較

Azureサービス深掘り43

119

Cosmos DBではなくAzure SQL Databaseを選ぶべきシナリオはどれか?

定義
120

Cosmos DBでコンテナのパーティションキーとして「category(値:電子機器・衣類・食品の3種類のみ)」を選んだ場合の問題点はどれか?

定義
121

Azure Event Hubs・Azure Service Bus・Azure Event Gridを比較したとき、「毎秒100万件のIoTイベントを複数のシステムが独立したオフセットで消費する」要件に最適なのはどれか?

定義
122

Azure Synapse Analytics Dedicated SQL Poolのデータ分散戦略で「小さなテーブル(ディメンションテーブル)を全ノードにコピーして大きなテーブルとのJOINを高速化する」分散方式はどれか?

定義
123

Azure Data Factoryの「スケジュールトリガー」と「タンブリングウィンドウトリガー」の違いとして正しいのはどれか?

定義
124

Azure Data FactoryのCopy ActivityとMapping Data Flowの使い分けとして正しいのはどれか?

定義
125

Power BIの「データフロー(Dataflow)」と「データセット(Dataset)」の違いとして正しいのはどれか?

定義
126

Power BIの「レポート(Report)」と「ダッシュボード(Dashboard)」の違いとして正しいのはどれか?

定義
127

Power BIのオンプレミスデータゲートウェイ(On-premises Data Gateway)の主な役割はどれか?

定義
128

Azure SQL DatabaseのDTUモデル(Database Transaction Unit)とvCoreモデルの違いとして正しいのはどれか?

定義
129

Azure Synapse Analytics Dedicated SQL Poolへのデータロードで「COPY INTO」を使用する主な理由はどれか?

定義
130

Azure Databricks の「Delta Lake」の主な特徴はどれか?

定義
131

Azure Event Hubsの「パーティション(Partition)」と「コンシューマーグループ(Consumer Group)」の関係について正しいのはどれか?

定義
132

Azure Stream Analyticsで「遅延到着イベント(Late Arrival Events)」の設定をする主な理由はどれか?

定義
133

Microsoft Purviewの「感度ラベル(Sensitivity Labels)」の主な目的はどれか?

定義
134

Azure Synapse Analytics の「Spark Pool」と「SQL Pool」の使い分けとして正しいのはどれか?

定義
135

Azure SQL DatabaseのServerless(サーバーレスコンピュート)ティアの「自動一時停止(Auto-pause)」機能について正しいのはどれか?

定義
136

Power BIの「行レベルセキュリティ(RLS)」をPower BI Serviceで設定する場合の正しい説明はどれか?

定義
137

Cosmos DBの「分析ストア(Analytical Store)」を有効にした場合の主な利点はどれか?

定義
312

Azure SQL DatabaseでDTUモデルを使用していたアプリケーションが急激に成長し、ピーク時にDTUの上限に達することが頻繁になりました。このとき、vCoreモデルに移行すると、どのような利点が得られますか?

応用
313

Azure Event Hubsで毎秒5万件のデータを3つのパーティションに分散して受け取っていたシステムで、急激に毎秒15万件の受信が発生したとき、パーティション数を6に増やしたとしても、既存のコンシューマーグループのオフセット読み込みに問題が生じる可能性があります。その理由はどれですか?

応用
314

Azure Data FactoryでMapping Data Flowを使用してETL処理を実装していたパイプラインが、データ量が1日あたり100GBに達したため処理完了時間が24時間を超えるようになりました。パフォーマンス改善を目的にAzure IntegrationRuntimeのコンピュートタイプを「一般用(General Purpose)」から「メモリ最適化(Memory Optimized)」に変更しました。このとき、どのような効果が期待できますか?

応用
315

Cosmos DBで強い一貫性(Strong Consistency)を構成して3リージョンでレプリケーションしていたシステムで、プライマリリージョンへの一時的なネットワーク障害が発生しました。このシナリオにおいて、クライアントアプリケーションのWrite操作に対してどのような動作が起きますか?

応用
316

Azure Stream Analyticsで「Late Arrival」の最大許容遅延を30分に設定してイベント処理を実行していたとき、ソースデータから5時間遅れで到着したイベントが流入しました。このイベントに対してStream Analyticsはどのような動作をしますか?

応用
317

Power BIで行レベルセキュリティ(RLS)を実装し、営業部員AはRegion=「東日本」、営業部員BはRegion=「西日本」のみ表示可能に設定していました。このときDAX式で定義されたRLSルールが「ユーザー名」ではなく「Azure ADグループメンバーシップ」に基づいて評価された場合、どのような問題が発生する可能性が最も高いですか?

応用
300

以下のAzure Data Factory に関する記述で、誤っているものはどれか?

誤り発見
301

以下のAzure Cosmos DB に関する記述で、誤っているものはどれか?

誤り発見
302

以下の Azure Stream Analytics に関する記述で、誤っているものはどれか?

誤り発見
303

以下の Azure Synapse Analytics に関する記述で、誤っているものはどれか?

誤り発見
304

以下の Power BI に関する記述で、誤っているものはどれか?

誤り発見
305

以下の Azure SQL Database に関する記述で、誤っているものはどれか?

誤り発見
306

Azure SQL Databaseで、以下の条件でデータベースを運用する場合、推定月額コストを最も安く抑えるため、どのモデルを選択すべきですか? ・ピーク時の同時接続数:150接続 ・1日あたりのトランザクション数:500万件 ・ピーク時のCPU利用率:70% ・平均ストレージ使用量:250GB ・非ピーク時間帯(12時間)はほぼデータベースを使用しない

計算
307

Azure Cosmos DBで以下のワークロードを運用する場合、推奨される価格モデルはどれですか? ・読み取り操作:毎秒12万件 ・書き込み操作:毎秒3万件 ・1件あたりの平均ドキュメントサイズ:2KB ・データの予測増減:明らかな季節変動あり(最大4倍の差) ・RU消費量:読み取り1件=1RU、書き込み1件=5RU

計算
308

Azure Synapse Analytics Dedicated SQL Poolで、以下のデータウェアハウスを構築する場合、最適なノード構成はどれですか? ・ファクトテーブル:150GB(日次でフル更新、複数の大規模JOIN対象) ・ディメンションテーブル:計10GB(変わらない) ・ピーク時の同時クエリ数:25クエリ ・クエリの平均実行時間:現在60秒、30秒以下に短縮したい ・現在のノード数:DW1000c(10ノード)

計算
309

Azure Event Hubsで以下のIoTシステムを構築する場合、必要なパーティション数の最小値はいくつですか? ・IoTデバイス数:500台 ・1デバイスあたりの送信頻度:1メッセージ/秒 ・1メッセージのサイズ:800バイト ・Event Hubsのスループットユニット(TU):2 TU(1 TUあたり1MB/秒の受信、100パーティション対応) ・パーティションキー:デバイスID(均等分散)

計算
310

Azure Data Factoryで以下のデータパイプラインを月間運用する場合、推定実行コストを最も削減できるトリガー設定はどれですか? ・毎日午前3時にオンプレミスDBから300GBのデータを取得 ・取得後、Synapse Analytics Dedicated SQL Poolへロード ・パイプライン実行時間:約30分 ・1実行あたりの統合ランタイム(IR)料金:約5ドル ・月間実行回数:30回

計算
311

Power BIで以下のレポートを配布する場合、推奨されるアーキテクチャはどれですか? ・ユーザー数:3,000名 ・データ更新頻度:1日1回(夜間) ・行レベルセキュリティ(RLS):部門別に異なるデータを表示(50部門) ・キャッシング要件:高速表示が必須 ・レポートサイズ:150MB/ファイル ・同時アクセス数ピーク:300名

計算
294

Azure Blob StorageとAzure Data Lake Storage Gen2の違いとして正しいのはどれか?

比較
295

Azure SQL Managed InstanceとAzure SQL Databaseの主な違いとして正しいのはどれか?

比較
296

Azure Synapse Analytics Dedicated SQL PoolとAzure Databricksの分析処理の特徴として、最も正確な違いはどれか?

比較
297

Azure Data FactoryのLookup ActivityとFilter Activityの使い分けについて、最も正確な説明はどれか?

比較
298

Azure Cosmos DBの「トランザクショナルストア」と「分析ストア」の主な違いとして正しいのはどれか?

比較
299

Azure Stream AnalyticsのReference DataとSideInputの関係について正しい説明はどれか?

比較

難問・アンチパターン43

138

Cosmos DBについて「誤っている」記述はどれか?

定義
139

以下のAzureアーキテクチャ設計のうち「最も深刻な問題がある」のはどれか?

定義
140

データエンジニアが「Azure Synapse Analytics Serverless SQL Poolを使えば、毎秒1万件のAPIリクエストをリアルタイムで処理してOLTPデータベースとして使える」と主張しています。この主張の問題点はどれか?

定義
141

開発者が「Power BIのImportモードを使えば、Azure SQL Databaseのデータが常にリアルタイムで更新されてダッシュボードに反映される」と言っています。正しい反論はどれか?

定義
142

あるシステムで「Azure Table StorageのPartitionKeyにデバイスの設置日(2024-01-15形式)を使う」設計を採用しました。この設計の問題点はどれか?

定義
143

「Azure Data Factoryのコスト最適化のため、すべてのETLパイプラインをAzure IR(Integration Runtime)ではなくSelf-hosted IR(SHIR)で実行する」という提案の問題点はどれか?

定義
144

「コスト削減のためにAzure Synapse Analytics Dedicated SQL Poolを夜間(22時〜6時)に一時停止(Pause)する」設計の注意点として正しいのはどれか?

定義
145

Cosmos DBで「Gremlin API(グラフ)を使えばすべてのデータ問題を解決できるため、リレーショナルDBへの移行は不要」という主張の問題点はどれか?

定義
146

「Azure Data Lake Storage Gen2の階層名前空間(Hierarchical Namespace)を有効にすると、既存のBlob Storageアプリケーションが完全に使えなくなる」という懸念について正しいのはどれか?

定義
147

ある企業が「DRの要件(RTO: 1時間以内)を満たすためにAzure SQL Databaseのポイントインタイムリストア(PITR)だけを使う」設計を採用しました。問題点はどれか?

定義
148

「Power BIのDirectQueryモードを使えば、大規模データセット(10億行)のレポートでも常に高速に表示できる」という主張の問題点はどれか?

定義
149

データエンジニアが「Azure Event Hubsはメッセージキューとして使えるため、Azure Service Busを使わずすべてのメッセージング要件をEvent Hubsに集約する」と提案しています。この提案の問題点はどれか?

定義
150

Azure SQLの機能について「誤った説明」はどれか?

定義
151

Azure Cosmos DBのコンテナ設計で「ホットパーティション」を防ぐための正しいアプローチはどれか?

定義
152

Azure Synapse Analytics Dedicated SQL Poolの「HASH分散」テーブルで最もパフォーマンスが向上するシナリオはどれか?

定義
153

「Azure Data Factoryは完全サーバーレスなのでパイプラインが何百万件実行されてもコストは常に一定」という説明の誤りはどれか?

定義
154

「Microsoft Purviewを導入すればデータのセキュリティ問題は完全に解決する」という主張の誤りはどれか?

定義
155

複数のAzureデータサービスの特性について「正しい組み合わせ」はどれか?

定義
156

以下のいずれかの「DP-900試験の出題範囲から外れている」トピックはどれか?

定義
330

Azure Cosmos DBで、1秒間に1,600件のドキュメント書き込みが発生するアプリケーションがあります。各ドキュメントは2KBです。(1書き込み操作=1KBあたり5RU)最低限プロビジョニングすべきRU/秒はいくらですか?

計算
331

Azure SQL Databaseで、データベースの合計サイズが1,050GBあります。自動バックアップ保有期間は7日間で、バックアップストレージのコストは1GBあたり0.10ドル/月です。月間のバックアップストレージコストはおよそいくらですか?(バックアップサイズはデータベースサイズと同等と仮定)

計算
332

Azure Synapse Analytics Dedicated SQL Poolで、1分間に60件のクエリ実行が発生するワークロードがあります。各クエリが平均10秒かかります。ワークロード管理(WLM)で最大並行実行数が5に制限されている場合、理論上の平均待機時間はおよそいくらですか?

計算
333

Azure Data Lake Storage Gen2で、今月新たに750GBのデータをHot層に書き込みました。このデータは30日後にCool層へ、90日後にArchive層へ自動移動します。このデータの「今月1ヶ月間」のストレージコストはいくらですか?(Hot:0.04ドル/GB/月、Cool:0.02ドル/GB/月、Archive:0.01ドル/GB/月)

計算
334

Azure Event Hubsで、1秒間に5,000件のイベント(各1KB)が送信されます。保持期間を24時間とした場合、必要なスループットユニット(TU)の数はいくつですか?(1TU=1MB/秒の入力容量)

計算
335

Power BIで、DirectQueryモードを使用するレポートが、5,000万行のAzure SQL Databaseテーブルを参照しています。1クエリの平均実行時間が8秒です。1時間に1,200回クエリが実行される場合、1時間のデータベースへのクエリ処理コストはおよそいくらですか?(1コンピュート時間当たり0.15ドル、1秒=1/3,600コンピュート時間)

計算
336

あるデータ分析チームが、Azure Data Lake Storage Gen2に毎日200GBのデータを保存し、Azure Synapse Analytics Serverless SQL Poolで分析しています。ある月、ストレージアカウントの読み取りスループットが突然低下し、クエリが遅くなりました。以下のうち、最も可能性の高い根本原因と対策の組み合わせはどれか?

応用
337

企業がAzure Cosmos DBで地理的に分散したイベントデータを保存し、複数リージョンでレプリケーション設定を行いました。その後、プライマリリージョンで一時的な障害が発生し、フェイルオーバーが自動実行されました。この状況下で、アプリケーションが次に直面する最も深刻な問題はどれか?

応用
338

あるビジネスインテリジェンスチームが、Power BIで10万行のCSVファイルからリアルタイムレポートを作成するため、DirectQueryモードを選択し、Azure SQL Databaseに接続しました。その後、複数のユーザーが同時にダッシュボードにアクセスしたとき、何が起きたか?

応用
339

ある企業がAzure Table Storageに大量のセンサーデータを保存し、PartitionKeyに「デバイスID+YYYYMMDD」(例:DEVICE001_20240315)、RowKeyに「タイムスタンプ」を使用しています。データ量の増加に伴い、特定日付のデバイスデータ取得が遅くなりました。問題と対策として正しいのはどれか?

応用
340

データエンジニアが「ディザスタリカバリのRTO(目標復旧時間)が2時間以内の要件を満たすため、Azure SQL DatabaseのポイントインタイムリストアPITR)だけを使う戦略」を提案しました。この戦略の最大の問題点はどれか?

応用
341

組織がAzure Synapse Analytics Dedicated SQL Poolを夜間(22時〜翌6時)に自動停止し、コスト削減を実施しています。月曜日の午前6時に停止中のプールが再開され、営業チームが朝8時にダッシュボードにアクセスしようとしました。以下のうち、起きうる最も深刻な問題はどれか?

応用
318

Azure SQL DatabaseのActive Geo-Replicationとオートフェイルオーバーグループ(Failover Groups)の違いとして、最も正確なものはどれか?

比較
319

Azure Data Lake Storage Gen2のHierarchical Namespace(階層名前空間)を有効にした場合と無効な場合の主要な違いはどれか?

比較
320

Azure Synapse AnalyticsのServerless SQL PoolとDedicated SQL Poolの差異として、最も正確なものはどれか?

比較
321

Azure Cosmos DBのプロビジョニング方式における「専有スループット(Dedicated Throughput)」と「共有スループット(Shared Throughput)」の最も重要な違いはどれか?

比較
322

Power BIの「Import(インポート)モード」と「DirectQuery(ダイレクトクエリ)モード」の差異として、正確なものはどれか?

比較
323

Azure Event HubsとAzure Service Busのメッセージング用途での根本的な違いとして、最も重要なものはどれか?

比較
324

Azure Data Lakeを使用したデータアーキテクチャの説明について、誤っているものはどれか?

誤り発見
325

Azure SQL DatabaseとAzure Synapse Analytics Dedicated SQL Poolの特性比較について、誤っているものはどれか?

誤り発見
326

Azure Cosmos DBのパーティショニングとスケーリングについて、誤っているものはどれか?

誤り発見
327

Azure Event HubsとAzure Service Busのメッセージング機能について、誤っているものはどれか?

誤り発見
328

Power BIのデータ取得モードについて、誤っているものはどれか?

誤り発見
329

Microsoft Purviewデータ管理について、誤っているものはどれか?

誤り発見

Power BIビジュアル33

157

ある小売企業が過去12ヶ月の月別売上高の「推移・トレンド」をPower BIダッシュボードで可視化したい。最も適切なビジュアルはどれか?

定義
158

5つの販売地域(北海道・東北・関東・関西・九州)ごとの売上高を比較し、どの地域が最も高いかを示したい。最も適切なビジュアルはどれか?

定義
159

マーケティングチームが「広告費の支出」と「売上の増加」の間に相関関係があるかどうかを視覚的に確認したい。最も適切なビジュアルはどれか?

定義
160

CFOが今四半期の「売上合計:12億3,456万円」という単一のKPI指標を、ダッシュボードの目立つ場所に大きく表示したい。最も適切なビジュアルはどれか?

定義
161

ECサイトのマーケティングマネージャーが「サイト訪問→商品閲覧→カートに入れる→購入完了」の各ステージでの離脱率(コンバージョン率)を可視化したい。最も適切なビジュアルはどれか?

定義
162

財務アナリストが「売上高→売上原価(マイナス)→粗利益→販管費(マイナス)→営業利益」という財務の積み上げ構造を可視化したい。最も適切なビジュアルはどれか?

定義
163

「6つの商品カテゴリが全体売上に占める割合(構成比)」を見せたい場合の円グラフ使用における注意点として正しいのはどれか?

定義
164

地方自治体のデータ分析チームが都道府県別の人口を日本地図上で視覚化したい。最も適切なビジュアルはどれか?

定義
165

大量の注文データ(注文ID・顧客名・商品名・金額・日付)を「詳細な一覧として行と列で表示し、小計や集計も見せたい」場合に最も適切なビジュアルはどれか?

定義
342

Power BIで「折れ線グラフ」と「面グラフ」の最大の違いは何か?

比較
343

「積み上げ棒グラフ」と「100% 積み上げ棒グラフ」の使い分けで正しいのはどれか?

比較
344

「散布図(バブルチャート)」と「クラスター化棒グラフ」の違いとして正しいのはどれか?

比較
345

Power BIで「テーブル」と「マトリックス」の最大の機能的違いは何か?

比較
346

「ゲージチャート」と「KPIカード」の使い分けで最も適切なのはどれか?

比較
347

「円グラフ」と「ドーナツグラフ」の実務上の使い分けで正しいのはどれか?

比較
354

ある製造企業が月別の生産数量データを収集しました:1月45,000単位、2月52,000単位、3月48,000単位、4月61,000単位、5月58,000単位、6月64,000単位。この6ヶ月間の平均生産数量を計算し、Power BIの「カード」ビジュアルで表示したい場合、表示すべき値はいくつですか?

計算
355

ECプラットフォームの4四半期の売上データは以下の通りです:Q1:2,800万円、Q2:3,200万円、Q3:2,900万円、Q4:4,100万円。年間の総売上から見たQ3の売上構成比(百分率)をPower BIの「円グラフ」で表示する場合、最も近い値はどれですか?

計算
356

5つの営業支店の月間成績は以下の通りです:東京支店:9,500万円、大阪支店:7,200万円、名古屋支店:6,800万円、福岡支店:5,100万円、札幌支店:4,400万円。最高売上(東京支店)と最低売上(札幌支店)の差分をPower BIの「KPIビジュアル」で表示する場合、その値はいくつになりますか?

計算
357

オンラインストアの顧客行動分析で、以下のコンバージョン漏斗データが得られました:サイト訪問:125,000人、商品閲覧:89,000人、カートに追加:34,000人、購入完了:8,500人。購入完了のステージの達成率(サイト訪問からの最終的なコンバージョン率)をPower BIの「漏斗グラフ」で表示する場合、最も近い値はどれですか?

計算
358

小売チェーンの3ヶ月間の営業実績データは以下の通りです:7月:前月比115%、8月:前月比108%、9月:前月比120%。6月の売上を1,000万円とした場合、9月の売上はいくらになりますか?Power BIの「カード」で表示する際の値は?

計算
359

サービス企業が顧客満足度調査を実施し、5段階評価で以下の結果を得ました:5つ星:150人、4つ星:112人、3つ星:120人、2つ星:80人、1つ星:38人。「4つ星以上」の顧客の割合(百分率)をPower BIの「ゲージ」ビジュアルで表示する場合、最も近い値はどれですか?

計算
348

Power BIのビジュアル機能に関する以下の記述のうち、誤っているものはどれか。

誤り発見
349

Power BIのテーブルビジュアルと行列(マトリックス)ビジュアルに関する記述で、誤っているものはどれか。

誤り発見
350

Power BIの円グラフと積み上げ棒グラフの使用方法に関する記述で、誤っているものはどれか。

誤り発見
351

Power BIの地図ビジュアルとフィルタリング機能に関する記述で、誤っているものはどれか。

誤り発見
352

Power BIのカスケード(ウォーターフォール)チャートとファンネルチャートの特性に関する記述で、誤っているものはどれか。

誤り発見
353

Power BIの分解ツリービジュアルと主要インフルエンサービジュアルに関する記述で、誤っているものはどれか。

誤り発見
360

営業チームがPower BIダッシュボードの「売上高の折れ線グラフ」に「商品カテゴリ別の凡例」を追加した場合、どのような問題が発生する可能性が高いか?

応用
361

店舗マネージャーが月別の顧客訪問数を積み上げ棒グラフで可視化し、複数の店舗を色分けで表示していました。その後、新しい店舗が3つ追加されてカテゴリが計13店舗に増えたとき、最初に検討すべき改善策は何か?

応用
362

データアナリストが縦棒グラフで四半期ごとの売上を表示していましたが、各四半期内での日別変動の詳細も同時に表示したいと考えています。元のグラフに「日付」フィールドを「軸」に追加すると、どのような効果と問題が生じるか?

応用
363

営業チームが「顧客別の年間購買額」をテーブルビジュアルで表示し、上位50顧客を管理していました。新しいデータが追加されて5,000顧客に増えた場合、テーブルビジュアルだけでは生じやすい問題として最も適切なのはどれか?

応用
364

プロダクトマネージャーが「7つのカテゴリ別の市場シェア」を円グラフで表示しています。最近になって1つのカテゴリの売上が急に1%に低下しました。この場合、円グラフでどのような視認性の問題が発生し、どの対応が最も実用的か?

応用
365

データアナリストが「過去24ヶ月の月別売上」を折れ線グラフで表示していましたが、CFOが「毎月の成長率(前月比)の変化も同じグラフで見たい」と要望しました。売上と成長率を同じグラフに追加すると、どのような問題が生じやすいか?

応用

Microsoft Fabric32

166

Microsoft Fabricの「OneLake」について正しい説明はどれか?

定義
167

Microsoft Fabricの「ショートカット(Shortcut)」機能の主な特徴はどれか?

定義
168

Microsoft Fabricの「Lakehouse」と「Data Warehouse」の主な違いはどれか?

定義
169

Power BIのDirect Lakeモードについて正しい説明はどれか?

定義
170

Microsoft FabricとAzure Synapse Analyticsの関係について正しい説明はどれか?

定義
171

Microsoft Fabricの「ミラーリング(Mirroring)」機能の主な目的はどれか?

定義
172

Microsoft Fabricのどのエクスペリエンスが、Azure Data Factoryのパイプライン機能に相当するか?

定義
173

DP-900試験において「Microsoft Fabric」が重要視される理由として正しいのはどれか?

定義
366

Microsoft FabricにおけるLakehouseとData Warehouseの主な違いについて、最も正確な説明はどれか?

比較
367

Microsoft FabricのData FactoryとData Pipelineの主な違いとして、正しい説明はどれか?

比較
368

Microsoft FabricのOneLakeとAzure Data Lake Storage(ADLS)の主な違いとして、最も適切なのはどれか?

比較
369

Microsoft FabricのShortcut(ショートカット)機能とMirroring(ミラーリング)機能の主な違いについて、正しい説明はどれか?

比較
370

Power BIのDirect LakeモードとDirectQueryモードの主な違いとして、最も正確な説明はどれか?

比較
371

Microsoft FabricのNotebookエクスペリエンスとSQL Analytic Endpointの主な使い分けについて、最も適切な説明はどれか?

比較
384

Microsoft Fabricでデータエンジニアが複数のクラウドプロバイダー(AWS S3とGoogle Cloud Storage)に保存されたデータを統一的に分析する必要が生じました。OneLakeとショートカット機能を活用した場合、どのような結果が期待されますか?

応用
385

Lakehouse と Data Warehouse の両方を保有する組織で、リアルタイム分析ダッシュボード用に Power BI を接続する予定です。Direct Lake モードの活用を検討した場合、どの構成が最も効率的で高速なクエリパフォーマンスを実現できますか?

応用
386

組織が Azure Synapse Analytics の既存のデータパイプラインを Microsoft Fabric に移行することを計画しています。パイプライン機能に相当する Fabric エクスペリエンスを使用して、移行後のオーケストレーション運用がどのように改善されると予想できますか?

応用
387

ミラーリング機能を使用して Operational Database(オンプレミスの SQL Server)から Microsoft Fabric へデータを同期している環境において、ソースデータベースで大規模なスキーマ変更(テーブル追加・列削除等)が発生しました。Fabric 側ではどのような影響が生じ、どのような対応が必要になりますか?

応用
388

複数の部門が異なる Fabric Workspace でそれぞれ独立したデータ分析を行っていますが、経営層から全社レベルの統合ダッシュボード作成を指示されました。OneLake の階層構造とショートカット機能を活用して、データガバナンスを保ちながら統合することを検討した場合、最も適切な実装方法はどれですか?

応用
389

企業が Data Warehouse と Lakehouse を並行運用しており、データ品質向上のため両者を連携させたデータパイプラインの構築を検討しています。Data Pipelines でこの統合を実装した場合、アーキテクチャ上のメリットとしてどれが最も適切ですか?

応用
372

Microsoft Fabricの機能に関する以下の記述で、誤っているものはどれか。

誤り発見
373

Microsoft Fabricの「Lakehouse」の特性に関する以下の記述で、誤っているものはどれか。

誤り発見
374

Microsoft Fabricの「Data Warehouse」エクスペリエンスに関する以下の記述で、誤っているものはどれか。

誤り発見
375

Microsoft Fabricの「Data Activator」機能に関する以下の記述で、誤っているものはどれか。

誤り発見
376

Microsoft Fabricのワークスペース管理とアクセス制御に関する以下の記述で、誤っているものはどれか。

誤り発見
377

Microsoft Fabricの「Dataflow Gen2」に関する以下の記述で、誤っているものはどれか。

誤り発見
378

Microsoft Fabricのデータ分析プロジェクトで、Lakehouseに1日で3,200GBのデータが取り込まれました。OneLakeの容量が100TBで、すでに25TBが使用されている場合、残り何日間このペースでデータを保存できますか?

計算
379

Microsoft Fabricのデータパイプラインで、毎日480,000件のレコードが処理されます。1レコードあたり8,500バイトのデータを格納する場合、30日間で総計何GBのデータが蓄積されますか?(1GB = 1,000,000,000バイトとして計算)

計算
380

Fabricのデータ変換プロセスで、入力データセット:56,000行、変換後のデータセット:48,500行が生成されました。削除または除外されたレコード数は全体の何パーセントですか?(小数第1位で四捨五入)

計算
381

Microsoft Fabricのデータウェアハウスで、クエリAは平均応答時間2.5秒で1日3,600回実行されます。クエリBは平均応答時間1.8秒で1日2,400回実行されます。1日のクエリ総処理時間は合計何時間ですか?

計算
382

Fabricのパイプラインで、データセットAの行数は650,000行、データセットBの行数は428,000行です。両データセット間で重複するレコードが98,000行ある場合、統合後の合計ユニークレコード数は何行ですか?

計算
383

Microsoft Fabricのコスト計算で、月額のコンピュート利用料が22,500円、ストレージ利用料が18,750円、データ転送料が3,750円である場合、月額総コストに占めるストレージ料金の比率は何パーセントですか?(小数第1位で四捨五入)

計算