DP-203日本語 無料問題集「Microsoft Data Engineering on Microsoft Azure (DP-203日本語版)」

Storage1とStorage2という名前の2つのAzureStorageアカウントがあります。各アカウントは1つのコンテナを保持し、階層名前空間が有効になっています。システムには、ApacheParquet形式で保存されたデータを含むファイルがあります。
Data Factoryのコピーアクティビティを使用して、フォルダとファイルをStorage1からStorage2にコピーする必要があります。ソリューションは、次の要件を満たす必要があります。
変換を実行する必要はありません。
元のフォルダ構造を保持する必要があります。
コピーアクティビティの実行に必要な時間を最小限に抑えます。
コピーアクティビティをどのように構成する必要がありますか?回答するには、回答領域で適切なオプションを選択します。
注:正しい選択はそれぞれ1ポイントの価値があります。
正解:

Explanation:

Box 1: Parquet
For Parquet datasets, the type property of the copy activity source must be set to ParquetSource.
Box 2: PreserveHierarchy
PreserveHierarchy (default): Preserves the file hierarchy in the target folder. The relative path of the source file to the source folder is identical to the relative path of the target file to the target folder.
Reference:
https://docs.microsoft.com/en-us/azure/data-factory/format-parquet
https://docs.microsoft.com/en-us/azure/data-factory/connector-azure-data-lake-storage
ストレージ アカウントを含む Azure サブスクリプションがあります。アカウントには、blob1 という名前の BLOB コンテナーと Azure Synapse Analytics サーバーレス SQL プールが含まれています。
blob1 に保存されている CSV ファイルをクエリする必要があります。ソリューションでは、csv という名前のフォルダーとそのすべてのサブフォルダー内のすべてのファイルがクエリされるようにする必要があります。
クエリをどのように完了すればよいですか? 回答するには、回答領域で適切なオプションを選択します。
注意: 正しい選択ごとに 1 ポイントが付与されます。
正解:

Explanation:
A computer screen shot of a computer code Description automatically generated

BULK Path (first dropdown):
* Correct Option: abfs:
* Since the storage account uses Azure Data Lake Storage Gen2, the abfs:// (Azure Blob File System) protocol is the correct option for accessing the files.
Path to Query Files:
* The path 'abfs://[email protected]/blob1/' specifies the container (blob1) and the folder (csv) within the storage account.
* This ensures that all files in the csv folder and its subfolders are included in the query.
FORMAT (last dropdown):
* Correct Option: 'CSV'
* This indicates that the queried files are in the CSV format, which matches the requirement in the question.
Azure Synapse Analytics 専用の SQL プールがあります。
データベースを監視して長時間実行されているクエリを監視し、どのクエリがリソースを待機しているかを特定する必要があります。各要件に対してどの動的管理ビューを使用する必要がありますか? 回答するには、回答領域で適切なオプションを選択してください。
ノート; 正解ごとに 1 ポイントの価値があります。
正解:

Explanation:
ADFdev と ADFprod という 2 つの Azure Data Factory インスタンスがあります。 ADFdev は Azure DevOps Git リポジトリに接続します。
Git リポジトリのメイン ブランチから ADFdev に変更を公開します。
アーティファクトを ADFdev から ADFprod にデプロイする必要があります。
最初に何をすべきですか?

解説: (JPNTest メンバーにのみ表示されます)
トランザクションデータの分析ストレージソリューションを設計する必要があります。ソリューションは、販売トランザクションデータセットの要件を満たす必要があります。
ソリューションに何を含める必要がありますか?回答するには、回答領域で適切なオプションを選択します。
注:正しい選択はそれぞれ1ポイントの価値があります。
正解:

Explanation:

Box 1: Round-robin
Round-robin tables are useful for improving loading speed.
Scenario: Partition data that contains sales transaction records. Partitions must be designed to provide efficient loads by month.
Box 2: Hash
Hash-distributed tables improve query performance on large fact tables.
Reference:
https://docs.microsoft.com/en-us/azure/synapse-analytics/sql-data-warehouse/sql-data-warehouse-tables-distribute
Azure Synapse Analytics 専用の SQL プールを設計しています。
個人識別情報 (PII) へのアクセスを監査できることを確認する必要があります。
ソリューションには何を含める必要がありますか?

解説: (JPNTest メンバーにのみ表示されます)
Azure Synapse Analytics 専用の SQL プールで、サプライヤー データの緩やかに変化するディメンション (SCD) を設計しています。
利用可能なフィールドへの変更の記録を保持する予定です。
サプライヤ データには、次の列が含まれます。

タイプ 2 SCD を作成するためにデータに追加する必要がある 3 つの列はどれですか?それぞれの正解は、ソリューションの一部を示しています。
注: 正しい選択ごとに 1 ポイントの価値があります。

正解:C、D、F 解答を投票する
解説: (JPNTest メンバーにのみ表示されます)
ストレージ アカウントを含む Azure サブスクリプションがあります。アカウントには、blob1 という名前の BLOB コンテナーと、Azure Synapse Analytic サーバーレス SQL プールが含まれています。blob1 に格納されている CSV ファイルをクエリする必要があります。ソリューションでは、(古い名前の csv 内のすべてのファイルとそのすべてのサブフォルダーがクエリされるようにする必要があります。クエリをどのように完了する必要がありますか? 回答するには、回答領域で適切なオプションを選択します。注: 正しい選択ごとに 1 ポイントが付与されます。

正解:

Explanation:
Sales.Orders という名前のテーブルを含む Azure Synapse Analytics 専用の SQL プールがあります。Sales.Orders には、SalesRep という名前の列が含まれています。
Sales.Orders に行レベル セキュリティ (RLS) を実装する予定です。
RLS の実装に使用されるセキュリティ ポリシーを作成する必要があります。このソリューションでは、SalesRep 列の値がユーザー名と一致する行のみが営業担当者に表示されるようにする必要があります。
コードをどのように完成させる必要がありますか? 回答するには、回答エリアで適切なオプションを選択します。
注: それぞれの正しい選択は 1 ポイントの価値があります。
正解:

Explanation:
Azure Synapseに、dbo.Customersという名前のテーブルを含むSQLプールがあります。テーブルには、Emailという列名が含まれています。
管理者以外のユーザーが[電子メール]列に完全な電子メールアドレスを表示しないようにする必要があります。ユーザーは、代わりに[email protected]の形式で値を表示する必要があります。
あなたは何をするべきか?

解説: (JPNTest メンバーにのみ表示されます)
AzureSynapseにSQLプールがあります。
一部のクエリが失敗するか、完了するまでに長い時間がかかることがわかりました。
ロールバックされたトランザクションを監視する必要があります。
どの動的管理ビューを照会する必要がありますか?

解説: (JPNTest メンバーにのみ表示されます)
注:この質問は、同じシナリオを提示する一連の質問の一部です。シリーズの各質問には、述べられた目標を達成する可能性のある独自の解決策が含まれています。一部の質問セットには複数の正しい解決策がある場合がありますが、他の質問セットには正しい解決策がない場合があります。
このセクションの質問に回答した後は、その質問に戻ることはできません。その結果、これらの質問はレビュー画面に表示されません。
ステージングゾーンを含むAzureData LakeStorageアカウントがあります。
ステージングゾーンから増分データを取り込み、Rスクリプトを実行してデータを変換し、変換されたデータをAzure SynapseAnalyticsのデータウェアハウスに挿入する毎日のプロセスを設計する必要があります。
解決策:Rノートブックを実行するAzure Databricksジョブをスケジュールしてから、データウェアハウスにデータを挿入します。
これは目標を達成していますか?

解説: (JPNTest メンバーにのみ表示されます)
Pool1 という名前の Azure Synapse Analytics 専用 SQL プールを含む Azure サブスクリプションがあります。
Azure Monitor を使用します。
Pool1 で実行されたクエリのパフォーマンスを監視する必要があります。
どのログを照会する必要がありますか?

解説: (JPNTest メンバーにのみ表示されます)

弊社を連絡する

我々は12時間以内ですべてのお問い合わせを答えます。

オンラインサポート時間:( UTC+9 ) 9:00-24:00
月曜日から土曜日まで

サポート:現在連絡