模擬試験 セット2(100問・115分・合格ライン750/1000 目安75%)
本試験と同じ100問・115分です。単一選択(ラジオボタン)と複数選択(チェックボックス、「2つ選べ」等)が混在します。ページを開いた時点からタイマーが動いています。すべて解答したら最下部の「採点する」を押してください(時間切れで自動採点されます)。
問1. (シナリオ)ある小売企業では、毎朝9時にBIダッシュボードの利用者が集中し、個々のクエリは単純なのに待ち行列(キュー)に溜まって結果表示が遅くなる。Enterprise Editionを利用中である。最も適切な対策はどれか。
問2. (シナリオ)月次で実行する大規模な集計クエリだけが極端に遅く、クエリプロファイルを見るとローカルストレージへのスピル(退避)が大量に発生していた。日常の小さなクエリは問題ない。最もコスト効率の良い対策はどれか。
問3. (シナリオ)経営ダッシュボードが同じクエリを1日に何度も発行している。ウェアハウスがサスペンド状態でも結果が即座に返ることがあるのはなぜか。
問4. (シナリオ)開発チームのウェアハウスのクレジット消費が想定の3倍になっている。調査すると、auto-suspendが8時間に設定され、X-Largeサイズで軽い検証クエリを流していた。有効な是正策はどれか。(2つ選べ)
問5. (シナリオ)夜間にサスペンドされるウェアハウスで、朝一番のクエリだけ毎日遅いという苦情がある。2回目以降は速い。主な原因はどれか。
問6. (シナリオ)マルチクラスタウェアハウスで、応答速度よりコスト抑制を優先したい。多少キューに溜まっても追加クラスタの起動を抑えたい場合、どのスケーリングポリシーを選ぶべきか。
問7. (シナリオ)監査要件により、テーブルの過去データを90日前まで遡って参照できる必要がある。Standard Editionを利用中のアカウントで取るべき対応はどれか。
問8. (シナリオ)金融機関が「自社管理の鍵を組み合わせた暗号化」と「パブリックインターネットを経由しない閉域接続」を必須要件に挙げた。Business Critical Editionで初めて利用可能になる機能はどれか。(2つ選べ)
問9. (シナリオ)請求明細に「クラウドサービス」のクレジットが計上される月とされない月がある。この課金の仕組みとして正しいものはどれか。
問10. (シナリオ)数十億行のイベントテーブルに対し日付で絞り込むクエリが遅い。クエリプロファイルではほぼ全マイクロパーティションがスキャンされていた。データはランダムな順序でロードされている。有効な対策はどれか。
問11. (シナリオ)ETLジョブがセッション内でのみ使う中間テーブルを毎回作成している。他のセッションから見える必要はなく、ストレージコストも最小化したい。最も適切なテーブルタイプはどれか。
問12. (シナリオ)Time Travel保持期間(1日)を過ぎたテーブルを誤ってドロップしたことに気づいた。Fail-safeについて正しい説明はどれか。
問13. マイクロパーティションの特性として正しいものはどれか。(2つ選べ)
問14. (シナリオ)あるチームが「スキーマAのテーブルを、別のデータベースのスキーマBに移動せずそのまま参照したい」と相談してきた。Snowflakeのオブジェクト階層として正しい説明はどれか。
問15. (シナリオ)コスト削減のため、開発者が数秒おきにウェアハウスを手動でサスペンド・レジュームするスクリプトを組んだところ、かえってクレジット消費が増えた。原因はどれか。
問16. (シナリオ)決算期の3日間だけ、常に最大の同時実行能力を確保したい(負荷に応じた増減で起動待ちが生じるのも避けたい)。マルチクラスタウェアハウスの構成として適切なものはどれか。
問17. (シナリオ)通常は軽いクエリが中心のウェアハウスで、ときどき巨大なスキャンを伴うクエリが混ざり、そのたびに全体が遅くなる。ウェアハウスサイズは変えずに、大きなスキャン部分だけ追加のコンピュートへ委譲したい。適切な機能はどれか。
問18. (シナリオ)データエンジニアリングチームが、SQLではなく使い慣れたプログラミング言語のDataFrame APIでSnowflake内のデータを処理したい。Snowparkがサポートする言語はどれか。(2つ選べ)
問19. (シナリオ)カスタマーサポート部門が、蓄積した問い合わせテキストの感情分析や要約を、機械学習基盤を別途構築せずSQLから直接実行したい。適切なアプローチはどれか。
問20. (シナリオ)数十億行のテーブルに対して「特定の会員IDを1件だけ探す」等値検索が多発し、プルーニングが効きにくく遅い。クラスタリングキーは別の列で既に使用中である。Enterprise Editionで追加すべき機能はどれか。
問21. (シナリオ)Standard Editionのアカウントで CREATE MATERIALIZED VIEW を実行したところエラーになった。原因として正しいものはどれか。
問22. (シナリオ)夜間バッチでスクリプトからSQLを一括実行し、結果をファイルへ書き出す運用を自動化したい。GUIを介さない実行に最も適したインターフェースはどれか。
問23. (シナリオ)インフラ担当者が「Snowflakeのテーブルデータが格納されているクラウドストレージのバケットを直接開いて中身を確認したい」と言っている。ストレージ層の説明として正しいものはどれか。
問24. クラウドサービス層が担う処理として正しいものはどれか。(2つ選べ)
問25. (シナリオ)10TBの本番データベースの完全なコピーを開発環境として即座に用意したい。追加ストレージコストを最小限にする方法はどれか。
問26. (シナリオ)データレイク上のParquetファイル群を、Snowflakeへロードすることなくその場でSQL参照したい。適切なオブジェクトはどれか。
問27. (計算)X-Smallウェアハウスが1時間あたり1クレジットを消費するとき、Smallウェアハウスを30分間連続稼働させた場合の消費クレジットはいくつか。
問28. (シナリオ)BI用ウェアハウスのauto-suspendを60秒に設定したところ、コストは下がったが「少し席を外して戻るとクエリが遅い」という声が増えた。この現象の説明と対応として最も適切なものはどれか。
問29. (シナリオ)同じダッシュボードクエリなのに、結果キャッシュが効くときと効かないときがある。結果キャッシュが再利用されるための条件はどれか。(2つ選べ)
問30. (シナリオ)夜間ETLと日中のBI分析が同じウェアハウスを共有しており、ETLの遅延時に朝のBIが巻き添えで遅くなる。アーキテクチャ上の定石はどれか。
問31. Snowsightで実施できる操作として正しいものはどれか。(2つ選べ)
問32. (シナリオ)監査で「日常のテーブル作成やETL運用のほとんどがACCOUNTADMINロールで行われている」と指摘された。是正策として最も適切なものはどれか。
問33. (シナリオ)入退社対応のためユーザーとロールの作成・削除だけを担当するチームに権限を渡したい。過剰な権限を与えずに済むシステム定義ロールはどれか。
問34. ACCOUNTADMINロールの運用に関するベストプラクティスはどれか。(2つ選べ)
問35. (シナリオ)分析チームのロールにスキーマ内の全テーブルへのSELECTを付与したが、その後ETLが新規作成するテーブルだけが毎回参照できず、都度手動でGRANTしている。恒久対策はどれか。
問36. (シナリオ)各テーブルの所有者(作成したロール)が自由に他ロールへ権限を付与できてしまい、ガバナンス部門が把握できない付与が増えている。権限付与の権限をスキーマ所有者に集約する仕組みはどれか。
問37. (シナリオ)電話番号列にマスキングポリシーを適用したのに、一部の分析担当者から「自分の画面では生の番号が見える」と報告があった。最も可能性の高い原因はどれか。
問38. (シナリオ)Standard Editionの利用企業が個人情報保護の強化を計画している。Enterprise Edition以上へのアップグレードで利用可能になるガバナンス機能はどれか。(2つ選べ)
問39. (シナリオ)ある列に「マスキングポリシー」、同じテーブルに「行アクセスポリシー」の両方を設定した。クエリ実行時の評価順序として正しいものはどれか。
問40. (シナリオ)ネットワークポリシーで許可IPリストを更新した直後、管理者自身が接続できなくなった。オフィスの新IPを許可リストに入れ忘れたのが原因だった。今後の再発防止策として適切なものはどれか。(2つ選べ)
問41. (シナリオ)人事システムと連携したIdPを導入済みの企業が、入社・異動・退職に合わせてSnowflakeのユーザーとロール割り当てを自動で作成・更新・無効化したい。利用すべき仕組みはどれか。
問42. (シナリオ)ETLツール用のサービスアカウントが、パスワード認証かつ接続元制限なしで運用されていると指摘された。セキュリティ強化策として適切なものはどれか。(2つ選べ)
問43. (シナリオ)リソースモニターのクォータ100%到達時のアクションをSUSPENDに設定していたが、到達後もしばらくクレジット消費が続いた。この動作の説明として正しいものはどれか。
問44. (シナリオ)SYSADMINロールの担当者が CREATE RESOURCE MONITOR を実行したところ権限エラーになった。正しい説明はどれか。
問45. (シナリオ)ある月のクレジット消費が前月の2倍になった。調査の結果、検証用ウェアハウスの消し忘れと想定外の大量クエリが原因だった。再発防止として有効な施策はどれか。(2つ選べ)
問46. SNOWFLAKEデータベースのACCOUNT_USAGEスキーマの特性として正しいものはどれか。(2つ選べ)
問47. (シナリオ)「たった今実行したロードジョブの結果を、遅延なしで即座に確認したい」という要件がある。参照すべき情報源はどれか。
問48. (シナリオ)数百個のテーブルに散在する個人情報列へ、列を1つずつ指定せずに一括で同じマスキングを適用・維持したい。適切なアプローチはどれか。
問49. (シナリオ)規制対応のため「自社が管理する鍵を暗号化に組み込み、必要なら自社側の判断でデータアクセスを遮断できること」が求められた。適切な機能とその前提はどれか。
問50. Snowflakeの保存データ暗号化の標準動作として正しいものはどれか。
問51. (シナリオ)カスタムロールDATA_ENGを作成しユーザーに付与したところ、DATA_ENGが作成したデータベースをSYSADMINが管理できず、運用が属人化してしまった。ロール設計上の是正策はどれか。
問52. (シナリオ)誤ってテーブルをTRUNCATEしてしまったため、3週間前にロードしたCSVファイル群(ステージに残っている)をCOPY INTOで再ロードしようとした。しかしCOPYは正常終了するもののロード件数が0件だった。原因と対策として最も適切なものはどれか。
問53. (シナリオ)クラウドストレージのバケットに毎日置かれる生データファイルを、認証情報をSQLに書かずにSnowflakeへロードするバッチ処理を新規構築する。作業の順序として最も適切なものはどれか。
問54. (シナリオ)100万行のファイルをCOPY INTOでロードしたところ、1行の形式エラーでロード全体が失敗した。エラー行だけをスキップして残りをロードしたい。指定すべきオプションはどれか。
問55. (シナリオ)本番テーブルへのロード前に、ステージ上のファイルにデータ形式のエラーがないかを、実際にはロードせずに確認したい。使用すべき機能はどれか。
問56. (シナリオ)50GBの単一の巨大CSVファイルをCOPY INTOでロードしたところ、大きなウェアハウスを使っているのに想定より時間がかかった。ロード時間を短縮する方法として最も適切なものはどれか。
問57. (シナリオ)AUTO_INGEST = TRUEのSnowpipeを作成したが、バケットに新しいファイルを置いてもまったくロードされない。原因の切り分けとして適切な確認・対処はどれか。(2つ選べ)
問58. (シナリオ)数KBの小さなファイルを毎分数千個Snowpipeでロードしていたところ、ロード量のわりにクレジット消費が想定を大きく超えた。コストを抑える対策として最も適切なものはどれか。
問59. (シナリオ)30日前にSnowpipeでロードしたファイルの一覧を監査したい。最も適切な確認方法はどれか。
問60. (シナリオ)IoTアプリケーションから発生する行単位のデータを、ファイルを経由せず数秒以内のレイテンシでテーブルに書き込みたい。最も適切な方式はどれか。
問61. (シナリオ)月次バッチでのみ消費していたストリームが「stale」となり、変更データを読み取れなくなった。根本原因として最も適切なものはどれか。
問62. (シナリオ)ストリームに対して INSERT INTO target SELECT * FROM my_stream を実行して差分を取り込んだ直後、確認のためストリームをSELECTしたところ0件だった。この状況の説明として最も適切なものはどれか。
問63. (シナリオ)スケジュール付きのタスクを含むタスクツリーを新規作成したが、時刻になってもまったく実行されない。原因として考えられるものはどれか。(2つ選べ)
問64. (シナリオ)5分間隔のタスクがストリームを処理しているが、新着データがない時間帯にも起動してコンピュートを消費している。無駄な実行を避ける最も適切な方法はどれか。
問65. (シナリオ)複数のストリームとタスクを連鎖させた変換パイプラインの保守が煩雑になっている。「結果として欲しいテーブルの定義」と「許容できる鮮度」を宣言するだけで、更新のオーケストレーションをSnowflakeに任せたい。採用すべき機能はどれか。
問66. (シナリオ)COPY INTO @ステージ でテーブルをアンロードしたところ、gzip圧縮されたCSVが複数ファイルに分割されて出力された。連携先システムの都合で1つのファイルにまとめたい。指定すべきオプションはどれか。
問67. (シナリオ)日次アンロードで、後続の分散処理システムが読みやすいように「ファイル1つあたりのサイズ上限」と「日付ごとのフォルダ分け」を制御したい。COPY INTO(アンロード)で使用するオプションはどれか。(2つ選べ)
問68. (シナリオ)レビュー中に、同僚が書いた CREATE STAGE 文にクラウドストレージのアクセスキーとシークレットが平文で埋め込まれているのを発見した。推奨すべき修正はどれか。
問69. (シナリオ)アナリストが自分だけの一時的な分析のためにローカルのCSVをロードしたい。スキーマにステージを作成する権限は持っていない。追加の設定なしで利用できるステージはどれか。
問70. (シナリオ)大規模な集計クエリが極端に遅い。Query Profileを確認すると「Bytes spilled to remote storage」が非常に大きい。最も効果的な対策はどれか。
問71. (シナリオ)朝9時台にBIダッシュボードの表示が遅いという苦情が多い。個々のクエリのQuery Profileを見ると処理自体は速いが、Queued(キュー待ち)時間が長い。最も適切な対策はどれか。
問72. (シナリオ)数TBのテーブルに日付で絞り込むクエリを実行したが遅い。Query Profileで「Partitions scanned」が「Partitions total」とほぼ同じ値になっていた。この状況の解釈と対策として最も適切なものはどれか。
問73. (シナリオ)それぞれ100万行程度のテーブル同士をJOINしたクエリが終わらない。Query Profileを見ると、Joinオペレータの出力行数が数十億行に膨れ上がっていた。最初に確認すべきことはどれか。
問74. (シナリオ)昨日実行したものとまったく同じテキストのクエリを再実行したのに、結果キャッシュが使われずウェアハウスが起動した。原因として考えられるものはどれか。(2つ選べ)
問75. (シナリオ)夜間はウェアハウスをすべてサスペンドしている。早朝、データ変更のない状態で、前日と同一の定型レポートクエリが実行された。このときの動作として正しいものはどれか。
問76. (シナリオ)AUTO_SUSPENDを60秒に設定したところ、コストは下がったが、断続的に実行される類似クエリのたびにリモートストレージへのスキャンが発生して遅くなった。この現象の説明として最も適切なものはどれか。
問77. (シナリオ)1つのウェアハウスをETLバッチとBIダッシュボードが共用しており、ピーク時に短いBIクエリが大量にキュー待ちになる。有効な対策はどれか。(2つ選べ)
問78. (シナリオ)普段は短いクエリばかりのウェアハウスで、月に数回だけアドホックに巨大なテーブルフルスキャンを伴う分析が実行され、そのときだけ極端に遅い。ウェアハウスのサイズは変えたくない。最も適切な機能はどれか。
問79. (シナリオ)10TBのテーブルに対し、サポート担当者が顧客IDの完全一致でたまに1件を検索する。テーブルの物理的な並び順(クラスタリング)は他の分析ワークロードに合わせており変えたくない。ルックアップを高速化する最も適切な機能はどれか。
問80. マテリアライズドビュー(MV)について正しい記述はどれか。(2つ選べ)
問81. (シナリオ)数TBの取引テーブルに対し、ほとんどのクエリが取引日の範囲(BETWEEN)で絞り込む。長年の更新でデータの自然な並び順が崩れ、プルーニングが効かなくなってきた。最も適切な対策はどれか。
問82. (シナリオ)問い合わせ管理チームが、大規模なログテーブルからメールアドレスの部分文字列(LIKE '%example%')で該当行を数件探す検索を日常的に行う。これを高速化できる機能はどれか。
問83. (シナリオ)JSONファイルをVARIANT列にロードしたところ、JSONの null リテラルを含む要素が SQL の NULL ではなく「null」という値のまま保持されていた。この挙動の説明として最も適切なものはどれか。
問84. (シナリオ)VARIANT列に格納された注文JSONに商品明細の配列(items)が含まれている。明細1件を1行として展開し、リレーショナルに分析したい。使用すべき機能はどれか。
問85. (シナリオ)ファイル全体が1つの巨大なJSON配列 [ {...}, {...}, ... ] になっているファイルをCOPY INTOでロードし、配列の要素1つずつを1行のVARIANTとして格納したい。指定すべきファイルフォーマットオプションはどれか。
問86. (シナリオ)ROW_NUMBER()で採番した結果のうち1位の行だけを取り出したい。サブクエリやCTEでラップせずに、ウィンドウ関数の結果で直接フィルタしたい。使用すべき句はどれか。
問87. 大規模テーブルの探索的分析でSAMPLE句を使う際の、サンプリング方式に関する正しい記述はどれか。(2つ選べ)
問88. (シナリオ)アナリストが、参照権限を持たない機密テーブルを集計するストアドプロシージャを呼び出したところ、正常に結果が得られた。この動作の説明として最も適切なものはどれか。
問89. (シナリオ)内部ステージに保存した請求書PDF(非構造化データ)へのアクセスをアプリケーション経由でユーザーに提供したい。ファイルURLの生成に使用できる関数はどれか。(2つ選べ)
問90. (シナリオ)連携ミスにより顧客テーブルに同一顧客IDの行が複数回取り込まれてしまった。「顧客IDごとに最新の更新日時の1行」だけを残して抽出したい。最も適切な方法はどれか。
問91. (シナリオ)Standardエディション(保持期間は既定値)のアカウントで、10日前にDROPしたpermanentテーブルをUNDROPしようとしたが失敗した。理由として最も適切なものはどれか。
問92. (シナリオ)ステージング用のtransientテーブルに、誤削除対策としてDATA_RETENTION_TIME_IN_DAYS = 30 を設定しようとした。結果として正しいものはどれか。
問93. (シナリオ)8日前に誤って上書きしたpermanentテーブルのデータ(保持期間1日)について、アナリストが「Fail-safeに残っているはずなので、AT句で直接クエリしたい」と相談してきた。正しい回答はどれか。
問94. (シナリオ)本番データベースをCLONEして検証環境を作成した。ところが、本番側でSELECT権限を持っていた分析ロールから「クローンのデータベースにアクセスできない」と連絡があった。原因として最も適切なものはどれか。
問95. (シナリオ)スキーマ全体をCLONEしたところ、一部のオブジェクトがクローンに含まれていなかった。クローンされないオブジェクトはどれか。(2つ選べ)
問96. (シナリオ)取引先にデータを継続的に提供したいが、相手はSnowflakeを契約しておらず今後も契約予定がない。最も適切な提供方法はどれか。
問97. (シナリオ)他社からSecure Data Sharingで共有データベースの提供を受けることになった。コンシューマ側の特性として正しいものはどれか。(2つ選べ)
問98. (シナリオ)自社はクラウドAのリージョンX、共有先はクラウドBのリージョンYのアカウントで、直接共有を作成しようとしたところできなかった。この状況でデータを提供する方法はどれか。(2つ選べ)
問99. (シナリオ)複数の取引先に同じテーブルを共有するが、各社には自社に該当する行だけを見せたい。また、ビューの定義やベーステーブルの構造は隠したい。最も適切な方法はどれか。
問100. (シナリオ)リージョン障害に備え、別リージョンのアカウントへデータベースレプリケーションを構成し、障害時にはフェイルオーバーで業務を継続する計画を立てている。正しい記述はどれか。(2つ選べ)