DS検定~模擬試験②~ 2024年12月7日2024年12月7日 ailearn 1. データの分布形状を確認するために最適な手法は次のうちどれですか? 箱ひげ図(ボックスプロット) ヒストグラム 散布図 クロス集計表 None 2. A B C D None 3. グラフ(Graph)の探索アルゴリズムの一つで、幅優先探索(Breadth-First Search)における探索順序はどれですか? 深さ優先で探索する 最も遠いノードから探索する 重みの大きいエッジを優先して探索する 隣接するノードを次々に探索する None 4. データの欠損値処理において「多重代入法(Multiple Imputation)」の特徴として最も適切な説明は次のうちどれですか? 欠損値を単純に削除する 欠損値を1回だけ補完する 欠損値を複数回補完し、結果を統合する 欠損値をランダムに生成する None 5. データセットに外れ値が含まれる場合、回帰分析におけるモデルの精度を向上させるための適切なアプローチは次のうちどれですか? 外れ値を無視してモデルを構築する。 外れ値を削除するかロバスト回帰を使用する。 外れ値を平均値で補完する。 外れ値を新しいカテゴリとして扱う。 None 6. 信頼区間が狭い場合、その結果に対してどのような解釈ができますか? 標本の精度が高いことを示す。 標本サイズが小さいことを示す。 分散が大きいことを示す。 データが正規分布に従わないことを示す。 None 7. 以下の条件を満たすデータ構造として最も適切なものはどれですか? キーと値のペアを管理。 データの追加、削除、検索を平均O(1)の時間で行える。 配列 リンクリスト ハッシュテーブル ヒープ None 8. スタック(Stack)における操作の一つで、データを取り出す操作を何と呼びますか? push pop enqueue dequeue None 9. AIがエネルギー分野において「再生可能エネルギーの管理」で活用される主な理由として最も適切なものは次のうちどれですか? 発電所の運営コストを全てゼロにするため エネルギー貯蔵施設の物理的な配置を決定するため エネルギー需要の変動を予測し、供給を最適化するため 電力の消費量を手動で記録するため None 10. グラフの探索アルゴリズムである深さ優先探索(DFS)は、次のうちどのような順序でノードを探索しますか? 隣接する全てのノードを同時に探索する 最も浅いノードから順に探索する エッジの重みが最も小さいノードを優先して探索する 最も深いノードまで探索し、その後バックトラックして次のノードを探索する None 11. 回帰分析において、変数間の多重共線性が存在する場合、どのような問題が発生しますか? モデルの決定係数(R²)が0に近づく。 回帰係数の信頼性が低下する。 モデルの自由度が増加する。 モデルが過学習する。 None 12. 課題定義のプロセスで発生する「認知バイアス」を排除するための方法として最も適切なものは次のうちどれですか? すべてのチームメンバーの意見を無条件で採用する データに基づいて客観的に課題を評価し、多様な視点を取り入れる 既存の成功事例を参考にして、同様のアプローチを取る チームリーダーの指示に従い、意思決定を迅速に進める None 13. AIが医療分野で使用される主な目的として最も適切なものは次のうちどれですか? すべての医師を置き換えるため 患者の診断をサポートし、早期発見を促進するため 医療機器の管理のみに使用するため 手術のみを担当するため None 14. 機械学習において、「ランダムフォレスト」の主な特徴として最も適切なものは次のうちどれですか? 線形回帰の一種である データを多次元の空間にマッピングする手法である 多数の決定木を用いて予測の精度を向上させるアルゴリズムである 時系列データ専用のアルゴリズムである None 15. トライ木(Trie)を使用する主な利点は次のうちどれですか? 全てのノードの値が数値であること 木の高さが低いこと 常にバランスが保たれていること 文字列の高速な検索と共通接頭辞の効率的な管理 None 16. 仮説検定において、第二種の誤り(βエラー)を減少させるために適切な方法は次のうちどれですか? 有意水準(α)を大きくする。 データの標準化を行う。 p値を低下させる。 サンプルサイズを増加させる。 None 17. 課題の定義において、利害関係者全体の合意を得るために重要なポイントとして最も適切なものは次のうちどれですか? 各ステークホルダーの意見を均等に反映させる 課題の範囲をできるだけ広げて、多様な意見を取り入れる 課題の影響や利点を明確にし、共通の目標を設定する 一部のステークホルダーの意見を優先し、迅速に決定を進める None 18. データの「正規化」と「標準化」の違いとして最も正しい説明は次のうちどれですか? 標準化はデータを特定の範囲に収め、正規化はデータを平均0、分散1に変換する 両者は同じ意味である 正規化はデータの欠損値を補完する 正規化はデータを特定の範囲に収め、標準化はデータを平均0、分散1に変換する None 19. デザイン思考に基づく課題定義のプロセスにおいて、最初に行うべきステップは次のうちどれですか? プロトタイプを作成し、テストを行う 解決策のアイデアをブレインストーミングする 課題を具体的に定義し、SMARTゴールを設定する 共感フェーズでユーザーのニーズを理解する None 20. 自然言語処理(NLP)における「注意機構(Attention Mechanism)」の主な目的は次のうちどれですか? モデルの計算コストを削減する テキストを固定長のベクトルに変換する 複数の言語を同時に処理する テキスト全体の重要な情報を動的に特定する None 21. 時系列データの自己相関関数 (ACF) を使用して確認できるものは何ですか? データ間の線形関係 データ間の時間依存性 データの外れ値 データの平均 None 22. データサイエンスにおける「欠損データの処理方法」として、最も高度な方法は次のうちどれですか? 欠損データをすべて削除する 欠損データを無視する 欠損データをそのまま残す 欠損データを予測モデルを用いて補完する None 23. AIが「医薬品開発」において果たす役割として最も適切なものは次のうちどれですか? すべての医薬品開発を廃止する 医薬品の需要予測を行わない 新薬の開発プロセスを効率化し、治験の成功確率を高める 新薬の開発を無制限に行う None 24. 農業におけるAIの主な役割は次のうちどれですか? 農作業全般を人間に代わって行う 農業におけるデータ活用を無効にする 気象データや土壌データを基に作物の成長を最適化する 農作物の種類を制限する None 25. データサイエンスにおける「特徴量選択」の目的として最も適切なものは次のうちどれですか? 不必要な特徴量を削除し、モデルの精度と計算効率を向上させる データセットを大きくする モデルのパラメータを自動設定する モデルの複雑さを高める None 26. 「サプライチェーン」におけるAIの役割として、最も適切なものは次のうちどれですか? AIがすべての物流業務を無効化する サプライチェーンのデータを削除する すべての業務を人間が手動で管理する AIが供給と需要のバランスを最適化し、リスク管理を強化する None 27. デザイン思考において「反復的なプロトタイピング」が重要とされる理由は次のうちどれですか? 繰り返しのテストを通じて、製品やサービスを改善し続けることができるため 最初のプロトタイプが必ずしも最終製品になるため プロトタイプを一度に多く作ることでコストを削減できるため プロジェクトの納期を短縮するため None 28. キュー(Queue)のデータ構造において、最初に追加された要素が最初に削除される方式は何と呼ばれますか? LIFO FIFO FILO LILO None 29. デザインプロセスにおいて、アフォーダンスとは何ですか? 物がどのように使えるかを直感的に示すデザインの特性 製品の美観を重視するデザインの要素 使用者にとって複雑な操作方法を必要とするデザイン 製品の持つ技術的な強みを強調するデザイン None 30. AIが「自動車産業の生産ライン」において果たす役割として、最も適切なものは次のうちどれですか? AIが生産を停止する 生産ラインの労働力を増やす 生産ラインの速度を遅くする AIが生産プロセスを自動化し、品質管理を強化する None 31. 複数のステークホルダーが関与する課題の定義において、利害関係の衝突を防ぐために有効なアプローチは次のうちどれですか? 最も影響力のあるステークホルダーの意見を優先する すべての利害関係者に対して同じ優先順位を設定する 課題の定義に関与するステークホルダーをできるだけ減らす 各ステークホルダーの期待や関心を明確にし、共有するプロセスを設ける各ステークホルダーの期待や関心を明確にし、共有するプロセスを設ける None 32. データの欠損率が高い場合に推奨される手法はどれですか? 多重代入法 欠損データの削除 平均値による補完 中央値による補完 None 33. AIが「法務分野」において文書管理で利用される場合、主な利点として最も適切なものは次のうちどれですか? 全ての法律文書を物理的に保存する 法律改正の必要性を自動的に提案する 裁判官の判決を完全に自動化する 大量の法的文書を自動分類し、重要な情報を抽出する None 34. 相関関係がある2つの変数間で因果関係を示すためには、次のうちどの手法が適切ですか? 単純な回帰分析 グランジャー因果分析 t検定 カイ二乗検定 None 35. 外れ値の影響を受けにくい代表値はどれですか? 平均値 分散 標準偏差 メディアン None 36. データの正規性を検定するための手法として適切なものは次のうちどれですか? t検定 カイ二乗検定 シャピロ・ウィルク検定 相関係数 None 37. 赤黒木(Red-Black Tree)は、二分探索木の一種であり、次のうち正しい特性はどれですか? 各ノードの値が常に奇数である 各ノードが赤または黒に塗られている 全ての葉ノードは赤である 木の高さは常に一定である None 38. AIが金融業界で特に活用されている分野は次のうちどれですか? 融資判断とリスク管理 金庫管理 物理的な現金の流通 店舗デザイン None 39. 「デザインプロセス」で利用される「サービスブループリント」の主な目的は次のうちどれですか? サービスの内部プロセスと顧客体験を可視化する デザイン思考の「共感」ステップを簡略化する サービスの収益性を予測する 顧客データの分析を代替する None 40. 科学的解析における仮説検定の第一種の誤りとは何を指しますか? 帰無仮説が真であるのに、誤って棄却すること 帰無仮説が偽であるのに、棄却しないこと データに基づかない推論を行うこと 仮説を正しく検証できないこと None 41. データサイエンスでよく使用される「ハイパーパラメータ」とは何ですか? モデルが自動で最適化するパラメータ モデルの学習プロセスで調整する必要のあるパラメータ データの欠損値を処理するための手法 データの前処理方法 None 42. 標本平均と母集団平均の差が小さい場合、次のうち正しい説明はどれですか? 母集団分布は正規分布に近い 標本サイズが非常に大きい 標本は母集団を代表している 母集団分散が大きい None 43. AIが「災害管理」において活用される場面として最も適切なものは次のうちどれですか? 災害復興費用の計算を手動で行う 天候データを分析して災害発生を予測する 被災者の救助活動を全て人力で行う 災害発生後のニュース報道を作成する None 44. データセットに含まれる外れ値を検出するために最も効果的な視覚化手法はどれですか? 箱ひげ図 ヒストグラム 散布図 Q-Qプロット None 45. 「ハイパーパラメータ」として適切なものは次のうちどれですか? 学習データ内の特徴量の値 学習率やバッチサイズの設定値 モデルの重みやバイアスの値 モデルが予測したクラスの確率 None 46. 「ペルソナ」とは、デザインプロセスにおいて何を指しますか? 製品のブランディングに用いるキャラクター 典型的なユーザー像を具体化した架空の人物 チームメンバーの役割を定義する概念 デザインの最終成果物を指す None 47. 「SMARTゴール」を使って課題を定義する際、何が重要とされるか? 課題が多様で、包括的で、創造的であること 課題が具体的で、測定可能で、達成可能で、関連性があり、期限が明確であること 課題が挑戦的で、リスクが高く、革新的であること 課題が単純で、分かりやすく、迅速に解決できるものであること None 48. デザイン思考において、プロトタイプの主な目的は何ですか? 最終製品を完成させるため アイデアを具現化し、ユーザーからのフィードバックを得るため 製品のコスト削減を目指すため チームの結束力を高めるため None 49. データの次元が多すぎるときに、次元削減を行うために適切な手法はどれですか? 主成分分析 (PCA) k-平均法 決定木 サポートベクターマシン (SVM) None 50. AIが「スマートシティ」の構築において果たす役割として最も適切なものは次のうちどれですか? 都市全体の運営をリアルタイムで最適化し、持続可能な社会の実現を支援する 都市の人口を減少させる 都市内のすべての活動を停止する 都市の環境を無視する None 51. 主成分分析 (PCA) において、主成分を選定するために一般的に使用される基準は何ですか? 分散の大きさ p値の大きさ 相関係数の大きさ 標準偏差の大きさ None 52. モデルの性能を評価するために使用される「混同行列」の要素に含まれないものは次のうちどれですか? True Positive False Negative True Negative Recall None 53. 機械学習のモデル評価において、データのバランスが重要となるケースとして適切なものはどれですか? クラスタリング 回帰分析 分類問題 PCA None 54. データの標準化を行う目的は何ですか? データの範囲を広げる データの平均値をゼロにし、分散を1にする データの値を整数に変換する データの分散を大きくする None 55. 課題定義のプロセスで「曖昧さ」を排除するために最も有効な方法は次のうちどれですか? 定性的データのみを活用する 定量的な成功指標を設定する 複数の解決策を同時に採用する 主観的な評価基準を使用する None 56. 「デザイン思考」のプロセスに含まれるステップとして正しいものは次のうちどれですか? 共感 → 定義 → 創造 → プロトタイプ → テスト 創造 → 評価 → テスト → 実装 問題定義 → 解決策探索 → 実行 分析 → 計画 → 評価 → 実行 None 57. 標本平均と母集団平均を比較するために、標本の標準誤差を用いる理由は何ですか? 母集団の分散を推定するため 標本の標準偏差を推定するため 標本平均のばらつきを測定するため 標本数を増やすため None 58. ハッシュテーブル(Hash Table)における「衝突(Collision)」とは何ですか? 同じハッシュ値を持つ異なるキーが発生すること 配列の範囲外にデータが追加されること リンクリストが循環すること データが重複して保存されること None 59. ニューラルネットワークの「バッチ正規化(Batch Normalization)」の主な目的は次のうちどれですか? モデルのサイズを小さくする データの正規化を行う 学習率を自動調整する 各層の出力を正規化し、学習の安定化と加速を図る None 60. 「気候変動対策」におけるAIの役割として最も適切なものは次のうちどれですか? AIが気候変動に関与しない AIが気象データを分析し、気候変動の影響を予測する 気候変動に関するデータを削除する 気候変動対策を停止する None 61. ある変数 X が、他の変数 Y と非線形な関係を持っていることが予想される場合、適切な解析手法は次のうちどれですか? 線形回帰 ロジスティック回帰 多項式回帰 単回帰分析 None 62. 配列(Array)のデータ構造において、データ要素の挿入や削除が特に時間がかかるのはどの位置ですか? 先頭 中央 末尾 ランダム None 63. 「人間中心設計」の基本的な概念として正しいものは次のうちどれですか? デザインを効率よく進めるための組織内の管理手法 デザインのコスト削減を目的としたプロセス デザインの中心にユーザーのニーズや体験を据えたプロセス デザインの完成度を最優先するプロセス None 64. AIが最も活用されている分野の1つとして正しいものは次のうちどれですか? 農業のみ 製造業、金融業、医療業など、さまざまな産業 芸術分野のみ 人間の感情理解に限定される None 65. 課題を定義する際に使用される「SWOT分析」の要素に含まれないものは次のうちどれですか? 弱み(Weaknesses) 機会(Opportunities) リーダーシップ(Leadership) 強み(Strengths) None 66. データの自由度が減少すると、t検定の結果にどのような影響を与えますか? t値が大きくなる t値が小さくなる p値が小さくなる p値が大きくなる None 67. データサイエンスにおける「特徴量エンジニアリング」とは何を指しますか? データの前処理を行う データの収集を行う モデルの精度を向上させるために、重要な特徴量を作成・選択すること データを可視化すること None 68. 「着想・デザイン」のプロセスにおいて、成功のために「反復的プロトタイピング」を実施する主な目的は次のうちどれですか? 開発コストを削減するため 顧客フィードバックを取り入れ、デザインを継続的に改善するため 製品の発売を早めるため デザインプロセスを簡略化するため None 69. グラフデータ構造において、全てのノードが他の全てのノードとエッジで直接つながっている場合、このグラフは何と呼ばれますか? 部分グラフ 無向グラフ 完全グラフ 木構造 None 70. 科学的解析において「効果サイズ」とは何を指しますか? 仮説検定の結果がどれほど重要かを示す指標 分散の大きさを示す指標 標準誤差の大きさを示す指標 サンプルサイズの大きさを示す指標 None 71. 木構造(Tree)において、全ての子ノードが2つ以下のノードを持つ木のことを何と呼びますか? 完全二分木 二分木 完全グラフ 平衡木 None 72. データの前処理で行う「標準化」とは次のうちどれを指しますか? データの分布を平均0、分散1に変換する データの分布を一様分布にする データの欠損値を削除する データを可視化する None 73. 以下のうち、p値とは何ですか? 帰無仮説が正しい場合に得られるデータの確率 仮説が正しい確率 仮説が偽である確率 検定の正確さ None 74. t検定において、標準誤差を計算する主な目的は次のうちどれですか? 標本データのばらつきを減少させるため。 母集団の標準偏差を推定するため。 標本平均の信頼性を評価するため。 標本間の相関を計算するため。 None 75. 二分ヒープ(Binary Heap)の特性に関して正しい説明はどれですか? 親ノードの値は常に子ノードの値より大きいか、または小さい 親ノードの値は常に子ノードの値と等しい 親ノードの値は常に子ノードの値よりランダムに決まる ヒープは常に平衡状態を維持する None 76. B木(B-Tree)がよく使われるデータベースのインデックス構造である理由は何ですか? 木の高さが固定されているため データが自動的にソートされるため 大量のデータに対してもバランスが保たれるため 全てのノードが1つの値を持つため None 77. 「発散的思考」とは、どのようなプロセスを指しますか? 1つの問題に対して特定の解決策を深掘りするプロセス 問題を解決するためのデータを収集するプロセス さまざまな視点から自由にアイデアを広げるプロセス 解決策を具体的に実行するプロセス None 78. 課題定義において、ステークホルダーからのフィードバックを効果的に活用する方法として適切なものは次のうちどれですか? フィードバックを受けたら、すぐにその意見を基に解決策を実施する すべてのフィードバックをまとめて、解決策の検討に利用する 重要なステークホルダーのフィードバックのみを反映させる フィードバックを検討し、課題の定義が適切かどうか再評価する None 79. 仮説検定において「有意水準」とは何を指しますか? 第二種の誤りを許容する確率の上限 第一種の誤りを許容する確率の上限 ある仮説が真である確率 データのばらつきを示す指標 None 80. 以下のヒープ構造に関する説明として正しいものはどれですか? 各ノードの値はその子ノードの値よりも常に小さいか等しい。 最小値の要素が常にルートに配置される。 最大ヒープ 二分探索木 AVL木 最小ヒープ None 81. 課題定義のフレームワークとしてよく使用される「5 Whys(5回のなぜ)」の目的は次のうちどれですか? 複数の解決策を洗い出す 問題の根本原因を特定する 問題の影響範囲を広げる 問題解決のための手段を優先順位付けする None 82. AIが物流業界で利用される際の代表的な用途は次のうちどれですか? 荷物の重量測定 人手による配送の完全な代替 配送先の削減 配送ルートの最適化と需要予測 None 83. 「UX(ユーザーエクスペリエンス)」デザインにおける重要な要素として正しいものは次のうちどれですか? 製品の技術的な性能を最大化すること ユーザーの体験全体を設計し、使いやすさや満足度を向上させる デザインのコストを最小化すること 製品の外観や見た目に重点を置くこと None 84. 「シナリオプランニング」とは何ですか? 既存のデザインを改善するためのテストプロセス ユーザーの行動を観察し、問題を特定するためのプロセス デザインの具体的な実行計画を策定するプロセス 将来の複数の可能性に備えた計画を策定するプロセス None 85. 欠損データを処理するための一般的な手法の1つはどれですか? 欠損値を無視する 欠損値を0に置き換える 欠損値を平均値で補完する 欠損値をランダムな値で埋める None 86. 「自動運転車」におけるAIの役割として最も適切なものは次のうちどれですか? AIがリアルタイムで周囲の環境を認識し、安全な運転を支援する AIが車両のエネルギー供給を担当する AIが運転者を無視する 自動運転車ではAIが不要である None 87. モデルのパフォーマンスを向上させるための「ハイパーパラメータチューニング」の一般的な方法は次のうちどれですか? データの削除 モデルの複雑化 正則化の排除 グリッドサーチ None 88. 正規分布に従うデータを基にしたカイ二乗検定の帰無仮説は何ですか? 2つの変数が独立である データが正規分布に従っていない データが正規分布に従っている データの分散が等しい None 89. モデルの性能を比較するために使用される「クロスバリデーション」の利点として最も適切なものは次のうちどれですか? データの一部のみでモデルを評価する トレーニングデータ全体を用いてモデルを評価できる 過学習を促進する テストデータを完全に除外する None 90. 自動運転車で使用されるAI技術に関する主な役割は次のうちどれですか? 車両の設計を行う 車両の安全運転を支援し、障害物を認識する 燃料の消費を管理する 乗客の体調管理を行う None 91. カテゴリカルデータの分布を視覚化する際、最も適切なグラフは次のうちどれですか? 棒グラフ 散布図 ヒートマップ 箱ひげ図 None 92. 「トライ木(Trie)」を用いたデータ構造の主な応用例として最も適切なものはどれですか? 数値データの範囲検索 文字列の検索やオートコンプリート グラフデータの最短経路探索 データベースのインデックス管理 None 93. 課題定義において「データ駆動型アプローチ」を採用する主な目的は次のうちどれですか? ステークホルダー間の意見を重視するため 問題の本質を客観的に把握し、再現可能な分析を行うため 課題の解決策を事前に決定するため 直感に基づく意思決定をサポートするため None 94. A B C D None 95. 教育分野におけるAIの活用例として最も適切なものは次のうちどれですか? AIがすべての授業を担当する AIがすべての教員を置き換える AIが生徒一人ひとりに合わせたカリキュラムを提供する AIが学習環境を監視する None 96. 課題定義の際に、現状分析と未来予測を組み合わせて行うことで得られるメリットは次のうちどれですか? 現在の問題と将来的なリスクやチャンスを同時に考慮できる 解決策の実行を迅速に進めることができる 過去のデータに基づいて確実な解決策を導き出すことができる チームメンバー全員の合意を得ることができる None 97. 「デザイン思考」で「収束的思考」を使用するタイミングとして最も適切なものは次のうちどれですか? 問題を広範に探索し、アイデアを発散させる段階 データを収集し、分析の範囲を設定する段階 顧客ニーズを特定するための初期段階 アイデアを評価し、実現可能性の高い解決策を絞り込む段階 None 98. 多重検定を行う場合、家族誤差率(Family-Wise Error Rate)を制御するために使用される手法はどれですか? Bonferroni補正 カイ二乗検定 ヒストグラムの作成 コレスポンデンス分析 None 99. 2標本t検定を使用して2つのグループの平均を比較する際、次のうち正しい仮定はどれですか? 両グループの分散は等しい 両グループの分散は異なる 両グループのサンプルサイズは等しい 両グループのサンプルサイズは異なる None 100. 課題定義において「ステークホルダー分析」の目的は次のうちどれですか? 課題に関わる利害関係者の影響や関心を特定するため 課題を迅速に解決するための戦略を策定するため 課題解決のためのコストを算出するため 課題に対する法的な影響を確認するため None Time's up