DS検定~模擬試験①~ 2024年12月7日2025年1月12日 ailearn 1. データエンジニアリング環境の構築において、スケーラブルな分散データ処理を実現するために使用されるプラットフォームはどれですか? Hadoop MySQL FTP JSON None 2. 次のうち、「演繹法」の特徴として正しいものはどれですか? 一般的な原則から具体的な結論を導く 具体的な事例から一般的な法則を導く 結論を予測する際に感覚を重視する データを分析せずに直感的な判断を行う None 3. 企業が「グリーンウォッシング(greenwashing)」と見なされる行為として最も適切なものは次のうちどれですか? 環境保護に実際に取り組んでいることを報告すること 持続可能な製品の開発に注力すること 環境保護のために全ての活動を停止すること 実際には環境に配慮していないのに、環境に優しい企業イメージをアピールすること None 4. AIとデータサイエンスが「公共政策」に与える変化として、最も適切なものは次のうちどれですか? 政策決定を完全にAIに依存させる データを基にしたエビデンスベースの政策立案の促進 市民からの意見を無視する方向性を強化する 政策を全て定量化する None 5. ビジネス行動規範における「エシカルサプライチェーン」とはどのような概念ですか? 労働者の権利や環境保護に配慮した倫理的なサプライチェーンの構築 コスト削減を最優先とするサプライチェーンの構築 すべての供給者が同じ国に所属するサプライチェーンの構築 短期的な利益を追求するためのサプライチェーンの構築 None 6. AIの発展により「労働市場」に現れている変化は次のうちどれですか? すべての仕事がAIに置き換わる 労働時間が増える傾向にある 新しい職種が生まれつつある 人間のスキルが無価値になる None 7. AIの導入によって「物流業界」で起きている変化として、次のうち最も適切なものはどれですか? 配送ルートの最適化と自動化技術の普及 全ての倉庫作業を手作業に戻す 配送ドライバーの職務を完全に削除する 顧客情報の管理を廃止する None 8. 論理的思考における「二重否定の法則」は、次のうちどの論理的関係を表していますか? ある命題が真である場合、その否定は偽である ある命題が真である場合、その否定の否定も偽である ある命題が偽である場合、その否定の否定は真である 否定された命題は常に真である None 9. データエンジニアリング環境でのジョブスケジューリングを自動化するために使われるツールはどれですか? Docker Kubernetes HTTP Airflow None 10. A B C D None 11. REST APIを使ってデータを収集する際に、データの形式として一般的に使用されるものは次のどれですか? CSV JSON XML SQL None 12. データサイエンスにおける「フィーチャーエンジニアリング」の目的は次のうちどれですか? モデルの精度を向上させるために、重要な特徴量を作成・選択すること データの可視化を行うこと データの取得元を確認すること モデルの精度を低下させること None 13. AIが「教育分野」で生み出している最も重要な変化として適切なものは次のうちどれですか? 学生全員に同じ教育プランを提供する 教材の印刷を完全に廃止する 教育者の役割を完全にAIに置き換える 各学生の進捗状況を分析し、個別に最適化された学習プランを作成する None 14. ビジネスにおける論理的思考の重要性として、最も適切な説明はどれですか? 経営戦略や意思決定において、感情に左右されずに客観的な判断を下すため データが揃っていない状況で直感的に意思決定するため チームメンバーの意見を無視して一貫した行動を取るため 競合他社との競争において感情的な反応を示すため None 15. AIが気候変動対策で活用される場面として、最も適切なものは次のうちどれですか? 自然災害の予測と早期警報システムの強化 大気汚染の拡大 自然エネルギーの使用を制限する 気候変動に関するデータの非公開 None 16. CI/CDパイプラインにおいて、環境の自動テストやデプロイを行うために使われる一般的なツールはどれですか? Hadoop Jenkins pandas Kubernetes None 17. 環境構築時に使用される「仮想環境管理ツール」として適切なのは次のうちどれですか? SQL VirtualBox FTP JSON None 18. A B C D None 19. A B C D None 20. Kubernetesにおける「ポッド」とは何ですか? クラスタ全体の負荷分散を行う機能 コンテナ間の通信を管理するプロトコル コンテナの依存関係を管理するシステム 1つまたは複数のコンテナを含む最小のデプロイメント単位 None 21. 以下の三段論法が成立しない理由を説明してください。 「すべての猫は動物である。すべての犬は動物である。したがって、すべての猫は犬である。」 中間項不周延の誤謬 誤った類推 後件肯定の誤謬 非矛盾の原則違反 None 22. 論理的思考のプロセスにおいて、「前提」を正しく設定することが重要な理由として正しいものは次のうちどれですか? 前提が間違っていても、正しい結論を導けるため 前提が間違っていると、どれだけ正しい推論をしても、結論が間違う可能性があるため 前提を設定しない方が柔軟な思考ができるため 前提を正しく設定することは論理的思考には関係がないため None 23. 「後件肯定の誤謬」が発生するのは次のどの場合ですか? 前提が正しいにもかかわらず、誤った結論に至る場合 結論を根拠にして前提を証明しようとする場合 後件が成り立つことで前件も成り立つと誤って推論する場合 仮定が間違っている場合 None 24. 勾配降下法(Gradient Descent)の学習率(learning rate)が大きすぎる場合、予想される問題は次のうちどれですか? 最適解に収束するのが非常に遅くなる。 最適解を飛び越えて振動する可能性がある。 局所解に閉じ込められる可能性が高くなる。 勾配が計算されないため、進行が停止する。 None 25. 不明 1 10 0 None 26. 企業が遵守すべき「CSR(Corporate Social Responsibility)」の主な目的は次のうちどれですか? 企業の株主だけに利益を還元するため 企業が環境保護の義務を軽減するため 企業が競合他社を排除するため 企業が利益だけでなく、社会全体に対して責任を果たすため None 27. 微分積分の基本定理に基づいて、積分とは何を計算する手法ですか? 関数の増加量 関数の面積 関数の傾き 関数の最大値 None 28. マルコフ連鎖において、「定常状態」とは何を意味しますか? 各状態が常に同じ確率で遷移する すべての状態に同じ確率で遷移する 系が時間経過とともに特定の確率分布に収束する 系が無限の時間を経過しても一定の変化がない状態 None 29. 標準偏差を求める際に必要な計算は何ですか? 分散を2乗する 平均値を引く 分散の平方根を取る 標本数を掛ける None 30. 「利益相反」を防ぐために企業が取るべき最適な対策は次のうちどれですか? 利益相反の可能性を無視する 従業員の副業や外部活動をすべて禁止する 事前に従業員に利益相反を自己申告させる 利益相反が発覚した場合でも特に対応しない None 31. 企業の行動規範における「データ保護」の重要性について正しい説明は次のうちどれですか? データ保護は法律上の義務ではないため、任意に行うもの データ保護は企業の利益には直接関係しないため、優先度は低い 個人情報や機密情報を適切に保護することで、法的リスクや信頼の喪失を防ぐため データ保護は、取引先にすべてを委任しても問題ない None 32. AIによる「バイアス」の問題が発生する可能性がある場面として、最も適切なものは次のうちどれですか? データが大量すぎて解析できない場合 AIが完全に自動で動作している場合 データセットが少ない場合 データセットに偏りが含まれている場合 None 33. 「内部告発制度」が企業において重要な役割を果たす理由として最も適切なものは次のうちどれですか? 従業員のプライバシーを監視するため 企業の業績を評価するため 競合他社との戦略的パートナーシップを形成するため 従業員が企業内の不正行為を匿名で報告できるようにすることで、違法行為を未然に防ぐため None 34. AIが医療分野に与えている影響として、正しいものは次のうちどれですか? AIが全ての診断を行うようになった 医師の業務を支援するツールとしてAIが活用されている 患者とのコミュニケーションがなくなった 医師が不要になっている None 35. データエンジニアリング環境構築において、一般的に使用される仮想化技術はどれですか? Docker HTTP SMTP TCP/IP None 36. 医療分野でのAI活用による「パーソナライズド医療」の利点として、最も適切なものは次のうちどれですか? 患者一人ひとりの特性に合わせた治療法が提供される すべての患者に同じ治療法が適用される 患者の個別データが必要ない 患者の治療結果が予測不可能になる None 37. 医療分野で活用されている最も一般的なデータ形式は次のうちどれですか? 構造化データのみ 非構造化データのみ 構造化データと非構造化データの両方 アナログデータのみ None 38. 次の議論で用いられている誤謬を特定してください。 「この会社の業績は非常に良い。だから、この会社の経営陣は全員優秀である。」 因果関係の誤謬 演繹法の誤謬 過度の一般化 誤った類推 None 39. 公共交通機関における「スマートカードデータ」の活用法として最も効果的なものは次のうちどれですか? スマートカードデータを破棄する 乗客のデータを公開する 乗客の利用パターンを分析し、運行スケジュールの最適化を行う 乗客のデータを使用しない None 40. 小売業における「消費者行動データ」の主な活用目的として最も適切なものは次のうちどれですか? 商品のデザインを一新する 顧客の購入傾向を分析し、マーケティング戦略を最適化する 全顧客に同一のプロモーションを提供する 店舗の賃貸契約を変更する None 41. 教育分野におけるAI活用の具体例として最も適切なものは次のうちどれですか? 教師の授業の代わりに全ての教育がAIで行われる AIがテストの採点のみを行う AIが生徒とのコミュニケーションを全て代行する AIが個別学習をサポートし、生徒一人一人の進捗に応じたカリキュラムを提供する None 42. データの主成分分析 (PCA) で得られる「主成分」とは何ですか? データ内のノイズを削減する データ内で最も多くの分散を説明する新しい軸 データの標準化を行う手法 データ内の外れ値を検出する手法 None 43. AWS(Amazon Web Services)を用いたクラウド環境の構築において、データストレージサービスとして使用されるものはどれですか? FTP HTTP SMTP S3 None 44. 「ハラスメント防止」に関する行動規範の主な目的は次のうちどれですか? 職場内での不正行為を防止するため 従業員の人権を尊重し、健全な職場環境を維持するため 従業員の労働時間を管理するため 従業員の個人情報を保護するため None 45. 次の仮説を検証するために最も適切な方法を選んでください。 「新しいマーケティング戦略は、製品の売上を10%増加させる。」 既存の売上データと新しい戦略の実施後の売上データを比較する 経営者に戦略の効果について意見を求める 顧客に対してアンケートを実施する 競合他社の売上データと比較する None 46. クラウド環境でのスケーラブルなデータパイプライン構築において、分散処理をサポートするサービスは次のうちどれですか? Terraform SQL Server AWS Glue Hadoop HDFS None 47. 環境構築において、「Terraform」が提供する主な利点として最も適切なものは次のうちどれですか? インフラをコードとして定義することで、一貫性と再現性を実現する。 コンテナの依存関係を管理し、軽量な仮想環境を作成する。 データベースのスケーリングとパフォーマンスを最適化する。 マルチクラウド環境でのみ使用可能である。 None 48. AIやデータ分析技術が小売業において最も活用されている場面は次のうちどれですか? 顧客データを用いた個別化されたマーケティング 店舗の在庫管理の廃止 店員の人数を増やすため 製品の価格を無作為に決定するため None 49. ソーシャルメディアから得られるデータを活用する際に重要な注意点は次のうちどれですか? データの量よりも質を重視する データが必ずしも正確でない可能性がある 全てのデータが分析可能である データの出所を気にする必要はない None 50. 「ソーシャルメディアデータ」を活用する際に最も重要な注意点は次のうちどれですか? データが常に正確であると仮定する 全てのデータをそのまま活用する データの出所を特定しない データのプライバシーや規制を遵守する None 51. 次のうち、特異値分解(SVD)において得られる3つの主要な成分はどれですか? 固有値、固有ベクトル、対角行列 行列のランク、転置行列、逆行列 左特異ベクトル、特異値、右特異ベクトル 行列式、逆行列、スカラー値 None 52. クラウド環境におけるコスト管理を最適化するために使用される技術は次のうちどれですか? クラウドストレージの分散化 コンテナのスケジューリング クラウドモニタリング Auto Scaling None 53. 「論理的思考」における「仮説検証」のプロセスで最も重要なステップは次のうちどれですか? 仮説の立案を省略してデータ収集を行う 仮説を検証するための適切なデータを収集する 仮説が正しいと前提して結論を導き出す 仮説検証の結果を無条件に採用する None 54. A B C D None 55. APIを利用して大量のデータを収集する際、APIリクエスト数を効率的に管理するための一般的な手法は次のうちどれですか? 正規表現 トークン化 ページネーション インデックス作成 None 56. AI技術の進化により、社会に最も顕著に見られる変化の1つは次のうちどれですか? 人間による意思決定が増加している 自動化による業務効率の向上 人々の労働時間が大幅に増加している データの重要性が低下している None 57. 企業の行動規範において「人権の尊重」が重視される理由として正しいものは次のうちどれですか? すべての従業員や関係者が平等に扱われ、差別や不当な扱いを受けない権利を保護するため 労働時間の管理を厳格に行うため 企業の業績を最大化するため 競合他社との競争を促進するため None 58. データ収集において、リアルタイム処理とバッチ処理の主な違いは何ですか? リアルタイム処理はAPIを使用し、バッチ処理は手動で実行される リアルタイム処理はデータが発生するとすぐに処理し、バッチ処理は一定期間のデータをまとめて処理する リアルタイム処理はデータを変更せず、バッチ処理はデータを削除する リアルタイム処理はクラウド環境でしか動作しない None 59. A B C D None 60. 論理的思考における「反証可能性」とは何ですか? 仮説がすでに証明されていること ある仮説が常に正しいことを示すこと 仮説が他の仮説と比較して優れていること ある仮説が誤っているかどうかを実験や観察で検証できること None 61. ビジネス行動規範において「サプライチェーン全体の倫理的責任」が求められるのはなぜですか? 企業はサプライチェーンに対しては責任を負わないため サプライチェーンの倫理的な問題は顧客に影響しないため 供給者の行動は企業の評判に影響を与えないため 企業が供給者やパートナーの不正行為にも責任を持つ必要があるため None 62. AIが「医療のパーソナライズド診断」においてもたらしている変化として最も適切なものは次のうちどれですか? 個人の遺伝情報や生活習慣に基づいた治療の提案 すべての患者に同じ治療法を適用する 医療データの収集を完全に廃止する 医療従事者を完全に置き換える None 63. 「オープンデータ」が公共政策において活用される際の最大の利点は次のうちどれですか? 公共サービスの提供コストを完全に削減する すべての政府機関の機密情報を公開する 政策のすべての課題を自動解決する 市民が政策決定に参加するための情報基盤を提供する None 64. 農業分野で利用される「気象データ」の具体的な活用方法として最も適切なものは次のうちどれですか? 収穫時期や灌漑スケジュールの最適化 作物の栽培地域を完全に機械化する 農作物の市場価格を決定する 農地の所有権を管理する None 65. データ収集のプロセスで、「サンプリング」が使用される主な理由として適切なものは次のうちどれですか? データ収集の時間とコストを削減するため。 データの精度を向上させるため。 収集データを全て保存するためのストレージ容量を増やすため。 データのセキュリティを強化するため。 None 66. センサーデータの収集に使用される技術として、最も適切なのはどれですか? TCP/IP SMTP SQLクエリ IoT(Internet of Things) None 67. ビッグデータが公共政策の分野で活用される際の主な利点は次のうちどれですか? 政策の決定にデータを使用せず、直感に頼る 市民のニーズをデータに基づいて正確に把握できる 政策の結果を無視する ビッグデータの解析は政策に役立たない None 68. データの活用が急速に進んでいる農業分野において、「スマート農業」がもたらす主な利点は次のうちどれですか? 農作物の手作業での収穫を促進する 気象データや土壌データを基に効率的な農業が行える 農業におけるデータの利用を制限する 農作物の種類を減少させる None 69. 公共交通機関で収集される「スマートカードデータ」の主な利用目的として最も適切なものは次のうちどれですか? 交通機関の運賃を均一化する 乗客の個人情報を公開する 乗客の利用パターンを分析し、運行スケジュールを最適化する 運賃を手動で調整する None 70. インフラストラクチャをコードとして定義し、環境構築の自動化を行うためのツールは次のうちどれですか? SQL pandas Terraform FTP None 71. 企業が「エシカルAI(倫理的AI)」を実現するために、導入すべき最も適切な取り組みは次のうちどれですか? AIモデルのブラックボックス化を進める バイアス除去のためにデータの公平性を確認する AIシステムの結果を秘密にする AI倫理を軽視してスピード重視で運用する None 72. A B C D None 73. 行列 𝐴 が逆行列を持つための条件として正しいものは次のうちどれですか? 行列 𝐴 が正方行列であること。 行列 𝐴 の行列式が 0 でないこと。 行列 𝐴 が対称行列であること。 行列 𝐴 の要素がすべて正であること。 None 74. A B C D None 75. 論理的思考において、三段論法の基本構造は次のうちどれですか? 前提 → 結論 → 反証 大前提 → 小前提 → 結論 結論 → 検証 → 前提 前提 → 検証 → 結論 None 76. データ収集において、APIを使用してデータを取得する際に重要な要素はどれですか? エンドポイント データベース クライアント側の設定 ログファイルの解析 None 77. 医療分野において、患者のバイタルデータ(心拍数、血圧など)を収集する主な方法として最も適切なものは次のうちどれですか? オンラインアンケート ウェアラブルデバイス 手書きのカルテ 社会保険のデータベース None 78. 企業が「データのプライバシー保護」において最初に行うべき対策は次のうちどれですか? 従業員の監視を強化する GDPRなどのデータ保護規制を遵守する 収集した全データを無制限に保存する 顧客にデータ利用目的を知らせずに分析を進める None 79. 「内部告発制度」の有効性を高めるために企業が行うべき対応は次のうちどれですか? 告発者の匿名性を確保する 告発を受けても内容を公開しない 告発を行った従業員に処罰を与える 告発内容を無視する None 80. AIが「環境保護」に貢献できる場面として、最も適切なものは次のうちどれですか? AIが環境に与える影響は限定的である AIが廃棄物管理を行うことは困難である AIは環境保護に関わらない AIがエネルギー消費を最適化し、温室効果ガスの排出を削減する None 81. 企業が利益相反を避けるために行うべき具体的な対策として最も適切なものは次のうちどれですか? 利益相反が発生しうる状況を事前に特定し、透明性のある報告体制を整える 従業員に利益相反が発生した際に個別の判断を任せる 利益相反が発生した場合、企業はその責任を取らない 企業のトップがすべての利益相反を管理する None 82. 論理的思考における「非矛盾の原理」とは何ですか? 同時に真と偽であることはできないという原則 複数の結論が同時に成り立つという原則 複数の前提が矛盾する場合、結論は無効であるという原則 仮説が検証されない場合、結論は確立されないという原則 None 83. データ収集において、ウェブスクレイピングが禁止されているサイトのデータを収集する場合、適切な対応として最も正しいものは次のうちどれですか? サイト運営者に許可を取るか、公開されているAPIを使用する。 IPアドレスを変更してスクレイピングを続ける。 ウェブページのHTMLを手動でダウンロードして使用する。 サードパーティのスクレイピングサービスを利用する。 None 84. AIとデータ分析技術の進展に伴い、「スマートシティ」としての都市が実現しつつありますが、この概念の基本的な目標は次のうちどれですか? 都市全体の運営コストを削減するため 都市の人口を減らすため 都市全体の効率と持続可能性を向上させるため 都市の拡張を阻止するため None 85. データ収集において、「ログデータ」を収集する主な目的として最も適切なものは次のうちどれですか? データ分析に使用するため。 アプリケーションのデバッグや監視を行うため。 データベースのストレージを最適化するため。 ユーザーのプライバシーを保護するため。 None 86. 確率密度関数(PDF)𝑓(𝑥)の性質として正しいものは次のうちどれですか? f(x)≥0 である。 確率密度関数の積分値は無限大になる。 f(x)は必ず正規分布を表す。 確率密度関数の最大値は常に1である。 None 87. AIとビッグデータが保険業界で活用されている分野の一つに「保険金詐欺の検出」があります。このプロセスにおけるAIの役割として最も適切なものは次のうちどれですか? すべての取引を無条件で承認する 保険金詐欺を人間が手動で確認する 保険金詐欺を無視する 保険金詐欺のパターンを学習し、疑わしい取引を特定する None 88. AIが提供する「予測分析」によって、企業の意思決定における改善点として最も適切なものは次のうちどれですか? 将来の需要や市場動向を正確に予測し、適切な意思決定ができるようになる 予測結果が不正確になるため、意思決定が困難になる データに基づかない直感的な意思決定が優先される AIが市場動向を予測することは不可能である None 89. AIを活用した「サプライチェーンマネジメント」の進展により、企業が享受できる最大のメリットは次のうちどれですか? サプライチェーン全体のリアルタイム監視と予測が可能になること 在庫の増加と管理コストの増加 サプライチェーンの複雑化 サプライチェーンのリスク増加 None 90. データ収集において、ETLパイプラインが失敗した際の一般的な対応は次のうちどれですか? パイプラインを再インストールする ログを確認し、エラー原因を特定して修正する データをすべて削除してやり直す 別のデータソースを使用する None 91. AIによる「自動翻訳技術」がビジネスコミュニケーションに与える影響として最も適切なものは次のうちどれですか? 異なる言語を話す相手とのコミュニケーションがスムーズに行えるようになる 翻訳精度が低くなるため、コミュニケーションが困難になる 通訳者が必要になる 自動翻訳技術は商用利用が難しい None 92. データ収集において、「データ品質」を向上させるために重要な要素は次のうちどれですか? データの量と速度 データの完全性、一貫性、精度 データの物理的な保存場所 データのファイル形式 None 93. ビッグデータの4つの「V」に含まれない要素は次のうちどれですか? Volume(量) Velocity(速度) Variety(多様性) Visualization(可視化) None 94. 次のデータの分散を求めてください: 5, 10, 15, 20, 25 50 62.5 75 100 None 95. データ収集において、定期的にデータを収集するために使用されるツールはどれですか? SQLクエリ cronジョブ JSONパーサー 正規表現 None 96. オープンデータが提供されている主な目的は次のうちどれですか? 公的データを市民や企業が自由に活用できるようにするため データの独占を促進するため 公的な情報の隠蔽を推奨するため データのセキュリティを強化するため None 97. データの活用が企業経営において重要視されている理由は次のうちどれですか? 感覚や経験だけでの経営が優位であるため データの解析に時間がかかりすぎるため データが信頼できないから データに基づく意思決定が、感覚に頼る意思決定よりも信頼性が高いため None 98. 「論理的整合性」とは次のうちどれを指しますか? 一つの命題が常に真であること 論理的な推論が常に正しい結果を導くこと データが正確であること 複数の命題が互いに矛盾しないこと None 99. 次のシナリオを基に、どのような行動規範違反が発生しているかを特定してください。 「従業員が顧客データを個人的な目的で利用し、外部に共有した。」 コンプライアンス違反 プライバシー侵害 データ倫理違反 以上すべて None 100. Kubernetesクラスタにおいて、スケーリングを自動化するために使用される主要な機能はどれですか? Pod Autoscaler Load Balancer Persistent Volume Cluster Autoscaler None Time's up