生成AIパスポート~模擬試験~ 2024年11月25日 ailearn 1. 過学習を防ぐための正則化手法として「ドロップコネクト(DropConnect)」が特に有効である理由として最も適切なものはどれか。 特定の層を完全に無効化する 重みをランダムに無効化して汎化性能を向上させる データの次元を削減する 重みの更新を不要にする None 2. GPTの主なメリットとして最も適切なものはどれか。 テキスト生成における柔軟性と文脈理解能力が高い ノイズ耐性に優れている 動画生成に最適化されている 特定のトピックに限定されている None 3. AIという用語が初めて提案されたのはどのような場であったか。 大学の授業 科学論文 ダートマス会議 商業展示会 None 4. LMの出力品質を向上させるために最も効果的な手法はどれですか? 学習データを増やし、多様性を確保する。 プロンプトを簡潔にするが、詳細な指示は与えない。 トレーニングデータセットを変更せずにモデルのサイズを減らす。 モデルのトレーニングを停止し、既存の状態を維持する。 None 5. ChatGPTがRLHF(人間のフィードバックによる強化学習)を利用する際に直面する主な課題として適切なものはどれか。 フィードバックデータの収集が自動化できない フィードバックがモデルの偏りを強化する可能性がある モデルの計算コストが大幅に増加する モデルのトレーニングが完全に停止する None 6. 生成モデルが「モンテカルロ法」と関連する理由として最も適切なものはどれか。 データの確率分布を明示的に計算するため サンプリングを通じて不確実性をモデル化するため データの分類精度を向上させるため 潜在変数の次元を削減するため None 7. 以下の文章に対して、LLMが最適な応答を生成するための工夫として正しいものを選びなさい。 「私は昨日ケーキを作りました。それから友達とそれを食べました。」 文脈を分割して個別に処理する。 文章全体の文脈を保持し、話題の流れに基づいて応答を生成する。 最初の文だけを処理して応答を生成する。 次の単語をランダムに選んで応答を生成する。 None 8. 生成モデルの系譜における「自己回帰型モデル」の特徴として正しいものはどれか。 全データを同時に生成する データを逐次的に生成する 潜在変数を使用してデータを再構築する データのクラスタリングに特化している None 9. Transformerモデルの「マルチヘッドアテンション」で発生する可能性のある計算コストの問題を軽減するための一般的な手法として正しいものはどれか。 各アテンションヘッドの数を増やす 入力データの次元数を削減する スパースアテンション(Sparse Attention)を使用する データのバッチサイズを小さくする None 10. AI社会原則における「持続可能性」の意味として最も適切なものはどれか。 AIが環境や社会に与える影響を最小限に抑えること AIをすべての分野で無制限に活用すること AIシステムを経済的利益の最大化に利用すること AIの技術革新を一切停止しないこと None 11. StyleGANのデメリットとして適切なものはどれか。 テキスト指示を解釈する能力が欠けている テキスト生成における文脈理解能力が低い 動画生成タスクには対応していない 音声データのノイズ処理が不可能 None 12. 個人情報保護法における「個人データ」と「保有個人データ」の違いとして正しいものはどれか。 保有個人データは特定の期間を超えて保存されるデータである 個人データは匿名加工情報である 保有個人データは開示請求の対象外である 個人データは法令による保護を受けない None 13. AI社会原則の「責任共有」の理念に基づく適切な行動はどれか。 AIの利用結果に関して責任を特定の個人に押し付けること AIの失敗については責任を問わないこと AIの責任をすべてシステムに帰属させること AIの開発者、利用者、規制者がそれぞれの役割に基づいて責任を果たすこと None 14. プロンプト設計において最も重要な点として正しいものを選びなさい。 プロンプトは曖昧であるべき プロンプトには無関係な情報を含めるべき プロンプトは簡潔かつ明確であるべき プロンプトの長さは重要ではない None 15. AIの利活用における「公平性」の概念が最も適切に関係するものはどれか。 AIが完全な自由意志で動作すること AIが人間の意図を正確に反映すること AIが特定のグループを不利益に扱わないこと AIがすべてのタスクを同じ速度で実行すること None 16. 転移学習の成功に必要な「ソースドメイン」と「ターゲットドメイン」の関係性として適切なものはどれか。 完全に独立していることが理想である ソースドメインがターゲットドメインより複雑である必要がある ある程度の類似性が必要である ターゲットドメインがソースドメインを上回る性能を持つ必要がある None 17. AI効果が特定の業界で新たな競争を生む要因として最も適切なものはどれか。 AI技術の普及により既存技術が陳腐化する AI技術が市場で過小評価される AI技術が特定の分野で独占される AI技術の失敗が顧客の不信を招く None 18. Few-Shotプロンプティングが適しているタスクとして正しいものを選びなさい。 箇条書き形式で出力を生成するタスク 簡単な質問応答 定義や説明を求める単純なタスク AIに新しいトピックを学習させるトレーニングタスク None 19. 過学習を回避するための一般的な方法として正しいものはどれか。 モデルの層数を増やす ドロップアウトを使用する トレーニングデータを減らす 重みを固定する None 20. AIの第一次ブームが終焉を迎えた主な原因として正しいものはどれか。 エキスパートシステムの知識入力の負担 計算能力の不足と現実的な成果の欠如 大量データの欠如 ディープラーニング技術の限界 None 21. AIのレベル別分類で、「強いAI(Strong AI)」が目指すものとして正しいものはどれか。 特定のタスクにおいて人間を上回る能力を持つ 機械学習モデルを効率的に訓練すること 現実の物理システムを模倣すること 人間の知能や意識を再現すること None 22. 以下のシナリオで、テキスト生成AIの利用方法として最も適切なものを選びなさい。 シナリオ: 医療分野で、患者向けの健康に関する記事を作成する。 AIが生成した内容をそのまま公開する。 AIに医学的な診断書の作成を指示する。 AIが生成した文章を専門家が確認し、必要に応じて修正してから公開する。 AIの応答を信用し、他の情報源を参照しない。 None 23. 「個人情報保護法」に基づく個人情報の例として適切でないものはどれか。 名前 年齢 パスワード 端末のOSの種類 None 24. ChatGPTが「生成AIパスポート」において学習するべき重要なポイントとして正しいものはどれか。 応答生成の仕組みと進化の過程 モデルのアーキテクチャの細部 モデルの全てのパラメータ 計算リソースの最適化方法 None 25. 次のうち、AIとロボットが連携する際に最も重要とされる要素はどれか。 ロボットの動力源の効率性 AIのモデルサイズの小型化 センサーからの情報処理と行動計画の統合 ロボットの物理的デザインの美しさ None 26. ChatGPTの進化の過程で、OpenAIが強化したセキュリティ対策として正しいものはどれか。 トレーニングデータにプライバシー保護技術を導入した 応答を完全にランダム化した モデルの計算リソースを制限した トレーニングデータの更新を停止した None 27. LMとLLMの違いとして正しいものを選びなさい。 LLMはLMよりも小規模なデータセットで動作する。 LLMはLMに比べてより大規模なデータセットと計算資源を活用する。 LMはLLMよりも文脈理解能力が高い。 LMとLLMはまったく異なるアルゴリズムを使用している。 None 28. AI効果の例として正しいものはどれか。 チェスAIが世界チャンピオンを破った際に「特別なプログラム」と見なされた 自動運転車が一度も事故を起こさなかった場合に「AIとして不十分」と評価された 画像認識技術が一般的に普及した後、それが「単なるアルゴリズム」と見なされた 人間がAIの予測に従わない場合に「AIが役に立たない」と評価された None 29. ニューラルネットワークの「重み」の役割として最も適切なものはどれか。 各層の計算を並列化する 入力信号を調整する 活性化関数を最適化する データの次元を削減する None 30. ChatGPTの動作を改善するために採用されている「RLHF(人間のフィードバックによる強化学習)」の主な目的として正しいものはどれか。 モデルの計算速度を向上させる トレーニングデータの量を削減する 応答の品質を人間の期待に近づける モデルのパラメータ数を増加させる None 31. 「AIの冬」を乗り越えた要因として最も関連性が高いのはどれか。 専門家システムの復活 シンボリックAIの改良 コンピュータの大幅な小型化 ディープラーニングとビッグデータの活用 None 32. 肖像権が適用されない場合として最も適切なものはどれか。 他人の顔が特定できる状態での写真のインターネット公開 無許可で撮影された他人の動画の商業利用 著名人の肖像を広告に使用する 公共イベントで多数の人が写った写真 None 33. Whisperのメリットとして最も適切なものはどれか。 高解像度画像生成が可能 動画編集機能を持つ テキスト生成能力が高い 多言語対応とノイズ耐性に優れている None 34. 次のアルゴリズムのうち、教師なし学習に該当する「次元削減」の手法を選びなさい。 主成分分析(PCA) ランダムフォレスト 勾配ブースティング 線形回帰 None 35. 個人情報保護法に基づき、事業者が「漏洩事故」を起こした場合の最も適切な対応として正しいものはどれか。 漏洩を隠し、外部に通知しない 問題が解決するまで公表を控える 被害者に通知し、監督機関に報告する 社内の対応マニュアルだけに従う None 36. ノーフリーランチ定理の概念が現実の機械学習において完全には適用されない理由として正しいものはどれか。 現実のデータは特定の構造やバイアスを持つため アルゴリズムの性能はデータセットのサイズに依存しないため すべての問題空間が一様分布しているため 現実の問題は無限の可能性を持つため None 37. 「フィッシング詐欺」とはどのような手口か。 インターネット上で商品の販売を装って詐欺を行う ウイルスを直接パソコンに感染させる ソーシャルメディアで他人のアカウントをハッキングする 偽のウェブサイトやメールで個人情報を詐取する None 38. テキスト生成AIが最新情報を提供する能力を補うために適切な方法を選びなさい。 プロンプトを詳細にするだけで最新情報を得る。 AIが生成する情報をそのまま使用する。 AIに最新情報を直接提供させる。 外部データベースやリアルタイムAPIを組み合わせて利用する。 None 39. AI効果が特に顕著になる理由として正しいものはどれか。 AI技術の発展速度が遅いため AI技術が日常生活に溶け込むため AI技術が特定の産業に限定されるため AI技術が完全に自律していないため None 40. プロンプトを設計する際、倫理的な観点から考慮すべき点として適切なものを選びなさい。 プロンプトに誤解を招く情報を含め、AIを試す。 プロンプトに偏見や差別的な内容を含まないよう注意する。 プロンプトの設計でAIが生成する結果を完全に無視する。 プロンプトは倫理的な配慮を必要としない。 None 41. 転移学習を使用している場合、学習済みモデルの初期層(低次層)を再訓練することが適切な場面として正しいものはどれか。 新しいタスクが元のタスクと完全に異なる場合 新しいタスクのデータが少ない場合 新しいタスクが元のタスクと高度に類似している場合 モデルの計算コストを削減したい場合 None 42. 各種生成AIの共通のデメリットとして最も適切なものはどれか。 トレーニングに必要なデータ量が膨大である 環境に優しい設計がされている タスクごとに専用のモデルを作成する必要がある 完全に教師なし学習である None 43. インターネットでの適切なコミュニケーションとは何か。 他者を尊重し、攻撃的な言動を避けること すべての意見に賛同すること 匿名であれば自由に意見を述べること 感情的な表現を多用すること None 44. ChatGPTが進化の過程で課題として直面している「長文対話」の問題を解決するために考案された技術として正しいものはどれか。 メモリ強化型の注意機構を導入する トークン数の制限を完全に撤廃する データ拡張手法を採用する 応答生成をランダム化する None 45. 第二次AIブームにおけるエキスパートシステムの主要な課題として最も適切なものはどれか。 訓練データの品質管理の困難さ ルールの追加や更新に伴う管理コストの増大 大量の計算リソースを必要とする ユーザーインターフェースの欠如 None 46. AIの各ブームに共通する終焉の理由として最も適切なものはどれか。 計算リソースや技術の限界 データ量の増加 社会的な需要の不足 新しい理論の誕生 None 47. LLMが長文の文脈を処理する際、どのような技術的な制約が発生しやすいですか? 応答が短くなりすぎる。 計算負荷が高まり、メモリ制限に達する可能性がある。 短い文脈では動作しない。 文脈の最初の部分しか処理しない。 None 48. LLM(Large Language Model)が他の言語モデルと比べて特に優れている点は何ですか? パラメータ数が多く、文脈理解と推論能力が高い。 訓練にデータを必要としない。 単一の特定タスクに特化している。 ハードウェアの制約が少ない。 None 49. AIが生成した画像を商業利用する際、知的財産権の侵害を避けるための最適な手段はどれか。 AI生成物を完全に加工する 商業利用の前に適切な権利確認を行う AIが生成した場合、権利確認は不要 AIの出力結果を自動的に公開する None 50. AIモデルが特定の人種に対して偏見を持つ結果を出した場合、公平性の観点からAI開発者が最初に行うべき対応はどれか。 モデルのトレーニングデータを見直し、バイアスを軽減する 偏見を含む結果をそのまま利用する 偏見があることを隠して運用を継続する AIの利用を一時的に停止するが、モデルは変更しない None 51. AIの活用によってプライバシー保護が損なわれた場合、企業が最も重視すべき対応として適切なものはどれか。 問題を内部で解決し、外部への公表を避ける プライバシーに関する規制を見直すまで運用を停止する 影響を受けた個人に状況を説明し、適切な補償を行う AIモデルを改善せずに運用を続ける None 52. AI社会原則の「説明責任」の要件として正しいものはどれか。 AIの出力結果を公開すること AIが人間に代わって責任を負うこと AIがどのように判断を行ったかを説明可能にすること AIの誤作動をすべて回避すること None 53. ノーフリーランチ定理の視点から、「モデル選択基準」を評価する際に重要な要素として適切なものはどれか。 問題の分布が一様であることを前提とする テストデータに対する予測性能を重視する モデルの計算効率のみを評価する トレーニングデータにおける精度を優先する None 54. プロンプトとAIの応答の関係について正しい記述を選びなさい。 プロンプトはAIの応答に影響を与えない。 プロンプトの形式は応答には関係ない。 プロンプトはAIモデルの動作速度にのみ影響を与える。 プロンプトの内容によってAIの応答が大きく変わる。 None 55. シンギュラリティ到達後に想定されるAIの能力として最も正しいものはどれか。 すべての問題を即座に解決できる すべての人間の仕事を代替する 人間が制御できない独自の進化を遂げる 人間にとって完全に安全な存在になる None 56. BERT(Bidirectional Encoder Representations from Transformers)の特徴として正しいものはどれか。 トークンの生成を逐次的に行う 双方向の文脈を考慮してトークン表現を学習する デコーダのみに基づいたアーキテクチャである 翻訳タスク専用に設計された None 57. 転移学習を利用している際に、モデルの「過学習」を防ぐために適切なアプローチとして正しいものはどれか。 学習率を極端に低く設定する トレーニングデータを増やさずに、より複雑なモデルを使用する すべての層を同時に再訓練する 最終層のみを再訓練し、低次層を凍結する None 58. AIの利活用に関する国際的なルールとして最も広く採用されているものはどれか。 GDPR(一般データ保護規則) TRIPS協定(知的財産権の貿易関連の側面に関する協定) パリ協定 ワシントン条約 None 59. GAN(生成的敵対ネットワーク)を基盤にしている生成AIとして正しいものはどれか。 GPT DALL-E Whisper StyleGAN None 60. セキュリティにおいて「二要素認証(2FA)」が有効である理由として正しいものはどれか。 パスワードを廃止できる 異なる2つの確認方法を用いることで、認証の安全性を高める 同じパスワードを使い回しても安全になる 常に自動的にログインを許可する None Time's up