AI実装検定B級 ⑥ pandas

表形式データを扱うライブラリpandasの分野です(39問収録)。import pandas as pdの記法、1次元のSeriesと2次元のDataFrame、Index(ラベル)の役割を土台として学びます。欠損値NaNの扱いが大きなテーマで、dropna(axis・thresh指定)・fillna・ffill・bfill・isna・notnaを区別します。さらに列の取り出し(df['列名'])やスライス、concatによる連結(axis)、mergeの結合(on・how・inner/outer/left)、groupbyやaggによる集計、read_csvでの読み込みも頻出です。NumPyとの違い(行・列ラベルを持つ点)も押さえておきましょう。

この分野の問題39問を、選択肢・正解・解説つきで掲載しています。まず自分で解答を考えてから「正解と解説を見る」を開いて答え合わせをしてください。

クイズモードで挑戦 →

182pandasにおいて、1列のデータを扱うための型を何と呼ぶか

  1. ASeries
  2. BDataFrame
  3. CList
  4. DArray
正解と解説を見る

正解:ASeries

Seriesは1列のデータを表す1次元のデータ構造である。

この問題の解説ページを開く →

183pandasにおいて、表形式のデータを扱うための型を何と呼ぶか

  1. ASeries
  2. BDataFrame
  3. CTable
  4. DMatrix
正解と解説を見る

正解:BDataFrame

DataFrameは表形式の2次元のデータを表す構造である。

この問題の解説ページを開く →

184pandasのライブラリをインポートする際の慣例的な略記として正しいものはどれか

  1. Aimport pandas as pa
  2. Bimport pandas as pds
  3. Cimport pandas as pd
  4. Dimport pandas as pan
正解と解説を見る

正解:Cimport pandas as pd

pandasはpdという略称でインポートするのが一般的である。

この問題の解説ページを開く →

185pandasのDataFrameにおいて、表全体を表現するものは何か

  1. ASeries
  2. BIndex
  3. CColumn
  4. DDataFrame
正解と解説を見る

正解:DDataFrame

DataFrameは表全体を表すデータ型である。

この問題の解説ページを開く →

186pandasのSeriesにおいて、インデックス(Index)の役割は何か

  1. Aデータへのアクセス手段を提供する
  2. B値を保存する
  3. Cデータの型を指定する
  4. D欠損値の置換を行う
正解と解説を見る

正解:Aデータへのアクセス手段を提供する

Indexは各データ値にアクセスするためのラベルや識別子として機能する。

この問題の解説ページを開く →

187pandasにおいて、データが存在しないことを示す「Not a Number」の略称はどれか

  1. ANone
  2. BNaN
  3. CNull
  4. DEmpty
正解と解説を見る

正解:BNaN

NaNはNot a Numberの略で、データがない欠損値を表す。

この問題の解説ページを開く →

188pandasのDataFrameから欠損値がある行を削除するメソッドはどれか

  1. Adrop()
  2. Bfillna()
  3. Cdropna()
  4. Ddelete()
正解と解説を見る

正解:Cdropna()

dropnaメソッドは欠損値を含む行や列を削除するために使用される。

この問題の解説ページを開く →

189pandasのfillna()メソッドの役割として正しいものはどれか

  1. A欠損値を削除する
  2. Bデータの型を変換する
  3. Cデータの合計を計算する
  4. D欠損値を別の値で補う
正解と解説を見る

正解:D欠損値を別の値で補う

fillnaメソッドは欠損値NaNを指定した値で埋めるために使用される。

この問題の解説ページを開く →

190pandasのconcat()関数の主な役割は何か

  1. Aデータセットを連結する
  2. Bデータの統計量を計算する
  3. Cデータをグラフ化する
  4. Dデータの一部を削除する
正解と解説を見る

正解:Aデータセットを連結する

concat関数は複数のSeriesやDataFrameを結合する際に使用される。

この問題の解説ページを開く →

191pandasにおいて、DataFrameから列名がmidscoreの列を取り出す際の記述方法として正しいものはどれか

  1. Adf.get(midscore)
  2. Bdf['midscore']
  3. Cdf.midscore()
  4. Ddf.take(midscore)
正解と解説を見る

正解:Bdf['midscore']

角括弧に文字列で列名を指定することで特定の列を取得できる。

この問題の解説ページを開く →

192pandasでDataFrameを作成する際、2次元配列を渡すために用いる記法はどれか

  1. A丸括弧
  2. B波括弧
  3. C二重の角括弧
  4. D不等号
正解と解説を見る

正解:C二重の角括弧

DataFrameを直接作成する際は二重の角括弧を用いて2次元配列を渡す。

この問題の解説ページを開く →

193pandasのSeriesにおいて、0番目から1番目までのデータを取り出すスライス記法で正しいものはどれか

  1. Ad[0:1]
  2. Bd[0:1:2]
  3. Cd[1:2]
  4. Dd[0:2]
正解と解説を見る

正解:Dd[0:2]

範囲指定のスライスでは終了位置の数値は含まれないため、0番目から1番目までを取得するにはd[0:2]と指定する。

この問題の解説ページを開く →

194pandasのdropna()メソッドで、欠損値がある「列」を削除したい場合に指定する引数はどれか

  1. Aaxis='columns'
  2. Baxis='rows'
  3. Caxis='index'
  4. Daxis='all'
正解と解説を見る

正解:Aaxis='columns'

axis='columns'(またはaxis=1)を指定することで列方向の削除が可能となる。

この問題の解説ページを開く →

195欠損値を「直前の値」で前方向に補完するpandasの現行メソッドはどれか。

  1. Abfill()
  2. Bffill()
  3. Cdropna()
  4. Dfillna(0)
正解と解説を見る

正解:Bffill()

ffill()は欠損値を直前の値で前方向に補完するメソッドである。

この問題の解説ページを開く →

196欠損値を「直後の値」で後方向に補完するpandasの現行メソッドはどれか。

  1. Affill()
  2. Binterpolate()
  3. Cbfill()
  4. Dfillna(0)
正解と解説を見る

正解:Cbfill()

bfill()は欠損値を直後の値で後方向に補完するメソッドである。

この問題の解説ページを開く →

197DataFrameのgroupby()メソッドの主な目的は何か

  1. A欠損値の削除
  2. Bデータの連結
  3. Cデータの検索
  4. Dデータをグループ化して集計する
正解と解説を見る

正解:Dデータをグループ化して集計する

groupbyメソッドは特定の列の値に基づいてデータをグループ化する際に使用する。

この問題の解説ページを開く →

198pd.merge()関数で、共通する項目を基にデータを結合する方法として指定する引数はどれか

  1. Aon
  2. Bby
  3. Cjoin
  4. Daxis
正解と解説を見る

正解:Aon

merge関数で結合キーを指定するにはon引数を使用する。

この問題の解説ページを開く →

199pandasで欠損値(NaN)を判定する推奨表記の関数はどれか。

  1. Ahasnan()
  2. Bisna()
  3. Cchecknan()
  4. Disempty()
正解と解説を見る

正解:Bisna()

isna()は欠損値をTrueで返す判定関数で、欠損判定の推奨表記である。

この問題の解説ページを開く →

200DataFrameにおいて、欠損値を含まない部分をTrueにする関数はどれか

  1. Aisna()
  2. Bdropna()
  3. Cnotna()
  4. Dfilled()
正解と解説を見る

正解:Cnotna()

notna()は欠損値ではない部分をTrueとする関数である。

この問題の解説ページを開く →

201pd.concat([df1, df2])でaxis=1を指定した場合の結合方向はどれか

  1. A縦方向
  2. B斜め方向
  3. C結合しない
  4. D横方向
正解と解説を見る

正解:D横方向

axis=1を指定すると横方向にデータが結合される。

この問題の解説ページを開く →

202DataFrameにおいて、欠損値以外の要素が閾値(thresh)以上ある行を残すための引数はどれか

  1. Athresh
  2. Blimit
  3. Cmin
  4. Dcount
正解と解説を見る

正解:Athresh

thresh引数を使うと、欠損値でない要素の数で判定が行える。

この問題の解説ページを開く →

203pandasにおいて、辞書形式のデータをSeriesに渡した際、キー(key)は何に対応するか

  1. A
  2. Bインデックス
  3. Cデータ型
  4. D欠損値
正解と解説を見る

正解:Bインデックス

辞書のキーはSeriesのインデックスとして機能し、値がデータとして格納される。

この問題の解説ページを開く →

204DataFrameにおける「inner」結合の性質として正しいものはどれか

  1. Aすべてのデータを残す
  2. B欠損値を含むものも残す
  3. C共通部分のみを抽出する
  4. D片方のデータのみを抽出する
正解と解説を見る

正解:C共通部分のみを抽出する

inner結合は指定されたキーの共通部分のみを結合して抽出する。

この問題の解説ページを開く →

205pd.merge()で「outer」を指定した場合の結合結果の特徴はどれか

  1. A共通部分のみが残る
  2. B左側のデータが優先される
  3. Cすべてのデータが削除される
  4. D値がない部分はNaNとして残り結合される
正解と解説を見る

正解:D値がない部分はNaNとして残り結合される

outer結合は片方にしか存在しないデータもNaNで埋めてすべて結合する。

この問題の解説ページを開く →

206DataFrameの集計に用いる「aggregate」関数の略称はどれか

  1. Aagg()
  2. Bsum()
  3. Cmean()
  4. Dtotal()
正解と解説を見る

正解:Aagg()

aggregate関数は通常agg()と記述して集計を行う。

この問題の解説ページを開く →

207pandasでDataFrameを作成する際、辞書の配列を渡すとどうなるか

  1. Aデータが削除される
  2. B1行ごとに列の値が指定される
  3. Cすべての列が同じ値になる
  4. Dエラーになる
正解と解説を見る

正解:B1行ごとに列の値が指定される

辞書の配列を渡す方法では1行単位で列の値を指定してDataFrameを構成する。

この問題の解説ページを開く →

208NumPyとpandasの違いとして正しい説明はどれか。

  1. Apandasは行ラベル・列ラベルを持つ表形式データを扱える
  2. BNumPyは表形式データ専用である
  3. Cpandasは数値計算が一切できない
  4. DNumPyは欠損値を必ず扱える
正解と解説を見る

正解:Apandasは行ラベル・列ラベルを持つ表形式データを扱える

pandasは行ラベル(Index)と列ラベルを持つ表形式データDataFrameを扱える点がNumPyと異なる。

この問題の解説ページを開く →

209pandasでCSVファイルを読み込む際に使われるメソッドはどれか

  1. Aload_csv()
  2. Bopen_csv()
  3. Cimport_csv()
  4. Dread_csv()
正解と解説を見る

正解:Dread_csv()

read_csv()はCSVファイルをDataFrameとして読み込む標準的なメソッドである。

この問題の解説ページを開く →

210pd.merge()のhow引数で、「左側」のデータを基準にする指定はどれか

  1. Aleft
  2. Bright
  3. Cinner
  4. Douter
正解と解説を見る

正解:Aleft

how='left'は左側のDataFrameを基準に結合を行う。

この問題の解説ページを開く →

211pandasで作成したSeriesのデータ型を確認する属性はどれか

  1. Atype
  2. Bdtype
  3. Ckind
  4. Dclass
正解と解説を見る

正解:Bdtype

dtype属性はSeries内のデータの型を表示する。

この問題の解説ページを開く →

212DataFrameの列名を表示するために使用する属性はどれか

  1. Aindex
  2. Bnames
  3. Ccolumns
  4. Dheader
正解と解説を見る

正解:Ccolumns

columns属性はDataFrameの各列名を取得できる。

この問題の解説ページを開く →

213欠損値の取扱いで「平均値にズレが生じる」問題を防ぐために何が必要か

  1. A削除のみを行う
  2. Bデータの型変更
  3. Cグラフ化
  4. D事前の統計処理
正解と解説を見る

正解:D事前の統計処理

欠損値が含まれると統計計算に影響するため、事前処理が必要である。

この問題の解説ページを開く →

214DataFrameにおいて、各列の平均を求める際の正しい記述はどれか

  1. Adf.mean()
  2. Bdf.sum()
  3. Cdf.count()
  4. Ddf.size()
正解と解説を見る

正解:Adf.mean()

デフォルトでは列ごとの平均を計算する。

この問題の解説ページを開く →

215Seriesのデータがすべて同じ値の場合、DataFrameに変換するとどうなるか

  1. Aエラーになる
  2. Bすべての行に同じ値が入る
  3. C欠損値が生成される
  4. Dデータが削除される
正解と解説を見る

正解:Bすべての行に同じ値が入る

すべてのIndexに対して同じ値が割り当てられた状態でDataFrameが生成される。

この問題の解説ページを開く →

216pd.concat([s1, s2])でデフォルトの結合方向はどれか

  1. A横方向
  2. B結合できない
  3. C縦方向
  4. Dエラーになる
正解と解説を見る

正解:C縦方向

axisを指定しない場合、concat関数はデフォルトで縦方向に結合する。

この問題の解説ページを開く →

217pandasのfillna()でメソッドを指定せずに数値を渡した場合の挙動はどれか

  1. Aエラーになる
  2. B指定した行のみ置換される
  3. C何も起きない
  4. Dすべての欠損値がその数値になる
正解と解説を見る

正解:Dすべての欠損値がその数値になる

fillna(数値)は欠損値全体を指定した数値で埋める。

この問題の解説ページを開く →

218pandasで平均値(mean)や標準偏差(std)を一度に表示する関数はどれか

  1. Adescribe()
  2. Bsummary()
  3. Cinfo()
  4. Danalyze()
正解と解説を見る

正解:Adescribe()

describe関数は平均値や標準偏差などの統計情報をまとめて表示する。

この問題の解説ページを開く →

219pandasのDataFrameにおいて、行(index)と列(columns)に名前を付ける際、DataFrame作成時に指定する引数はどれか

  1. Arowとcol
  2. Bindexとcolumns
  3. Cindicesとcolumn
  4. Dlabelsとaxis
正解と解説を見る

正解:Bindexとcolumns

DataFrame作成時のindex引数とcolumns引数で指定する。

この問題の解説ページを開く →

220pd.merge()でouter結合したとき、片方にしか存在しないデータはどう処理されるか。

  1. A0で埋められる
  2. B削除される
  3. CNaNになる
  4. Dエラーになる
正解と解説を見る

正解:CNaNになる

outer結合では一致しない部分はNaNで補完して結合される。

この問題の解説ページを開く →
AI実装検定B級の全分野一覧へ戻る