APA形式でのデータセットの引用方法
データセットは、自然科学、社会科学、人文学にわたる研究の実証的な基盤を形成します。公開されている研究データ、政府統計、調査データ、科学的測定値のいずれを引用する場合でも、APA第7版のデータ引用形式を理解することで、透明性、再現性、データ作成者への適切なクレジットを確保しながら、オープンサイエンスの原則を前進させることができます。
データセットの引用が重要な理由
オープンサイエンスとデータ共有への流れにより、データセットはますます重要な学術成果物となっています。研究者はリポジトリにデータセットを発表し、ジャーナルは補足データを公開し、政府機関は公開データをリリースします。これらのデータ資源は、再現研究、メタ分析、新しい研究課題を可能にします。データセットを適切に引用することは、データの収集、クリーニング、文書化に必要な多大な労力を認めると同時に、他の研究者がその成果にアクセスし、それを土台にすることを可能にします。
APA第7版は、DOIのような永続的識別子による発見可能性を重視した具体的なガイドラインとともに、データを引用可能な学術成果物として認識しています。データ引用は、データセットが更新された場合のバージョン番号を含め、読者がデータを見つけて理解するのに十分な情報を提供すべきです。これらの原則を理解することで、データ出典を適切に記録し、科学コミュニティのデータ共有インフラに貢献できます。
データセット引用の基本形式
DOI付きデータセット:
著者, A. A. (年). データセットのタイトル (Version X) [Data set]. 出版社・リポジトリ. https://doi.org/xx.xxxx
DOIなしデータセット:
著者, A. A. (年). データセットのタイトル [Data set]. 出版社・リポジトリ. URL
政府統計データ:
機関名. (年). データ・統計のタイトル [Data set]. URL
本文中の引用:
- 括弧内: (著者, 年)
- 文中に組み込む場合: 著者 (年)
段階的な説明
ステップ1:著者または作成者を特定する
データセットの著者とは、そのデータを作成、収集、または編纂した個人または組織です。標準的なAPAの著者書式に従って、20名までの著者を列挙します。組織的または共同のプロジェクトについては組織名を使います。政府データについては、それを作成した具体的な機関(「米国国勢調査局」など、単に「米国政府」ではなく)を使います。
ステップ2:出版年を決定する
データが収集された年ではなく、データセットが公開または一般に利用可能になった年を使います。定期的に更新されるデータセットについては、アクセスした特定バージョンの年を使います。データが継続的に更新される場合は、取得日を含めます。
ステップ3:データセットのタイトルの書式を整える
データセットの完全なタイトルを斜体にし、センテンスケースを使います。データセットに正式なタイトルがあればそれを使います。ない場合は、データを明確に示す説明的なタイトルを作成します。データにバージョンがある場合は、タイトルの後に括弧でバージョン番号を含めます。
ステップ4:[Data set]を指定する
タイトルとバージョンの後に、角括弧で[Data set]を含めます。この記述子は、あなたがデータについての出版物ではなく、データそのものを引用していることを明確にします。特定のデータタイプについては、[Database]、[Statistical data]、あるいは他の記述子を使うこともあります。
ステップ5:リポジトリまたは出版社を含める
データが保管されているデータリポジトリ、アーカイブ、または出版社の名前を記載します。一般的なリポジトリには、figshare、Dryad、Inter-university Consortium for Political and Social Research(ICPSR)、Dataverse、あるいは所属機関のリポジトリなどがあります。政府データについては、その機関が著者であり出版社でもある場合があります。
ステップ6:DOIまたはURLを追加する
利用可能な場合はDOIを含めます(形式:https://doi.org/xx.xxxx)。DOIはデータセットへの永続的なアクセスを提供します。DOIが存在しない場合は、データセットのランディングページへの直接URLを含めます。定期的に更新されるデータについては、URLの前に取得日を含めます。
詳細な例
例1:DOI付きの研究データセット
参考文献リスト:
Martinez, S. R., Chen, L., & Williams, K. (2023). Global climate measurements 2000-2022: Temperature and precipitation data (Version 2.1) [Data set]. figshare. https://doi.org/10.6084/m9.figshare.1234567
本文中の引用:
(Martinez et al., 2023)
複数の著者、バージョン番号、リポジトリ、DOIを含む標準的な研究データの引用。
例2:政府統計データ
参考文献リスト:
U.S. Census Bureau. (2020). American Community Survey 5-year estimates [Data set]. https://data.census.gov/cedsci/table?tid=ACSDP5Y2020.DP05
本文中の引用:
(U.S. Census Bureau, 2020)
政府統計データは、機関を著者として、データセット名とアクセスURLとともに引用します。
例3:リポジトリからの調査データ
参考文献リスト:
Pew Research Center. (2024). American trends panel wave 128: January 2024 survey data [Data set]. Roper Center for Public Opinion Research. https://ropercenter.cornell.edu/data-set/pew-american-trends-panel-w128
本文中の引用:
(Pew Research Center, 2024)
研究組織からの調査データは、その組織とデータが保管されているリポジトリを引用します。
例4:科学的測定データ
参考文献リスト:
National Oceanic and Atmospheric Administration. (2023). Sea surface temperature anomalies: Global ocean data [Data set]. National Centers for Environmental Information. https://www.ncei.noaa.gov/data/sea-surface-temperature-anomalies/
本文中の引用:
(National Oceanic and Atmospheric Administration, 2023)
政府機関からの科学的測定データは、作成機関とデータセンターの両方を引用します。
例5:ゲノム・生物学データ
参考文献リスト:
Johnson, A. M., & Thompson, R. K. (2024). RNA-seq data for breast cancer cell lines (Version 1.0) [Data set]. Gene Expression Omnibus. https://www.ncbi.nlm.nih.gov/geo/query/acc.cgi?acc=GSE123456
本文中の引用:
(Johnson & Thompson, 2024)
生物学データセットは、リポジトリ名(GEO、GenBankなど)とアクセッション番号をURL内に含めます。
例6:継続的に更新されるデータ
参考文献リスト:
World Bank. (n.d.). World development indicators: GDP growth annual % [Data set]. Retrieved January 15, 2025, from https://databank.worldbank.org/source/world-development-indicators
本文中の引用:
(World Bank, n.d.)
継続的に更新されるデータについては「n.d.」を使い、URLの前に取得日を含めます。
避けるべきよくある間違い
1. データではなく分析論文を引用する
実際のデータセットを使用した場合は、そのデータについて記述または分析している論文ではなく、データセット自体を引用してください。データと分析方法の両方を参照する場合は、両方の引用が適切な場合もあります。
2. バージョン番号の省略
データセットはしばしば更新されます。読者があなたが使用したのと同じデータにアクセスできるよう、提供されている場合はバージョン番号(Version 2.0、v3.1)を含めてください。
3. [Data set]の記述子を忘れる
タイトルの後には常に括弧で[Data set]または類似の記述子を含めてください。これにより、あなたが出版物ではなくデータを引用していることが明確になります。
4. 利用可能なDOIを含めない
DOIはデータセットへの永続的なアクセスを提供します。直接URLがある場合でも、リポジトリによってDOIが提供されている場合は常にそれを使ってください。
5. 一般的なデータベース名を使う
リポジトリやデータベースについて具体的に記載してください。「オンラインデータベース」ではなく「figshare」を使います。「データアーカイブ」ではなく「ICPSR」を使います。
6. 不完全な政府データの帰属
政府データについては、単に「米国政府」や「労働省」ではなく、そのデータを作成した具体的な機関(例:労働統計局)を使ってください。
7. 動的データに取得日を含めない
時間とともに変化するデータ(株価、天気データ、定期的に更新される統計など)については、特定の値にいつアクセスしたかを記録するため、取得日を含めてください。
簡易リファレンスガイド
データセット引用に必要な要素:
- データを作成・収集した著者または組織
- 出版年(継続的に更新されるデータには「n.d.」)
- 斜体・センテンスケースのデータセットタイトル
- 括弧内のバージョン番号(該当する場合)
- 角括弧内の[Data set]または類似の記述子
- リポジトリまたは出版社名
- 取得日(動的データのみ)
- DOIまたはURL
データタイプの記述子
- [Data set]: 一般的な研究データ
- [Database]: 複数のテーブルを持つ構造化データベース
- [Statistical data]: 統計データセット
- [Survey data]: 調査の回答と結果
- [Genomic data]: DNA、RNA、タンパク質配列
- [Geospatial data]: 地理・空間データ
- [Time series data]: 時系列測定値
- [Image data]: 分析用の画像コレクション
一般的なデータリポジトリ
- figshare: 一般的な研究データリポジトリ
- Dryad: 科学・医学研究データ
- Dataverse: 社会科学・学際データ
- ICPSR: 社会・行動科学データ
- GenBank/GEO: ゲノム・生物学データ
- Zenodo: 欧州の研究データリポジトリ
- OSF: Open Science Frameworkのデータ共有
- GitHub: コードとデータのバージョン管理
データ引用のベストプラクティス
自分で収集したデータを使う
研究のために独自のデータを収集した場合、参考文献リストに自分自身を引用する必要はありません。代わりに、方法セクションでデータ収集方法を記述しましょう。他者が引用できるよう、リポジトリにデータを寄託することを検討してください。
大規模データセットの一部を引用する
大規模なデータセットの一部を使用する場合は、データセット全体を引用し、本文中でどのサブセットを使用したかを説明してください。そのサブセットに独自のDOIがない限り、別個の引用は作成しないでください。
同じデータの複数バージョン
ある期間にわたってデータセットの複数のバージョンを使用した場合は、それぞれのバージョンを、その特定のバージョン番号とアクセス日とともに個別に引用してください。
独自データまたは制限付きデータ
アクセス制限のあるデータについては、通常どおり引用しつつ、本文中でアクセス制限を明記してください。該当する場合は、読者がどのようにアクセスを申請できるかを説明してください。
データセットの情報を見つける
次の出典から引用の詳細を見つけましょう:
- データリポジトリのランディングページ: タイトル、著者、バージョン、DOI
- READMEファイル: しばしば適切な引用形式が含まれている
- データセットのドキュメント: データ収集とバージョンに関するメタデータ
- 「Cite this dataset」ボタン: 多くのリポジトリが整形済みの引用を提供している
- データ論文: 一部のデータセットには付随する出版物がある
- リポジトリのメタデータ: データセットに関する構造化された情報
補足データ対メインデータセット
雑誌論文からの補足データ
雑誌論文からの補足データファイルを使用する場合は、その論文を引用し、補足資料であることを明記してください:
Smith, J. (2024). Climate patterns analysis. Journal of Climate, 37(2), 123–145. https://doi.org/10.xxxx [Supplementary data files]
独立したデータセット
独自のDOIとリポジトリエントリを持つ独立したデータセットは、関連する出版物とは別に引用します。
完璧なデータセット引用を作成する
データ引用には、DOI、バージョン番号、リポジトリ名などの特定の要素が必要です。無料のAPA引用ジェネレーターは、研究データ、政府統計、調査データなど、あらゆるタイプのデータセットの書式を整えます。正確な引用を適切な帰属とともに瞬時に手に入れましょう。
よくある質問
- データセットとそれを説明する論文のどちらを引用すべきですか?
- 実際のデータを使用した場合は、データセットを引用してください。研究結果や方法論について論じている場合は、その論文を引用してください。多くの場合、両方を引用することになります―論文は文脈と方法のために、データセットはそれを再分析したために。
- 政府のウェブサイトからダウンロードしたデータはどう引用すればよいですか?
- 政府機関を著者として引用し、データセット名を含め、[Data set]と明記し、URLを提供してください。バージョンや更新情報が利用可能であれば含めてください。
- データセットに正式なタイトルがない場合はどうすればよいですか?
- 斜体とセンテンスケースを使い、データを明確に示す説明的なタイトルを作成してください。例:Daily temperature measurements from weather stations in California, 2010-2020。
- ファイル形式(.csv、.xlsxなど)を含めるべきですか?
- いいえ。[Data set]の記述子で十分です。ファイル形式は技術的な詳細であり、引用には含まれません。
- 同じ調査の複数年にわたるデータはどう引用すればよいですか?
- それらが別々のデータリリースである場合は、各年を個別に引用してください。複数年を統合した場合は、方法セクションでそのアプローチを説明し、使用したシリーズまたは各年を引用してください。
- 引用情報がすべて見つからない場合はどうすればよいですか?
- 見つけられる限りの情報を含めてください。少なくとも、データの作成者・出典、おおよその日付、説明的なタイトル、アクセスURLを提供してください。