본문으로 건너뛰기
← 가이드 목록으로 돌아가기

APA 형식으로 데이터 세트 인용하는 법

데이터 세트는 자연과학, 사회과학, 인문학 전반에 걸친 연구의 실증적 토대를 이룹니다. 공개된 연구 데이터, 정부 통계, 설문조사 데이터, 과학적 측정값 중 무엇을 인용하든, APA 7판의 데이터 인용 형식을 이해하면 투명성과 재현성을 확보하고 데이터 제작자에게 정당한 공로를 인정하는 동시에 오픈 사이언스 원칙을 발전시킬 수 있습니다.

데이터 세트 인용이 중요한 이유

오픈 사이언스와 데이터 공유를 향한 흐름으로 데이터 세트는 점점 더 중요한 학술 산출물이 되고 있습니다. 연구자는 저장소에 데이터 세트를 게시하고, 학술지는 보충 데이터를 공개하며, 정부 기관은 공공 데이터를 배포합니다. 이러한 데이터 자원은 재현 연구, 메타분석, 새로운 연구 질문을 가능하게 합니다. 데이터 세트를 적절히 인용하는 것은 데이터를 수집·정제·문서화하는 데 들어간 상당한 노력을 인정하는 동시에, 다른 연구자들이 기존 작업에 접근하고 이를 기반으로 발전시킬 수 있도록 합니다.

APA 7판은 DOI와 같은 영구 식별자를 통한 검색 가능성을 강조하는 구체적인 지침과 함께 데이터를 인용 가능한 학술 산출물로 인정합니다. 데이터 인용은 독자가 데이터를 찾고 이해하기에 충분한 정보를 제공해야 하며, 데이터 세트가 업데이트된 경우 버전 번호도 포함해야 합니다. 이러한 원칙을 이해하면 데이터 출처를 적절히 기록하고 과학계의 데이터 공유 인프라에 기여할 수 있습니다.

데이터 세트 인용의 기본 형식

DOI가 있는 데이터 세트:

저자, A. A. (연도). 데이터 세트 제목 (Version X) [Data set]. 출판사·저장소. https://doi.org/xx.xxxx

DOI가 없는 데이터 세트:

저자, A. A. (연도). 데이터 세트 제목 [Data set]. 출판사·저장소. URL

정부 통계 데이터:

기관명. (연도). 데이터·통계 제목 [Data set]. URL

본문 내 인용:

  • 괄호 인용: (저자, 연도)
  • 서술형 인용: 저자 (연도)

단계별 설명

1단계: 저자 또는 제작자 확인하기

데이터 세트의 저자는 해당 데이터를 만들거나 수집하거나 편찬한 개인 또는 조직입니다. 표준 APA 저자 서식에 따라 저자를 최대 20명까지 나열하세요. 조직적이거나 공동으로 수행한 프로젝트라면 조직명을 사용하세요. 정부 데이터의 경우, 단순히 "미국 정부"가 아니라 데이터를 생산한 구체적인 기관(예: 미국 인구조사국)을 사용하세요.

2단계: 출판 연도 결정하기

데이터가 수집된 연도가 아니라 데이터 세트가 출판되거나 공개된 연도를 사용하세요. 정기적으로 업데이트되는 데이터 세트라면 접근한 특정 버전의 연도를 사용하세요. 데이터가 계속 업데이트되는 경우 검색일을 포함하세요.

3단계: 데이터 세트 제목 서식 지정하기

데이터 세트의 전체 제목을 이탤릭체로 쓰고 문장체 대문자 표기법을 사용하세요. 데이터 세트에 공식 제목이 있으면 그것을 사용하세요. 없다면 데이터를 명확히 식별하는 설명적인 제목을 만드세요. 데이터에 버전이 있으면 제목 뒤 괄호 안에 버전 번호를 포함하세요.

4단계: [Data set] 명시하기

제목과 버전 뒤에 대괄호로 [Data set]을 포함하세요. 이 설명어는 여러분이 데이터에 관한 출판물이 아니라 데이터 자체를 인용하고 있음을 명확히 합니다. 특정 데이터 유형에는 [Database], [Statistical data] 등 다른 설명어를 사용할 수 있습니다.

5단계: 저장소 또는 출판사 포함하기

데이터가 보관된 데이터 저장소, 아카이브 또는 출판사의 이름을 기재하세요. 일반적인 저장소로는 figshare, Dryad, 정치사회연구 대학간컨소시엄(ICPSR), Dataverse, 또는 소속 기관 저장소 등이 있습니다. 정부 데이터의 경우 해당 기관이 저자이자 출판사 역할을 모두 할 수 있습니다.

6단계: DOI 또는 URL 추가하기

가능한 경우 DOI를 포함하세요(형식: https://doi.org/xx.xxxx). DOI는 데이터 세트에 대한 영구적인 접근을 제공합니다. DOI가 없으면 데이터 세트의 랜딩 페이지로 직접 연결되는 URL을 포함하세요. 정기적으로 업데이트되는 데이터라면 URL 앞에 검색일을 포함하세요.

상세 예시

예시 1: DOI가 있는 연구 데이터 세트

참고문헌 목록:

Martinez, S. R., Chen, L., & Williams, K. (2023). Global climate measurements 2000-2022: Temperature and precipitation data (Version 2.1) [Data set]. figshare. https://doi.org/10.6084/m9.figshare.1234567

본문 내 인용:

(Martinez et al., 2023)

여러 저자, 버전 번호, 저장소, DOI를 포함한 표준적인 연구 데이터 인용입니다.

예시 2: 정부 통계 데이터

참고문헌 목록:

U.S. Census Bureau. (2020). American Community Survey 5-year estimates [Data set]. https://data.census.gov/cedsci/table?tid=ACSDP5Y2020.DP05

본문 내 인용:

(U.S. Census Bureau, 2020)

정부 통계 데이터는 기관을 저자로 인용하며 데이터 세트명과 접근 URL을 함께 기재합니다.

예시 3: 저장소의 설문조사 데이터

참고문헌 목록:

Pew Research Center. (2024). American trends panel wave 128: January 2024 survey data [Data set]. Roper Center for Public Opinion Research. https://ropercenter.cornell.edu/data-set/pew-american-trends-panel-w128

본문 내 인용:

(Pew Research Center, 2024)

연구 기관의 설문조사 데이터는 해당 기관과 데이터가 보관된 저장소를 함께 인용합니다.

예시 4: 과학적 측정 데이터

참고문헌 목록:

National Oceanic and Atmospheric Administration. (2023). Sea surface temperature anomalies: Global ocean data [Data set]. National Centers for Environmental Information. https://www.ncei.noaa.gov/data/sea-surface-temperature-anomalies/

본문 내 인용:

(National Oceanic and Atmospheric Administration, 2023)

정부 기관의 과학적 측정 데이터는 생산 기관과 데이터 센터를 모두 인용합니다.

예시 5: 유전체·생물학 데이터

참고문헌 목록:

Johnson, A. M., & Thompson, R. K. (2024). RNA-seq data for breast cancer cell lines (Version 1.0) [Data set]. Gene Expression Omnibus. https://www.ncbi.nlm.nih.gov/geo/query/acc.cgi?acc=GSE123456

본문 내 인용:

(Johnson & Thompson, 2024)

생물학 데이터 세트는 저장소명(GEO, GenBank 등)과 승인 번호를 URL에 포함합니다.

예시 6: 지속적으로 업데이트되는 데이터

참고문헌 목록:

World Bank. (n.d.). World development indicators: GDP growth annual % [Data set]. Retrieved January 15, 2025, from https://databank.worldbank.org/source/world-development-indicators

본문 내 인용:

(World Bank, n.d.)

지속적으로 업데이트되는 데이터는 "n.d."를 사용하고 URL 앞에 검색일을 포함합니다.

피해야 할 흔한 실수

1. 데이터가 아닌 분석 논문을 인용하기

실제 데이터 세트를 사용했다면 데이터를 설명하거나 분석하는 논문이 아니라 데이터 세트 자체를 인용하세요. 데이터와 분석 방법을 모두 참조하는 경우라면 두 가지 인용이 모두 적절할 수 있습니다.

2. 버전 번호 생략하기

데이터 세트는 자주 업데이트됩니다. 독자가 여러분이 사용한 것과 동일한 데이터에 접근할 수 있도록, 제공되는 경우 버전 번호(Version 2.0, v3.1)를 포함하세요.

3. [Data set] 설명어 빠뜨리기

제목 뒤에는 항상 대괄호로 [Data set] 또는 유사한 설명어를 포함하세요. 이는 여러분이 출판물이 아니라 데이터를 인용하고 있음을 분명히 합니다.

4. 사용 가능한 DOI를 포함하지 않기

DOI는 데이터 세트에 대한 영구적인 접근을 제공합니다. 직접 URL이 있더라도 저장소에서 DOI를 제공한다면 항상 그것을 사용하세요.

5. 일반적인 데이터베이스명 사용하기

저장소나 데이터베이스에 대해 구체적으로 기재하세요. "온라인 데이터베이스"가 아니라 "figshare"를 사용하세요. "데이터 아카이브"가 아니라 "ICPSR"을 사용하세요.

6. 불완전한 정부 데이터 출처 표시

정부 데이터의 경우, 단순히 "미국 정부"나 "노동부"가 아니라 데이터를 생산한 구체적인 기관(예: 노동통계국)을 사용하세요.

7. 동적 데이터에 검색일을 포함하지 않기

주가, 날씨 데이터, 정기적으로 업데이트되는 통계처럼 시간에 따라 변하는 데이터에는 특정 값에 언제 접근했는지 기록하기 위해 검색일을 포함하세요.

빠른 참조 가이드

데이터 세트 인용에 필요한 필수 요소:

  1. 데이터를 제작 또는 수집한 저자(들) 또는 조직
  2. 출판 연도(지속적으로 업데이트되는 데이터는 "n.d.")
  3. 이탤릭체와 문장체 대문자 표기법으로 쓴 데이터 세트 제목
  4. 괄호 안 버전 번호(해당하는 경우)
  5. 대괄호 안 [Data set] 또는 유사한 설명어
  6. 저장소 또는 출판사명
  7. 검색일(동적 데이터에만 해당)
  8. DOI 또는 URL

데이터 유형 설명어

  • [Data set]: 일반 연구 데이터
  • [Database]: 여러 테이블을 가진 구조화된 데이터베이스
  • [Statistical data]: 통계 데이터 세트
  • [Survey data]: 설문조사 응답 및 결과
  • [Genomic data]: DNA, RNA, 단백질 서열
  • [Geospatial data]: 지리 또는 공간 데이터
  • [Time series data]: 시계열 측정값
  • [Image data]: 분석용 이미지 모음

일반적인 데이터 저장소

  • figshare: 일반 연구 데이터 저장소
  • Dryad: 과학·의학 연구 데이터
  • Dataverse: 사회과학 및 학제간 데이터
  • ICPSR: 사회·행동과학 데이터
  • GenBank/GEO: 유전체 및 생물학 데이터
  • Zenodo: 유럽 연구 데이터 저장소
  • OSF: Open Science Framework 데이터 공유
  • GitHub: 코드와 데이터 버전 관리

데이터 인용 모범 사례

직접 수집한 데이터 사용하기

연구를 위해 직접 데이터를 수집했다면 참고문헌 목록에 자신을 인용할 필요는 없습니다. 대신 방법 섹션에서 데이터 수집 방법을 설명하세요. 다른 사람들이 인용할 수 있도록 저장소에 데이터를 기탁하는 것을 고려해 보세요.

대규모 데이터 세트의 일부 인용하기

대규모 데이터 세트의 일부를 사용할 때는 전체 데이터 세트를 인용하고 본문에서 어떤 부분집합을 사용했는지 설명하세요. 해당 부분집합에 자체 DOI가 없는 한 별도의 인용을 만들지 마세요.

같은 데이터의 여러 버전

시간에 걸쳐 데이터 세트의 여러 버전을 사용했다면, 각 버전을 그 특정 버전 번호와 접근일과 함께 별도로 인용하세요.

독점적이거나 제한된 데이터

접근이 제한된 데이터는 평소대로 인용하되 본문에 접근 제한 사항을 명시하세요. 해당하는 경우 독자가 어떻게 접근을 요청할 수 있는지 설명하세요.

데이터 세트 정보 찾기

다음 출처에서 인용 세부 정보를 찾으세요:

  • 데이터 저장소 랜딩 페이지: 제목, 저자, 버전, DOI
  • README 파일: 흔히 적절한 인용 형식이 포함되어 있음
  • 데이터 세트 문서: 데이터 수집과 버전에 관한 메타데이터
  • "Cite this dataset" 버튼: 많은 저장소가 서식이 갖춰진 인용을 제공함
  • 데이터 논문: 일부 데이터 세트에는 관련 출판물이 있음
  • 저장소 메타데이터: 데이터 세트에 관한 구조화된 정보

보충 데이터와 주 데이터 세트

학술지 논문의 보충 데이터

학술지 논문의 보충 데이터 파일을 사용하는 경우, 해당 논문을 인용하고 보충 자료임을 명시하세요:

Smith, J. (2024). Climate patterns analysis. Journal of Climate, 37(2), 123–145. https://doi.org/10.xxxx [Supplementary data files]

독립형 데이터 세트

자체 DOI와 저장소 항목을 가진 독립적인 데이터 세트는 관련 출판물과는 별도로 인용됩니다.

완벽한 데이터 세트 인용 만들기

데이터 인용에는 DOI, 버전 번호, 저장소명 같은 특정 요소가 필요합니다. 무료 APA 인용 생성기는 연구 데이터, 정부 통계, 설문조사 데이터 등 모든 유형의 데이터 세트 서식을 지정합니다. 정확한 인용을 적절한 출처 표기와 함께 즉시 얻으세요.

자주 묻는 질문

데이터 세트와 그것을 설명하는 논문 중 어느 것을 인용해야 하나요?
실제 데이터를 사용했다면 데이터 세트를 인용하세요. 연구 결과나 방법론을 논의하는 경우라면 논문을 인용하세요. 대개는 둘 다 인용하게 됩니다. 논문은 맥락과 방법을 위해, 데이터 세트는 그것을 재분석했기 때문입니다.
정부 웹사이트에서 다운로드한 데이터는 어떻게 인용하나요?
정부 기관을 저자로 인용하고, 데이터 세트명을 포함하고, [Data set]으로 표시하고, URL을 제공하세요. 버전이나 업데이트 정보가 있으면 포함하세요.
데이터 세트에 공식 제목이 없으면 어떻게 하나요?
이탤릭체와 문장체 대문자 표기법을 사용해 데이터를 명확히 식별하는 설명적인 제목을 만드세요. 예: Daily temperature measurements from weather stations in California, 2010-2020.
파일 형식(.csv, .xlsx)을 포함해야 하나요?
아니요. [Data set] 설명어로 충분합니다. 파일 형식은 기술적인 세부 사항으로 인용에 포함되지 않습니다.
동일한 설문조사의 여러 연도 데이터는 어떻게 인용하나요?
별도의 데이터 발표라면 각 연도를 개별적으로 인용하세요. 여러 연도를 결합했다면 방법 섹션에서 접근 방식을 설명하고 사용한 시리즈나 각 연도를 인용하세요.
인용 정보를 모두 찾을 수 없으면 어떻게 하나요?
찾을 수 있는 만큼의 정보를 포함하세요. 최소한 데이터 제작자·출처, 대략적인 날짜, 설명적인 제목, 접근 URL을 제공하세요.

관련 가이드