문헌 검색은 연구자 간의 인용 연계망을 추적하는 문헌고찰 과정입니다. 핵심 논문(key paper)의 참고문헌을 추적해서 열람하고 해당 논문을 인용한 후속 연구를 함께 추적함으로써, 연구 주제와 관련된 학술계통과 연구 동향의 흐름을 파악할 수 있습니다.
이 글의 순서 7개 항목
연구자가 다양한 키워드를 조합하여 학술 데이터베이스를 다각도로 탐색하더라도, 당면한 연구 목적에 엄밀히 부합하는 유관 문헌을 검색하지 못하는 한계에 부딪히는 경우가 빈번하게 발생합니다. 이러한 상황에서는 해당 연구 분야의 논의를 집약하고 있는 키페이퍼를 확보하는 전략이 유효한 대안이 됩니다. 키페이퍼의 참고문헌 목록에는 다루고자 하는 연구 주제와 밀접하게 맞닿아 있는 주요 선행연구들이 망라되어 있습니다. 연구자가 이를 체계적으로 추적해 나간다면 키워드 검색 과정에서 누락되었던 가치 있는 문헌군을 발굴할 수 있습니다.
키워드 검색만으로 연구 목적에 부합하는 선행문헌을 검색하기 어려운 원인은, 연구자가 설정한 검색 질의어와 원저자가 사용한 학술 용어 간의 어휘적 불일치에서 비롯됩니다. 연구자의 검색어와 저자의 서술 용어가 지시하는 본질이 완전히 동일할지라도, 표기된 문자열이 형태적으로 일치하지 않는 한 학술 데이터베이스는 해당 문헌을 유효한 검색 결과로 노출하지 못합니다. 이는 대다수 학술 데이터베이스의 검색 메커니즘이 의미론적인 맥락을 추론하기보다는, 입력된 질의어와 문헌 텍스트 간의 기계적인, 또는 문자적인 일치의 여부만을 대조하여 결과를 노출하는 체계에 기초하고 있기 때문입니다.
따라서 키워드 검색이 한계에 직면했을 때에는, 다수의 검색어를 기계적으로 반복 입력하기보다는 문헌 추적 기법(snowballing)으로 탐색 전략을 전환하는 것이 바람직합니다. 문헌 추적 기법은 이미 확보한 키페이퍼를 출발점으로 삼아 학술 지식의 인용 연계망(citation network)을 체계적으로 탐색하는 방법론입니다. 즉, 키페이퍼가 준거로 삼은 과거의 원천(seminal) 선행문헌을 소급해서 확인하는 것과 동시에, 해당 논문을 학술적으로 계승하고 인용한 후속 연구들을 추적해 나감으로써 연구 주제와 직결된 유사한 문헌군을 확보할 수 있습니다.
키워드 검색 방식의 한계
검색어로 문헌을 탐색하는 방식은 입력한 검색어와 논문 본문의 텍스트가 서로 일치하는지를 대조하며 작동합니다. 그러나 이 방식은 크게 두 가지 상황에서 한계를 드러냅니다. 첫째는 여러 학문 분야가 융합되면서 동일하거나 유사한 대상을 전공 영역에 따라 서로 다른 명칭으로 부르는 경우이며, 둘째는 시간의 흐름에 따라 학술적인 개념의 명칭이 진화하는 경우입니다.
예를 들어서, ‘직장 내 괴롭힘’이라는 동일한 현상을 두고 경영학에서는 ‘직장 내 따돌림(workplace ostracism)’으로 명명하고, 간호학에서는 ‘태움 또는 무례 행위(incivility)’로 지칭하며, 심리학에서는 ‘집단 괴롭힘(mobbing)’으로 표현하기도 합니다. 또한 과거에 ‘감정노동’으로 통칭하던 개념이 최근에 와서는 ‘감정 부조화’와 같이 한층 세분화된 학술 용어로 사용되기도 합니다.
따라서 연구자가 자신의 전공 분야에서 주로 쓰이는 익숙한 용어만으로 검색한다면, 인접한 학문 분야의 연구 성과나 과거로부터 축적되어 온 선행 문헌이 검색 대상에서 누락될 수 있습니다.
이때 문헌 추적은 문자적인 일치에 의존하는 키워드 검색의 한계를 보완하는 접근입니다. 데이터베이스 키워드 검색이 기계적 대조를 위한 알고리즘에 의존하는 방식이라면, 문헌 추적은 관련 분야의 전문가들이 이미 검증하고 선별한 문헌 목록을 탐색하는 방식입니다. 따라서 연구자는 전문가의 학술적인 판단을 거친 핵심 문헌들을 참고문헌 목록에서 직접 확인하고 확보할 수 있습니다.
어떤 논문을 추적의 출발점(seed paper)으로 삼아야 하는가?
문헌 추적의 성패는 키페이퍼의 선정과 확보에 달려 있습니다. 기준 문헌을 제대로 선정하지 못한다면 연구 목적과 는 전혀 무관한 엉뚱한 논문을 수집할 위험이 있습니다. 효과적인 문헌 확장을 위해 기준으로 삼아야 할 키페이퍼가 되기 위한 조건은 다음과 같습니다.
- 가설 구조의 유사성이 높은 최신 논문: 연구자가 설정한 독립변수, 종속변수, 연구 대상 중에서 최소한 두 가지 이상을 다루고 있는 문헌입니다.
- 피인용 횟수가 많은 고전적인 핵심 논문: 학술 데이터베이스(예., Google Scholar 등)에서 많은 피인용 횟수를 나타내는 문헌입니다. 인용 빈도가 많은 논문은 해당하는 학문 분야에서 이론적인 토대를 정립하였거나 측정 도구를 최초로 설계한 원전일 가능성이 높습니다. 따라서 해당 논문을 인용한 후속 연구를 추적하는 것만으로도 관련 분야의 전반적인 연구 흐름을 파악할 수 있습니다.
- 체계적 문헌고찰(systematic review)과 메타분석(meta-analysis)으로 접근한 논문: 선행 연구들을 종합적으로 수집하고 분석한 총설 논문(review paper)입니다. 이들 논문에서 등장하는 참고문헌 목록은 해당 분야의 주요한 연구 성과를 망라하기 때문에, 연구자의 주제와 관련한 학술적인 지형을 파악할 수 있는 가이드라인으로 활용할 수 있습니다.
위의 세 가지 조건을 충족하는 논문을 기준별로 한 편씩, 총 2-3편 정도 확보하는 것이 좋습니다. 다만 키페이퍼의 초록(abstract)만을 확보하는 데에 그쳐서는 안 됩니다. 문헌 추적을 효과적으로 하기 위해서는 반드시 원문(full-text)을 확보하고 논문에 수록된 참고문헌 목록을 면밀히 확인해야 합니다.
시간의 양방향 추적: 스노우볼링(snowballing) 기법
키페이퍼를 확보한 후에는 시간의 흐름을 기준으로 과거와 미래의 두 방향에서 문헌을 동시에 추적해야 합니다. 즉, 키페이퍼가 인용한 과거의 선행연구를 추적하고, 해당 논문을 인용한 이후의 후속 연구를 함께 탐색하는 양방향 추적을 의미합니다.
표. 스노우볼링(Snowballing) 추적 방식 비교: 거슬러 올라가는 추적 vs. 훑어 내려오는 추적
| 추적의 방향 | 거슬러 올라가는 추적 (Backward Snowballing) | 훑어 내려오는 추적 (Forward Snowballing) |
|---|---|---|
| 추적 대상 | 핵심 논문이 과거에 인용한 선행 문헌들 | 핵심 논문이 출판된 후, 이를 인용한 후속 문헌들 |
| 시간의 흐름 | 핵심 논문의 출판 연도보다 이전(과거) | 핵심 논문의 출판 연도보다 이후 |
| 정보의 진원지 | 핵심 논문 맨 뒤의 ‘참고문헌 (References)’ 목록 | 구글 스칼라, KCI, Scopus 등의 ‘피인용(cited by)’ 링크 |
| 학술적 획득물 | 변수 개념의 최초 정의, 측정도구(설문지)의 원형, 핵심 이론의 뿌리 발굴 | 해당 주제의 가장 최신 학술 동향, 파생된 변수, 후속 연구의 한계점 및 연구 공백의 파악 |
[후방 추적: Backward Snowballing]
과거 선행연구를 추적하는 작업(후방 추적)은 연구의 이론적 배경을 견고하게 구축하기 위한 기초 단계입니다. 구체적으로는 키페이퍼의 본문을 검토하는 과정에서 특정한 개념의 정의가 인용된 구절(예., “A는 ~로 정의된다(Smith, 2010)”)을 확인하고, 논문 말미의 참고문헌 목록에서 해당 문헌(Smith, 2010)의 서지 정보를 찾아 원문을 확보합니다. 이 과정을 반복한다면 연구에서 다루어지는 변수들이 어떤 학술적인 계보를 거쳐 발전해 왔는지를 알 수 있습니다.
[전방 추적: Forward Snowballing]
후속 연구를 추적하는 작업(전방 추적)은 연구의 시의성과 독창성을 확보하기 위한 과정입니다. 예를 들어, 2018년에 발표된 키페이퍼 A를 구글 스칼라에서 검색한 뒤에 하단의 피인용 링크를 확인하면, 발표 시점부터 현재까지 논문 A를 인용한 후속 문헌 목록을 확인할 수 있습니다. 연구자는 이 목록을 분석함으로써 자신이 구상한 연구 가설이 이미 선행연구에서 검증되었는지, 혹은 학계에서 아직 다루지 않은 연구 공백(research gap)에 해당하는지를 판단할 수 있습니다.
과거의 선행연구와 미래 후속 연구를 아우르는 양방향 문헌 추적은 반드시 병행되어야 합니다. 과거 방향의 추적에만 의존한다면 최신의 연구 동향과 학술적인 시의성을 반영하기 어렵고, 미래 방향의 추적에만 치중한다면 연구의 이론적인 토대와 개념적인 기원이 취약해질 수 있기 때문입니다.
문헌 연계망의 구축을 위한 보조 탐색 경로
양방향 문헌 추적 기법 외에도 선행연구 연계망을 확장할 수 있는 유용한 보조 경로들이 존재합니다. 다음의 세 가지 경로를 병행하여 활용하면 문헌 탐색의 범위를 한층 효과적으로 넓힐 수 있습니다.
- 저자 추적(author tracking): 논문을 읽다 보면 자신의 연구 주제와 매우 유사한 논문을 집필한 학자를 발견하게 됩니다. 이들은 대부분 수년 동안에 걸쳐 해당 세부 전공을 연구해 온 전문가입니다. 학술 데이터베이스에서 그 저자의 이름을 클릭하면, 그가 과거에 발표했거나 동료 학자들과 공저로 참여한 수십 편의 논문을 쉽게 확보할 수 있습니다. 다만 동명이인의 가능성을 고려하여 저자의 소속 기관을 함께 확인해야 합니다.
- 우수한 학위논문 추적(thesis tracking): 일반적으로 석사·박사 학위논문은 50-100편에 달하는 선행연구를 인용합니다. 따라서 연구 주제와의 관련성이 높은 선행 학위논문의 참고문헌 목록을 문헌 탐색의 기초 지침으로 유용하게 활용할 수 있습니다.
- AI/DB 추천 기능(recommendation algorithms): 최근 RISS, Scopus, ResearchGate 등의 주요 학술 플랫폼은 ‘유사 문헌(related articles)’이나 ‘함께 많이 읽은 문헌’과 같은 추천 기능을 제공합니다. 연구자는 이 기능을 활용하여 기존의 키워드 검색에서 누락되었던 관련 선행연구를 효과적으로 발굴할 수 있습니다.
문헌 수집을 종료해야 하는 ‘이론적 포화(Theoretical Saturation)’의 신호
인용 관계를 추적하다 보면 수집한 문헌이 증가하고, 이에 따라서 다루어야 하는 분석 범위를 통제하기가 어려워집니다. 따라서 적절한 시점에 문헌 탐색을 종료하고 논문 집필 단계로 전환해야 합니다. 문헌 수집의 종료 기준을 알리는 ‘이론적 포화 상태(theoretical saturation)’는 다음의 세 가지 신호로 판단할 수 있습니다.
1. 선행연구와 참고문헌의 중복 확인: 열람한 키페이퍼에 등장하는 참고문헌이나 피인용 목록에서 이미 확보한 논문들과 주요 저자가 반복해서 나타나는 상태입니다. 이 현상은 키페이퍼를 대부분 확보하였다는 것을 의미합니다. 일반적으로 30-50편의 키페이퍼를 열람하는 과정에서 인용의 중복 현상을 관찰할 수 있습니다.
2. 연구 범위의 이탈과 주제의 발산: 확보하는 문헌들이 연구자가 원하는 연구주제나 가설의 범위에서 벗어나는 상태입니다. 예를 들어서, ‘직무 소진’을 탐색하는 과정에서 ‘임상 치료법’이나 ‘관련 법률 개정안’과 같이 인접 분야에서의 연구 주제로 확장된다면, 문헌 확장을 중단하고 원래의 연구 범위로 진입해야 합니다.
3. 근거 문헌의 충족: 연구모형을 구성하는 모든 변수(독립-종속-매개-조절변수)의 개념적인 정의와 변수들 사이의 관계를 뒷받침하는 문헌적인 근거를 모두 확보한 상태입니다. 각 변수의 개념을 정의하는 주요 이론을 다루는 문헌과 변수들 간의 인과관계를 설명하는 연구 문헌이 체계적으로 정리되었다면 탐색의 목적을 달성한 것으로 판단할 수 있습니다.
| 가상사례: 양방향 문헌 추적 기법 행정학 석사과정에 재학 중인 A씨는 ‘공무원 집단의 조직 침묵(Organizational Silence)이 혁신 행동에 미치는 영향’을 연구 주제로 선정하였습니다. 그리고 관련한 선행연구를 찾기 위해 학술연구정보서비스(RISS)에 접속해서 검색을 시작하였습니다. 하지만 키워드 검색을 통해서 확보한 문헌의 수는 12편에 그쳤습니다. 다양한 검색어 조합을 시도했음에도 뚜렷한 개선 결과를 얻을 수 없었습니다. A씨는 키워드 검색을 중단하고 문헌확보를 위한 다른 전략에 나섰습니다. 구체적으로, 이미 확보한 12편의 문헌 중에서 피인용 횟수가 가장 많고 등급이 가장 높은 논문 1편을 키페이퍼로 선정하였습니다. 그리고 참고문헌 추적을 통해 키페이퍼에서의 이론적 배경 챕터가 인용한 문헌과 참고문헌 목록을 조사하였습니다. 그 결과, 행정학 분야에서는 ‘조직 침묵’ 외에도 ‘발언 행동(voice behavior)의 결여’, ‘방관적 침묵(defensive silence)’ 등의 여러 유사어가 학계에서 통용되고 있음을 알 수 있었습니다. A씨는 이들 용어를 키워드로 검색해서 주요 원문들을 확보하였습니다. 이와 함께, 피인용 추적을 통해 최근의 연구에서는 조직 침묵이라는 개념이 하위 세대에 속한 공무원의 특성이나 진성 리더십(authentic leadership)과 같은 조절변수로 연계되어 확장되고 있음을 확인할 수 있었습니다. A씨는 양방향 문헌 추적을 통해 처음의 12편에서 이후에는 50여 편의 문헌을 확보할 수 있었습니다. 이후에는 이론적 포화 상태에 도달한 것으로 판단한 후에 문헌 탐색을 종료하고 논문의 집필에 착수하였습니다. (본 내용은 행정학 논문컨설팅의 실무 경험을 바탕으로 재구성한 가상의 시나리오입니다.) |
자주 묻는 질문 (FAQ)
Q. 체계적 문헌고찰(systematic literature review) 또는 메타분석(meta-analysis)으로 접근한 최근에 출판된 논문을 어떻게 검색해야 하나요?
A. 학술 데이터베이스의 검색 창의 ‘주제어’를 입력하는 곳에 ‘메타분석’ 또는 ‘체계적 문헌고찰’을 불리언 연산자와 결합하여 검색식을 구성하면 됩니다. 그리고 학술 데이터베이스의 검색창에는 다음의 키워드 수식을 입력합니다.
(주제어) AND (“메타분석” OR “체계적 문헌고찰” OR “meta-analysis” OR “systematic review” OR “literature review”)
Q. 타인의 학위논문에 수록된 참고문헌 목록을 원문도 확인하지 않고 자신의 논문에 그대로 인용한다면, 논문심사 위원이 이를 식별할 수 있을까요?
A. 심사 과정에서 쉽게 식별될 수 있으며, 연구 윤리 위반에 해당합니다. 선행 연구의 참고문헌 목록을 문헌 탐색의 기초 자료로 활용하는 것은 물론 적절한 접근입니다. 그러나 원문을 직접 열람하지 않고 선행 연구의 서술과 서지 정보를 그대로 전재하는 행위는 재인용 표기를 누락한 연구 부정행위에 해당합니다.
Q. 구글 스칼라(Google Scholar)의 ‘피인용(cited by)’ 검색 결과가 지나치게 많은 경우에는 문헌을 어떻게 선별해야 하나요?
A. ‘피인용 문서 내 검색(search within citing articles)’ 기능을 사용해서 검색 범위를 좁힐 수 있습니다. 해당 옵션을 선택한 후에, 주요 변수(예., 독립-종속-조절변수)나 구체적인 연구 대상(예., ‘간호사’, ‘직장인’)을 추가 검색어로 입력합니다. 이 조건 검색을 적용하면 키페이퍼를 인용한 후속 논문 중에서 연구주제와 직접 연관된 선행연구만을 선별할 수 있습니다.
Q. 반드시 확보해야 하는 참고문헌의 적정 편수가 정해져 있나요? 그리고 참고문헌의 양적인 규모가 논문의 질적 수준을 결정하나요?
A. 참고문헌이 충족해야 하는 분량에는 공식적으로 규정된 기준이나 상/하한선이 존재하지 않습니다. 인문학과 같이 문헌에 대한 심도있는 텍스트 분석이 중심이 되는 학문 분야에서는 100편 이상을 인용하기도 합니다. 하지만, 일반적인 사회과학 연구(석사과정 기준)에서는 30~60편 내외로 참고문헌을 구성합니다.
논문에서 드러나는 학술적인 가치는 참고문헌의 수량으로 결정되지 않습니다. 서론과 이론적 배경에서 연구 가설과 변수들 사이의 인과관계를 얼마나 논리적이고 타당한 문헌으로 뒷받침하는가에 따라 결정됩니다. 아울러, 형식적인 분량을 채우기 위해 연구자가 원문을 직접 열람하지 않은 문헌을 무리하게 포함한다면, 논문의 심사 과정에서 내용 숙지에 관한 질의에서 심각한 지적을 받을 수 있습니다.
Q. 선행연구 추적 과정에서 특정한 개념이나 이론을 최초로 제안한 1970년대에 출판된 고전 문헌을 찾았습니다. 하지만 출판 시점이 오래되었더라도 반드시 인용해야 하나요?
A. 원칙적으로 반드시 인용해야 합니다. 문헌을 인용할 때에는 이론적인 기원과 최근에 발표된 실증 기반의 연구를 구분하여 배치하는 접근이 필요합니다. 예를 들어서, 변수에 관한 개념을 최초로 정의하거나 중요한 이론적 프레임워크(예., 계획된 행동이론, 기술수용모델)을 원용할 때에는 출판연도와는 무관하게 반드시 원문을 인용해야 합니다. 이는 학술적인 개념의 기원을 규명하고 연구의 이론적인 토대를 세우기 위함입니다. 반면, 변수들 사이의 인과관계나 현상의 실태를 주장하기 위해서는 최근 3-5년 이내에 출판된 문헌을 함께 인용해야 합니다. 즉, 핵심 개념과 기본 이론을 제시할 때에는 원문을 인용해서 정당화하고, 구체적인 연구가설과 변수 간의 관계를 주장할 때에는 시의성(timeliness)을 가지는 최신 문헌으로 뒷받침하는 이원화된 인용 방식으로 접근하는 것이 좋습니다.
결론
키워드 기반 검색(keyword-based search)은 연구자가 입력한 질의어와 문헌 텍스트 간의 표면적, 문자적인 일치 여부를 대조하는 방식에 기반합니다. 학술 데이터베이스는 특정 단어가 개별 논문의 제목, 주제어, 초록 등에 명시적으로 포함되어 있는지를 기계적으로 판별하여 결과를 노출하므로, 동일한 본질적인 개념을 상이한 학술 용어나 동의어로 다룬 유관 선행연구를 검색하지 못한다는 한계를 가집니다.
이러한 구조적 제약은 여러 학문 영역 교차하는 다학제적 융합 연구 영역이거나, 시대적 흐름에 따라 학술적 개념어가 통시적으로 변천해 온 주제일수록 더욱 두드러지게 나타납니다. 문헌 추적 기법은 이러한 키워드 검색의 맹점을 효과적으로 보완하는 방법론입니다. 선행 연구자들이 참고문헌을 통해 축적해 둔 지식의 인용 연계망(citation network)을 매개로 유관 문헌군을 체계적으로 추적하고 확장해 나가는 방식을 취합니다.
문헌 추적의 출발점이자 기준점이 되는 키페이퍼는 연구 주제와의 관련성, 학계에서 축적된 높은 피인용 횟수, 그리고 최근에 발표된 문헌고찰 여부라는 세 가지 준거에 따라 선별합니다. 이 세 기준을 동시에 충족하는 단일 문헌을 특정하기 어려운 경우에는, 각각의 요건을 나누어 충족하는 두세 편의 논문을 상호보완적으로 조합하여 활용하는 전략을 취할 수 있습니다. 아울러 키페이퍼는 수록된 참고문헌 목록뿐만 아니라 본문에서 선행연구가 인용된 구체적인 논증의 맥락까지를 대조해야 하므로, 연구자는 반드시 해당 논문의 전문을 확보해야 합니다.
문헌 추적은 시간의 축에 따라 과거와 미래라는 두 가지 방향으로 전개됩니다. 먼저 참고문헌 목록을 과거로 소급하여 탐색하는 후방 추적을 활용하면, 핵심 개념의 이론적인 정초와 주요 측정 도구가 비롯된 원천 문헌(seminal paper)에 도달할 수 있습니다. 이와 함께 해당 논문을 인용한 후속 연구들을 확인하는 전방 추적을 체계적으로 수행하면, 최신의 연구 동향과 당면한 학술 분야의 지식 공백을 규명할 수 있습니다. 이들 두 방식은 상호보완적인 성격을 가지며, 따라서 연구자는 이를 반드시 병행해야 합니다. 만약 후방 추적에만 의존한다면 시의성이 저하된 과거의 고전 문헌에 편중될 우려가 있으며, 반대로 전방 추적에만 치우치게 되면 이론적인 기원과 역사적 형성 맥락을 간과할 위험이 따르기 때문입니다.
이 밖에도 해당 분야를 견인해 온 핵심 연구자나 권위 있는 학술지를 중심으로 문헌을 탐색하는 방식, 유관 학위논문의 참고문헌 목록을 검토하는 방안, 학술 데이터베이스가 제공하는 알고리즘 기반의 추천 기능 등도 보조적인 탐색 경로로 활용할 수 있습니다. 특히 선행 학위논문의 참고문헌 목록은 다루고자 하는 연구 주제의 전반적인 학술지형을 파악하는 데 훌륭한 길잡이가 됩니다. 다만 연구자는 선행연구에 수록된 서지 정보를 그대로 옮겨 적는 기계적인 재인용을 지양해야 하며, 반드시 개별 문헌의 원문을 직접 확보해서 논증의 맥락을 면밀히 대조한 후에 인용해야 합니다.
문헌 확장을 종결하는 시점은 크게 세 가지 신호를 바탕으로 판단합니다. 첫째, 새롭게 탐색한 논문의 참고문헌 목록에서 이미 확보한 주요 저자 및 핵심 문헌이 지속적으로 중복되어 출현할 때입니다. 둘째, 탐색 과정에서 수집되는 문헌들이 당초 설정한 연구가설이나 본래의 연구 범주를 점차 벗어나기 시작할 때입니다. 셋째, 연구모형에 포함된 모든 변인 간의 관계를 이론적, 실증적으로 뒷받침할 수 있는 핵심 근거 문헌을 체계적으로 완비했을 때입니다. 이 가운데 첫 번째 신호는 해당 분야의 논의가 ‘이론적 포화’ 상태에 도달했는지를 판별하는 가장 결정적인 척도입니다. 통상적으로 연구 주제와 직결된 30-50편 내외의 키페이퍼를 검토하는 단계에 이르면, 유관 문헌군이 순환하며 중복되는 현상이 뚜렷하게 관찰되기 시작합니다.