선행연구를 정독한 후에 워드 프로세스로 감상문을 기록하는 것은 매우 비효율적인 정리 방식입니다. 이에 대한 대안으로서 논문의 주요 항목을 스프레드시트의 단일 행(row)에 정리하는 방식을 소개합니다. 자료를 구조화하면 수십 편에 달하는 문헌을 종단 축(열 기준)을 따라 대조할 수 있습니다. 이를 통해 선행연구들끼리 합의한 정설과 때로는 서로 어긋나고 있는 연구의 결과, 그리고 연구자가 탐색할만한 가치가 있는 연구 공백(research gap)이 자연스럽게 드러납니다.
이 글의 순서 8개 항목
수십 편의 논문을 읽은 대학원생이라도 “분명히 다 읽었는데 머릿속에 남은 것이 하나도 없고, 내 논문의 이론적 배경을 첫 줄부터 어떻게 시작해야 할지 막막하다”라고 호소합니다.
이 문제는 문헌고찰 과정에서 문헌을 정리하는 형식에서 비롯됩니다. 경험이 많지 않은 연구자들은 간혹 논문을 한 편 읽을 때마다 워드 프로세서나 노트에 한두 문단씩 서술형으로 요약을 남깁니다. 그런데 첫 번째 논문 요약에는 분석 방법을 적고, 두 번째 논문 요약에는 표본의 크기를 기술하며, 세 번째 논문 요약에는 자신이 느낀 바를 작성합니다. 항목이 제각각인 서술형 요약 30개는 서로 대조할 수 없는 파편화된 기록에 불과합니다.
‘제2장. 이론적 배경’을 집필한다는 것은 논문 A, B, C를 병렬적으로 나열하는 독후감 쓰기가 아닙니다. “A, B, C를 포함하는 다수의 연구에서는 모두 X가 Y에 정(+)의 영향을 미치는 것으로 관찰되고 있으나, 특수 집단인 Z를 대상으로 이 관계를 확인한 연구는 그 사례가 없다“와 같이 연구자의 통찰력이 담겨있는 학술적인 문장으로 만들어 내야 합니다.
연구자에게 필요한 종합적인 통찰은 수십 편의 논문을 동일한 규격으로 정렬해서 나란히 비교할 때에 비로소 가능해집니다. 그 비교의 목적을 가능하게 하는 효과적인 도구가 문헌 정리 매트릭스(literature review matrix)입니다.
연재글 순서
- 학술 데이터베이스의 지도: 선행연구의 논문은 어디에서 어떻게 찾아야 하는가
- 검색어 설계의 기술: 학술 문헌 검색을 위한 검색식(search query) 설계와 키워드 조합의 전략
- 검색의 확장: 한 편의 키페이퍼(key paper)에서 수십 편의 선행연구로 시야를 넓히는 추적 기법
- 핵심문헌의 선별 전략: 방대한 선행연구에서 옥석을 가려내는 스크리닝 기법
- 논문을 읽는 순서: 수백 편의 문헌을 읽지 않고 파악하는 발췌독(拔萃讀)의 기술
- 문헌분석 매트릭스: 방대한 선행연구에서 연구 공백(Research Gap)을 찾아내는 분석 도구
- 서지관리 프로그램: 수백 편의 논문을 관리하는 도구
- 참고문헌 목록의 작성과 검증: 서식의 일관성과 본문-목록 1:1 대응 프로토콜
- 문헌고찰의 업데이트: 최신 선행연구의 관리와 심사 대비를 위한 전략
서술형 요약이 학술적 글쓰기를 망치는 이유
선행문헌의 주요 내용을 서술의 형태로 요약하면 원문에서 이미 등장하는 문장의 서술 흐름에 수동적으로 종속되는 현상이 불가피하게 나타납니다. 서론이 장황한 논문은 요약해야 하는 분량이 과도하게 늘어나고, 통계 분석에 많은 비중을 차지하는 논문을 요약하는 과정에서는 수식과 분석 절차에 대한 기록이 비대해지기 마련입니다.
이처럼 파편화된 서술식 요약은 다음의 취약점을 가지고 있습니다.
- 비교 대조의 불가능성: 선행연구 A에서는 연구 대상을 기록하였으나 선행연구 B에서 그 항목을 누락하였다면, A vs. B를 비교하는 과정에서 “선행연구들이 어떤 표본 집단을 다루었는가?”라는 질문에는 답을 하기가 어렵습니다.
- 원문 복제에 따른 연구윤리 위반의 위험: 서술형 요약으로 접근하다 보면 연구자도 모르는 무의식중에 원문의 문장 구조를 복사해서 그대로 옮겨 적는 유혹에 노출되기 쉽습니다. 이는 추후에 연구자 본인의 학위논문을 집필하는 과정에서 원문 텍스트가 섞이게 되어 표절 시비를 만들 수 있습니다.
- 인지적 과부하와 비효율성: 수십 페이지의 분량으로 서술형 요약을 만드는 작업은 원문을 다시 독해하는 것과 다를 바가 없을 만큼의 상당한 부담과 시간의 손실을 수반합니다.
문헌 분석 매트릭스는 위의 모든 문제를 표준화된 형식으로 통제할 수 있습니다. 매트릭스라고 하는 고정된 서식을 만든다면 연구자는 매트릭스의 각 영역(cell)에 키워드 중심의 정제된 정보만을 선별해서 기입하면 됩니다. 이를 통해 불필요한 수식을 걷어내고 연구의 요점만을 간결하게 요약할 수 있는 역량을 강화할 수 있습니다.
문헌 분석 매트릭스를 구성하는 여섯 가지 기본 열(column)
스프레드시트 프로그램(예., Microsoft Excel)을 실행해서 첫 번째 행에 다음 여섯 가지 범주의 열(colum) 머리글을 입력합니다. 이 여섯 개 열에 기록된 내용은 앞으로 학위논문의 서론과 연구의 방법, 연구의 결과, 논의 챕터를 집필할 때 학술적인 근거로 활용됩니다.
표 1. 문헌 분석 매트릭스
| 엑셀 열(Column) 구분 | 기입해야 하는 구체적인 내용 | 논문을 집필할 때의 쓰임새 |
|---|---|---|
| ① 서지정보 | 저자명(출판연도), 짧은 제목 | 본문 인용(예., 홍길동, 2024) 및 참고문헌 목록 작성용 |
| ② 연구 대상 | 표본의 특징(예., 직업, 연령대) 및 표본의 크기(N) | 내 연구 대상의 차별성을 주장하거나 표본의 크기 설정에 관한 근거로 활용 |
|
③ 변수와 측정도구 |
독립/종속/매개/조절변수명 및 측정도구의 원본 출처 | [가장 중요] 내 논문의 설문지를 설계할 때 출처를 입증 |
| ④ 연구방법론 | 양적/질적 연구 여부, 분석 기법(예., 회귀분석, SEM, 분산분석 등) | 내가 특정한 통계 기법을 선택한 방법론적인 정당성을 부여 |
| ⑤ 연구의 결과 | A가 B에 정/부 영향, 유의/기각 여부 (숫자 배제, 결론만) | 연구가설 설계를 뒷받침하는 학술적인 근거와 방향성(+) 제시 |
|
⑥ 연구의 한계 및 후속 연구 방향 |
저자가 논의 챕터의 마지막에서 기술한 연구의 한계점과 후속 연구 제언 | 내 연구의 필요성과 연구 공백(Gap)을 공격할 무기 |
연구의 특성이나 분석 목적에 따라 세부 열 항목을 탄력적으로 조정할 수도 있습니다. 예를 들어서, 척도 개발 연구의 경우에는 ‘설문 문항의 수’ 항목을 별도로 구성하고, 질적 연구라면 ‘심층 인터뷰 소요 시간’ 항목으로 보완하는 방식이 가능합니다. 다만 전체 열의 수는 8개를 초과하지 않도록 관리하는 것이 바람직합니다. 매트릭스가 지나치게 확장되면 정보를 한눈에 확인하기 어렵기 때문입니다. 아울러, 작성해야 하는 항목이 과도하게 늘어남에 따라 연구자의 심리적인 부담이 늘어나게 되어 문헌고찰의 과정을 지연시키는 부작용을 초래할 수 있습니다.
문헌 분석 매트릭스의 설계를 위한 패러프레이징(paraphrasing) 원칙
문헌 분석 매트릭스의 기본 서식을 완성했다면, 다음의 세 가지 작성 원칙을 준수하면서 각 셀(cell)에 내용을 기입해야 합니다.
- 문헌 독해와 동시에 실시간으로 기입: 논문을 완독한 후에는 기억에 의존해서 매트릭스를 한꺼번에 완성하려고 한다면 정보의 왜곡을 발생시킬 수 있습니다. 논문의 초록과 연구방법론을 살펴보는 과정에서 실시간으로 스프레드시트의 해당 셀을 완성하고, 다음의 문헌으로 이동해야 합니다.
- 원문 복제를 지양하고 연구자 고유의 언어로 축약: 예를 들어서, “본 연구의 결과를 통하여, 직무스트레스의 수준은 종사자의 이직의도 수준을 증가시키는 것으로 나타났다”와 같은 원문에서의 문장을 매트릭스에 그대로 옮겨 적어서는 안됩니다. 해당 셀에는 “직무스트레스 → 이직의도 (+ 유의)”와 같이 연구자가 식별할 수 있는 부호나 압축된 개념어로 간결하게 정리해야 합니다. 이는 자료의 가독성을 높일 뿐만 아니라, 앞으로의 학위논문 집필 과정에서 발생할 수 있는 표절의 위험을 사전에 차단할 수 있습니다.
- 확인되지 않은 정보는 공란으로 유지: 만약 어떤 논문에 신뢰도 값이 누락되어 연구의 한계점이 등장하지 않는다면, 연구자가 임의로 추정하지 말고 셀을 빈칸으로 남겨두어야 합니다. 매트릭스의 세로축 정보를 살펴보았을 때 특정한 열이 내용들이 공란으로 되어 있다면, 그 현상 자체가 “선행연구들이 측정 도구의 신뢰도 검증의 측면에서는 상대적으로 취약하다”라는 논거를 뒷받침하는 근거로 사용할 수 있습니다.
표 2. ‘직무스트레스가 이직의도에 미치는 영향에 관한 선행연구 매트릭스 완성의 예
| 서지정보 | 연구 대상 | 연구의 내용 | 연구의 결과 | 연구의 한계 |
|---|---|---|---|---|
| 김ㅇㅇ(2022) |
제조업 근로자 (N=312) |
직무스트레스 → 이직의도 | 정(+)의 영향 (유의) | 서비스 직종을 대상으로 하는 후속 연구가 필요 |
| 이ㅇㅇ(2023) |
종합병원 간호사 (N=268) |
직무스트레스 → 이직의도 | 정(+)의 영향 (유의) | 스트레스 완화 변수 (조절효과) 미검증 |
| 박ㅇㅇ(2024) |
일반 공무원 (N=405) |
직무스트레스 → 직무만족 → 이직의도 | 부분 매개 (유의) | 횡적 연구의 한계 |
세로 읽기(종람, 縱覽): 매트릭스에서 ‘연구의 공백’을 식별하는 원리
스프레드시트(excel) 표에서 20-30행, 즉 선행연구 20-30편의 내용이 채워지면 논문 한편 단위의 횡단(행) 독해를 더이상은 해서는 안되고, 열(column)을 기준으로 접근하는 세로 분석으로 전환해야 합니다. 세로축을 따라 정보를 일괄적으로 대조하면 아래와 같은 학술적인 통찰을 직관적으로 얻을 수 있습니다.
학술적 합의(consensus)의 확인 [연구의 결과] 열을 세로축을 따라 내려 읽었을 때 20편 가운데 18편에서 “직무스트레스 → 이직의도 (+)”라는 결과가 일관적으로 나타나고 있다면, 이는 이론적 배경을 서술하는 탄탄한 논거로 활용할 수 있습니다. 즉, “다수의 선행연구(김ㅇㅇ, 2022; 이ㅇㅇ, 2023; 박ㅇㅇ, 2024 등)에서 직무스트레스가 이직의도의 수준을 높이는 주요한 선행 변수라는 점이 반복적으로 확인되었다”와 같이 서술할 수 있습니다. 이를 바탕으로 연구가설을 설계하는 과정에서 문헌적인 근거를 확보하게 됩니다.
상반된 결과(inconsistency)의 발견 [연구의 결과] 열을 확인하는 과정에서 문헌 A는 정(+)의 영향, 문헌 B는 부(-)의 영향, 문헌 C는 유의하지 않은 영향(기각)으로 나타났다면, 연구의 결과 내에서 뚜렷한 어긋남을 확인할 수 있습니다. 경우에 따라서는 이것을 조절변수를 도입하는데 근거로 사용하기도 합니다. 예를 들어서 “선행연구들에서 나타나는 연구의 결과는 그 패턴이 서로 일치하지 않는 것으로 평가되고 있다. 이는 두 변수 사이의 인과관계에 영향을 미치는 조절변수(moderator)가 작용하고 있을 가능성을 시사한다. 이에 따라 본 연구는 상사의 지지를 조절변수로 투입하여…”로 서술함으로써 연구모형을 정교하게 설계하는 데 필요한 논리로 사용할 수 있습니다.
연구 공백(research gap)의 규명 [연구 대상] 열과 [연구의 한계] 열을 세로 축으로 분석하면, 표본 집단의 대다수가 제조업 종사자, 간호사, 일반 사무직에 편중되어 있고 다수의 저자가 “특수한 직군을 대상으로 하는 연구의 필요성”을 후속연구로 남겨 두었음을 확인할 수 있습니다. 이를 통해 ‘연구 공백’을 식별함므로써 연구의 차별성과 기여도를 확보하게 됩니다. 즉, “직무스트레스에 관련한 기존의 연구는 민간 기업의 종사자나 보건의료 인력에 국한되어 수행되었다. 반면, 고도의 감정노동과 재난 현장의 압박에 노출되는 소방공무원을 대상으로 수행한 연구의 사례는 아직 관찰되고 있지 않다. 따라서 본 연구는 500명의 소방공부원을 대상으로 …”와 같이 연구의 필요성과 당위성을 역설하면서 서론에서의 문제 제기를 완성할 수 있습니다.
50편 이상의 문헌 관리를 위한 변수별 시트(sheet) 분할 전략
분석 대상의 문헌 수가 50편을 넘기면서 단일 시트(sheet)가 과도하게 확장되면 정보의 가독성이 떨어집니다. 이때에는 스프레드시트(excel) 아래의 탭(tab)을 구분해서 매트릭스를 관리해야 합니다.
가장 적절한 분할 기준은 연구모형을 구성하는 주요 변수입니다. 예를 들어서, 연구모형의 구조가 [직무스트레스 → 조직몰입 → 이직의도]로 설계되었다면, ‘시트 1’은 ‘직무스트레스’, ‘시트 2’는 ‘조직몰입’, 그리고 ‘시트 3’은 ‘이직의도’로 각각 지정합니다. 이후에 각 변수를 중심으로 다루는 문헌들을 해당 시트로 분류해서 배치합니다. 만약, 하나의 문헌이 복수의 변수를 동시에 다루고 있다면 해당되는 여러 시트에 중복으로 기재해도 무방합니다.
변수에 따라 시트를 분할해서 운용하면 여러가지 이점을 확보할 수 있는데, 특히 학위논문 제2장 [이론적 배경]에서의 절(clause) 목차와 개별 시트(sheet)의 명칭이 1:1로 정확하게 매칭이 되기 때문입니다.
| 가상 사례: 교육학 석사과정 학생의 문헌 분석 매트릭스 활용을 통한 연구가설의 설계 교육학을 전공하는 석사과정 학생 A씨는 ‘초임 교사의 직무소진과 이직의도’를 다룬 40편의 선행논문을 확보하였습니다. 그리고 문서 편집기(Microsoft Word) 파일에 논문 1편당 반페이지의 분량으로 서술형 요약을 작성하였습니다. 총 20페이지에 이르는 요약본을 완성한 후에 A씨는 의욕적으로 ‘제2장. 이론적 배경’을 작성하기 시작하였습니다. 하지만 첫 문장에서부터 어떠한 방향으로 전개해야 할지를 몰랐습니다. A씨는 기존의 서술형 요약 방식을 탈피하고, 스프레드시트(Microsoft Excel) 프로그램에 6개 열(저자/연구의 대상/측정 변수/분석 방법/연구의 결과/연구의 한계)로 이루어진 문헌분석 매트릭스를 구성하였습니다. 아울러 이미 독해한 40편의 요약 내용을 부호와 간결한 개념어로 압축해서 매트릭스의 각 셀에 기입하였습니다. 적지 않은 시간이 소요되는 작업이었으나, 40개의 행으로 구조화된 분석 매트릭스를 완성할 수 있었습니다. A씨가 매트릭스에서 [연구의 결과] 열을 기준으로 세로축을 따라 내려 읽으며 살펴본 결과, “초임 교사의 직무소진이 이직의도를 강화한다”라고 밝혀진 연구 결과가 25편의 선행문헌에서 반복적으로 나타난 것을 확인할 수 있었습니다. 한편 [연구의 한계] 열을 분석한 후에, 7편의 선행연구에서 공통적으로 “직무소진에 의한 부정적인 영향을 완충할 수 있는 ‘학교 관리자의 진정성 리더십’에 관한 후속 연구가 요구된다”라는 후속의 연구방향을 기술한 것으로 식별되었습니다. A씨는 문헌분석 매트릭스를 분석한 결과를 바탕으로 학교 관리자의 진정성 리더십을 조절변수로 투입함으로써 연구모형을 고도화하였습니다. 또한 서론을 작성하는 과정에서는 매트릭스를 통해 포착한 여러가지 학술적인 통찰을 다음과 같이 압축한 문장으로 기술하였습니다. “직무소진과 이직의도 간의 관계는 다수의 선행연구에서 반복적으로 평가가 이루어져 왔다(김ㅇㅇ, 2022; 박ㅇㅇ 외, 2023 등). 그러나 직무스트레스가 미치는 부정적인 영향을 완충할 수 있는 관리적 차원의 변수을 탐색하는 노력은 미진한 것으로 나타나고 있다.” 이는 문헌분석 매트릭스를 통해 연구가설의 구조를 발전시키고 연구 필요성의 당위성을 뒷받침한 사례입니다. (본 사례는 교육학 석사학위 논문 컨설팅 수행 경험을 바탕으로 재구성한 가상의 시나리오입니다.) |
자주 묻는 질문 (FAQ)
Q. 서지 관리 소프트웨어(예., Endnote, Mendeley 등)를 활용하고 있음에도 스프레드시트 문헌 분석 매트릭스를 별도로 만들어야 하나요?
A. 두 도구는 기능과 목적의 측면에서 뚜렷하게 구별됩니다. Endnote, Mendeley와 같은 서지 관리 프로그램은 참고문헌(references) 목록을 학술지 양식(예., APA style)에 맞추어 자동으로 생성하고, 본문 내에서의 인용 표기를 지원하는 서지 출판용 도구라는 특징을 가집니다. 이들 프로그램도 메모 기능을 제공하고 있으나, 많은 문헌들에서의 연구 대상, 측정 변수, 연구 결과를 스프레드시트와 같은 2차원 격자 구조를 통해 한눈에 대조하기에는 어렵습니다. 서식 관리는 서지 관리 프로그램에 일임하더라도, 연구자의 비판적인 사고와 논증의 설계에 도움을 주는 문헌 분석 테이블을 별도로 구축하는 것이 좋습니다.
Q. 해외 문헌을 정리할 때에도 테이블의 셀에 영문 원문을 그대로 기입해야 하나요?
A. 국문으로 번역하여 압축된 형태로 기입하는 것이 바람직합니다. 문헌 분석 매트릭스는 대외적으로 공유하기 위한 목적이 아니라, 연구자 본인이 학위논문을 집필할 때 활용할 수 있는 기초 자료로 사용합니다. 영문 원문을 셀에 그대로 복사하여 붙여넣기를 하면 텍스트 분량이 과도하게 늘어나 가독성이 안좋아지고, 더욱이 국문의 논문을 작성하는 과정에서 번역을 다시 해야 합니다. 따라서 문헌을 독해하는 과정에서 내용을 그 즉시 국문으로 패러프레이징을 하고 주요 개념어를 중심으로 기록하는 것이 바람직합니다.
Q. 문헌 분석 매트릭스를 가공해서 학위논문의 ‘제2장 이론적 배경’의 말미에 ‘선행연구 요약표’ 형태로 수록해도 무방한가요?
A. 적극적으로 권장되는 바람직한 기술 방식입니다. 직접 제작한 문헌 분석 매트릭스에서 이론적으로 연계성이 높은 10-15편의 선행연구를 행(row)에서 선별한 후, 정돈된 테이블의 양식으로 변환해서 학위논문 본문에 기술할 수 있습니다.
Q. 여러 변수를 다루고 있고, 그리고 연구의 결과가 방대한 문헌이라면, 매트릭스의 셀 안에는 어떠한 방법으로 내용을 압축해야 하나요?
A. 연구자 본인의 연구모형, 그리고 연구가설 설계와 관련성이 깊은 2-3개의 변수만을 선별해야 합니다. 연구자의 연구와는 전혀 무관한 변수들은 원저자의 연구 맥락에서는 의미가 있을지 모르나, 본 연구의 분석 준거에서는 불필요한 정보입니다. 따라서 연구 목적에 부합하지 않는 부차적인 정보는 과감하게 배제하고 본 연구와 관련된 변수만을 기입해야 합니다.
Q. 다수의 선행문헌에서 동일한 연구 대상과 연구결과가 중복되어 나타난다면, 이를 매트릭스에 반복해서 기재하는 작업이 실효성을 가지나요?
A. 가장 가치 있는 학술적인 성과입니다. 중복으로 기재된 다수의 행(row)은 해당 학문 분야에서 이미 확고한 지지를 얻은 정설(orthodoxy)을 입증할 수 있는 객관적인 지표가 됩니다. 연구자는 이를 바탕으로 서론과 이론적 배경에서 “다수의 선행연구를 통해 변수 A와 변수 B의 인과관계가 반복적으로 검증되어 왔다”라고 주장할 수 있는 근거를 확보하게 됩니다. 따라서 정보의 중복을 지양할 필요가 전혀 없으며, 반복적으로 관찰되는 연구결과를 확인하는 것이 분석 매트릭스를 설계하는 이유이기도 합니다.
결론
선행문헌을 분석하는 과정에서 각각의 문헌을 서술형으로 요약하면 문헌 상호 간의 비교가 어려워집니다. 학위논문의 ‘제2장 이론적 배경’에 기술해야 하는 내용은 “다수의 선행연구에서 동일한 결과가 반복하여 나타났다“라거나 “특정한 집단을 대상으로 그 관계를 확인한 사례가 관찰되지 않는다“와 같이, 복수의 문헌을 종합해서 논증하는 성격을 띄어야 합니다. 문헌 분석 매트릭스를 활용하면 그와 같은 서술을 원활하게 전개할 수 있습니다. 표의 세로축(열 기준)을 따라 여러 문헌을 한눈에 비교하고 분석할 수 있기 때문입니다.
문헌 분석 매트릭스는 저자와 연도, 연구 대상, 변수, 연구의 방법, 연구 결과, 연구의 한계점이라는 여섯 가지 기본 열을 축으로 구성합니다. 각 항목은 문헌을 독해하는 과정에서 그 즉시 기입하고, 이때 연구자는 세 가지 원칙을 준수해야 합니다. 즉, 연구자 고유의 언어로 패러프레이징하여 기록하고, 셀에는 한두 문장 내외로 간결하게 압축하며, 문헌에 명시되지 않은 정보는 임의로 추정하지 않고 공란으로 유지하는 것입니다. 나아가 분석 대상의 문헌 수가 50편이 넘어간다면 매트릭스를 주요 변수별 시트(sheet)로 분할해서 관리하는 방식이 효과적입니다.