Kodowanie danych jakościowych krok po kroku

Kodowanie danych jakościowych krok po kroku, DobrzeNapisane.pl

Przeprowadziłeś dwanaście wywiadów, masz sto stron transkrypcji i teraz siedzisz nad tym z poczuciem, że utoniesz. Od czego zacząć? Jak z gadającej ściany tekstu zrobić rozdział z wynikami, który będzie czymś więcej niż streszczeniem, kto co powiedział? Tu wchodzi kodowanie, czyli serce analizy jakościowej. To moment, w którym wielu studentów panikuje, bo nikt im nie pokazał, że to uporządkowany proces, a nie magia ani zgadywanka.

Prawda o kodowaniu jest taka, że to najzwyklejsza w świecie robota porządkowa, tyle że na znaczeniach zamiast na liczbach. Przechodzisz przez materiał fragment po fragmencie i nadajesz kawałkom tekstu etykiety, które mówią, o czym ten kawałek jest. Z setek takich etykiet wyłaniają się powtarzające się wątki, a z wątków wnioski, które wpisujesz do pracy. Nie musisz być socjologiem z dziesięcioletnim stażem. Musisz znać kolejność kroków i trzymać się jej konsekwentnie.

W tym przewodniku przejdziemy całą drogę od surowej transkrypcji do gotowego opisu w metodologii. Zaczniemy od tego, czym kodowanie właściwie jest i po co się je robi. Potem omówię trzy poziomy kodowania, czyli kody otwarte, osiowe i selektywne. Pokażę, jak zacząć w programach MAXQDA i Atlas.ti, jak przejść od kodów do kategorii i wniosków, jak zadbać o rzetelność przez zgodność sędziów i, na koniec, jak cały ten proces opisać w rozdziale metodologicznym, żeby obronił się przed komisją.

Czym jest kodowanie i po co

Zacznijmy od podstaw, bo bez nich reszta wisi w powietrzu. Kodowanie danych jakościowych to przypisywanie etykiet do fragmentów materiału, na przykład do zdań w wywiadzie, akapitów w dokumencie czy wypowiedzi z grupy fokusowej. Każda etykieta, czyli kod, w skrócie mówi, o czym dany fragment jest. Robisz to po to, żeby z chaosu surowego tekstu wydobyć powtarzające się znaczenia i móc o nich powiedzieć coś sensownego.

Wyobraź sobie sto stron transkrypcji z wywiadów o doświadczeniu pracy zdalnej. Bez kodowania zostajesz ze stertą zdań, w której nic nie widać. Kodowanie nakłada na ten materiał siatkę. Fragment, w którym rozmówca mówi o braku kontaktu z zespołem, oznaczasz kodem „izolacja”. Inny, o pracy w piżamie do południa, kodem „rozmycie granic”. Gdy przejdziesz tak cały materiał, nagle widzisz, że kod „izolacja” pojawił się u dziewięciu na dwunastu rozmówców. To już nie jest wrażenie, to obserwacja oparta na danych.

Kodowanie to nie streszczanie wywiadów. To wydobywanie z nich powtarzających się wzorców, których nie widać gołym okiem.

Po co to robić, skoro można po prostu opisać, co ludzie mówili? Bo opis bez kodowania jest niewiarygodny i nie do obronienia. Gdy piszesz, że „rozmówcy często wspominali o izolacji”, komisja ma prawo zapytać, na jakiej podstawie. Kodowanie daje Ci odpowiedź: pokazujesz, w ilu wywiadach i w ilu miejscach ten wątek wystąpił. Zamieniasz wrażenie w systematyczną analizę, którą da się prześledzić krok po kroku. To różnica między pracą naukową a felietonem.

Kody otwarte, osiowe, selektywne

Kodowanie nie jest jednorazowym ruchem, tylko procesem, który przechodzi przez kolejne poziomy. W podejściu wywodzącym się z teorii ugruntowanej mówi się o trzech etapach: kodowaniu otwartym, osiowym i selektywnym. Każdy zagęszcza i porządkuje materiał bardziej niż poprzedni. Przejdźmy je po kolei, bo to szkielet całej analizy.

Pierwszy etap to kodowanie otwarte. Idziesz przez materiał fragment po fragmencie i nadajesz kody wszystkiemu, co wydaje się istotne, bez wcześniejszego planu. Na tym etapie kodów jest dużo, bywa że kilkadziesiąt albo więcej, i to normalne. Nie filtrujesz jeszcze, nie oceniasz, które są ważniejsze. Twoim zadaniem jest pokryć materiał etykietami i wyłapać wszystko, co się w nim pojawia. To etap rozbioru, w którym tekst rozpada się na kawałki znaczeń.

Drugi etap to kodowanie osiowe. Masz już górę kodów otwartych i zaczynasz szukać między nimi powiązań. Które kody mówią o tym samym? Które łączą się w większe wątki? Kody „izolacja”, „brak rozmów przy kawie” i „samotność w domu” składasz w jedną kategorię, na przykład „osłabienie więzi społecznych”. Na tym etapie z luźnych etykiet budujesz kategorie nadrzędne, czyli grupy kodów połączone wspólnym tematem. Materiał zaczyna się układać w strukturę.

Trzeci etap to kodowanie selektywne. Tu wybierasz kategorię albo kilka kategorii, które są sercem Twoich wyników, i wokół nich budujesz spójną opowieść odpowiadającą na pytanie badawcze. To etap, na którym z mozaiki kategorii wyłania się główny wątek pracy, na przykład że praca zdalna poprawia komfort, ale kosztem więzi i granic między życiem a pracą. Selektywne kodowanie scala wszystko w wniosek, który da się zapisać jednym, mocnym zdaniem. Nie każda praca magisterska schodzi tak głęboko, ale warto wiedzieć, że taka droga istnieje, bo pokazuje, dokąd zmierza cały proces.

MAXQDA i Atlas.ti, jak zacząć

Można kodować ręcznie, na wydrukach z kolorowymi zakreślaczami, i przy małym materiale to się broni. Ale gdy masz kilkanaście wywiadów, ręczne pilnowanie kodów zamienia się w koszmar. Tu wchodzą programy do analizy danych jakościowych, z których najpopularniejsze to MAXQDA i Atlas.ti. Oba robią w gruncie rzeczy to samo, różnią się szczegółami interfejsu, więc opiszę wspólną logikę, a nie każdy przycisk.

Praca w obu programach zaczyna się od zaimportowania materiału. Wrzucasz transkrypcje wywiadów, dokumenty, czasem nagrania, do projektu w programie. Od tej chwili masz wszystko w jednym miejscu, a program pamięta, co skąd pochodzi. To już samo w sobie porządkuje pracę, bo nie szukasz po dziesięciu plikach na dysku. Cały materiał i wszystkie kody siedzą w jednym projekcie, do którego wracasz.

Sam mechanizm kodowania jest banalnie prosty i identyczny w obu narzędziach. Zaznaczasz fragment tekstu i przypisujesz mu kod, czyli wybierasz istniejącą etykietę z listy albo tworzysz nową. Program zapamiętuje, że ten konkretny kawałek wywiadu numer trzy jest oznaczony kodem „izolacja”. Robisz tak przez cały materiał, a lista kodów rośnie z boku ekranu. W każdej chwili widzisz, ile kodów masz i ile razy każdy wystąpił.

Tu pojawia się przewaga programów nad papierem, czyli wyszukiwanie i zestawianie. Jednym kliknięciem wyświetlasz wszystkie fragmenty oznaczone danym kodem, ze wszystkich wywiadów naraz. Chcesz zobaczyć każde miejsce, gdzie pojawiła się „izolacja”? Klikasz kod i masz listę dwudziestu cytatów z różnych rozmów. Możesz też sprawdzać, które kody współwystępują, liczyć ich częstość i budować z nich kategorie. To właśnie ta funkcja zamienia kupę tekstu w analizę, której nie ogarniesz zakreślaczem. Na start nie musisz znać wszystkich możliwości. Wystarczy, że zaimportujesz materiał, nauczysz się kodować fragmenty i wyświetlać cytaty danego kodu. Reszta dojdzie w praktyce.

Potrzebujesz pomocy z pracą dyplomową?

Wyślij fragment tekstu, bezpłatną wycenę otrzymasz w 24 h. Poprawki bez limitu w cenie usługi.

Wyślij do wyceny

Od kodów do kategorii i wniosków

Samo nałożenie kodów to dopiero surowiec. Wielu studentów zatrzymuje się na tym etapie i wkleja do pracy listę pięćdziesięciu kodów z liczbą wystąpień, myśląc, że to wyniki. To nie są wyniki, to półprodukt. Prawdziwa analiza zaczyna się, gdy z kodów budujesz kategorie, a z kategorii wnioski. Pokażę, jak przejść tę drogę, bo to ona decyduje o jakości rozdziału.

Pierwszy ruch to grupowanie kodów w kategorie. Patrzysz na swoją listę kodów i szukasz tych, które mówią o pokrewnych rzeczach. Kody „brak rozmów z zespołem”, „samotność”, „tęsknota za biurem” łączysz w jedną kategorię „osłabienie więzi”. Kody „praca w piżamie”, „sprawdzanie maili wieczorem”, „brak rytmu dnia” w kategorię „rozmycie granic”. Z kilkudziesięciu drobnych etykiet robi Ci się kilka większych kategorii, które porządkują cały materiał. To dokładnie ten ruch, który w teorii ugruntowanej nazywa się kodowaniem osiowym.

Drugi ruch to przejście od kategorii do wniosków, czyli do odpowiedzi na pytanie badawcze. Sama kategoria „osłabienie więzi” to nadal opis, nie wniosek. Wniosek powstaje, gdy mówisz, co z tej kategorii wynika i jak ma się do Twojego pytania. Na przykład: praca zdalna, choć ceniona za komfort, systematycznie osłabia więzi z zespołem, co rozmówcy odbierają jako główny koszt tego modelu. To już jest twierdzenie, które niesie treść i które poprzesz cytatami z wywiadów.

Cytaty są tu nie do pominięcia, bo to one łączą Twój wniosek z surowym materiałem. Każdą kategorię i każdy wniosek ilustrujesz fragmentami wypowiedzi, które najlepiej go oddają. Czytelnik widzi wtedy, że nie wymyśliłeś kategorii, tylko wyrosła ona z danych. Dobieraj cytaty trafne, nie najdłuższe, i podpisuj je tak, by było jasne, z którego wywiadu pochodzą, rzecz jasna z zachowaniem anonimowości rozmówców. Wniosek bez cytatu jest gołosłowny, cytat bez wniosku jest niemy.

Rzetelność kodowania (zgodność sędziów)

Tu dochodzimy do pytania, które prędzej czy później zada promotor albo recenzent: skąd wiadomo, że Twoje kodowanie nie jest po prostu Twoją prywatną interpretacją? Analiza jakościowa bywa oskarżana o subiektywność, więc musisz pokazać, że Twoje kody są na tyle jasne i powtarzalne, że ktoś inny zakodowałby ten sam materiał podobnie. Temu służy rzetelność kodowania, najczęściej sprawdzana przez zgodność sędziów.

Idea jest prosta. Bierzesz część materiału, na przykład dwa albo trzy wywiady, i dajesz je do niezależnego zakodowania drugiej osobie, czyli drugiemu sędziemu, według tego samego klucza kodowego co Twój. Potem porównujecie, w ilu miejscach przypisaliście te same kody do tych samych fragmentów. Im większa zgodność między sędziami, tym mocniejszy dowód, że Twoje kody są jednoznaczne, a nie zależą od tego, kto akurat patrzy na tekst. Wysoka zgodność uwiarygadnia całą analizę.

Żeby to miało sens, potrzebujesz klucza kodowego, czyli spisanej listy kodów wraz z definicją każdego z nich. Drugi sędzia musi wiedzieć, co dokładnie oznacza kod „izolacja” i czym różni się od „rozmycia granic”, inaczej porównanie jest bezwartościowe. Klucz kodowy to nie biurokracja, to warunek powtarzalności. Przy okazji zmusza Cię do doprecyzowania własnych kodów, bo definiując je dla kogoś innego, wyłapujesz, które były mętne. Sam proces pisania klucza poprawia jakość kodowania.

Zgodność sędziów wyraża się liczbą, a w pracach często podaje się ją jako współczynnik, na przykład kappa Cohena, który koryguje zgodność o przypadek. Nie musisz w to wchodzić głęboko na poziomie pracy magisterskiej, ale warto wiedzieć, że taki wskaźnik istnieje i że sama procedura, czyli niezależne kodowanie przez drugą osobę i porównanie wyników, jest tym, co podnosi wiarygodność. Gdy w metodologii napiszesz, że sprawdziłeś zgodność sędziów, pokazujesz komisji, że potraktowałeś rzetelność poważnie. To robi różnicę przy ocenie.

Jak opisać proces w metodologii

Cała Twoja praca przy kodowaniu pójdzie na marne, jeśli nie opiszesz jej porządnie w rozdziale metodologicznym. Komisja nie siedziała przy Tobie, gdy kodowałeś, więc jedyne, co widzi, to Twój opis procedury. Słaby opis sprawia, że nawet solidna analiza wygląda na chaotyczną. Dobry opis pokazuje, że wiedziałeś, co robisz. Zobaczmy, co taki opis musi zawierać.

Po pierwsze, opisz materiał i sposób jego przygotowania. Ile wywiadów, jak długich, jak transkrybowanych, jak zanonimizowanych. Czytelnik musi wiedzieć, na czym właściwie pracowałeś, zanim przejdziesz do tego, jak to kodowałeś. Po drugie, nazwij podejście analityczne, czyli powiedz wprost, że stosowałeś na przykład kodowanie w duchu teorii ugruntowanej z etapami otwartym, osiowym i selektywnym, albo inną przyjętą metodę. To zakotwicza Twoją pracę w konkretnej tradycji metodologicznej, a nie zawiesza ją w próżni.

Po trzecie, opisz narzędzie i przebieg kodowania. Napisz, w jakim programie pracowałeś, na przykład MAXQDA albo Atlas.ti, i jak wyglądał proces: od kodowania otwartego, przez grupowanie kodów w kategorie, po wyłonienie głównych wątków. Nie musisz opisywać każdego kliknięcia, ale czytelnik powinien móc prześledzić logikę, jak z surowych transkrypcji powstały kategorie. Po czwarte, wspomnij o rzetelności, czyli o sprawdzeniu zgodności sędziów i o kluczu kodowym, jeśli je stosowałeś. To ten fragment, który uprzedza pytanie o subiektywność.

Metodologia to nie opowieść o tym, jak Ci poszło. To instrukcja, dzięki której ktoś inny mógłby powtórzyć Twoją analizę.

Najważniejsza zasada na koniec: opis metodologii musi być na tyle dokładny, żeby ktoś inny mógł zrozumieć i z grubsza odtworzyć Twoją procedurę. To kryterium, które stosuje komisja. Jeśli z Twojego opisu nie da się odczytać, jak doszedłeś od stu stron tekstu do pięciu kategorii, opis jest za słaby, choćby sama analiza była dobra. Pisz konkretnie, podawaj etapy, nazywaj metody i narzędzia. Rozdział metodologiczny, który czyta się jak przepis, a nie jak wspomnienie, to oznaka dojrzałej pracy.

Najczęstsze błędy

  • Mylenie kodowania ze streszczaniem wywiadów i opisywanie, kto co powiedział, zamiast szukania wzorców
  • Zatrzymanie się na liście kodów i wklejenie jej do pracy jako rzekomych wyników
  • Brak przejścia od kodów do kategorii, a od kategorii do wniosków odpowiadających na pytanie badawcze
  • Formułowanie wniosków bez poparcia ich cytatami z materiału
  • Pominięcie sprawdzenia rzetelności i wystawienie się na zarzut subiektywności analizy
  • Brak spisanego klucza kodowego, przez co kody są mętne i niepowtarzalne
  • Kodowanie kilkunastu wywiadów ręcznie na wydrukach, gdy program zrobiłby to porządniej
  • Zbyt ogólnikowy opis procedury w metodologii, z którego nie da się odtworzyć analizy
  • Dobieranie do wniosków najdłuższych cytatów zamiast najtrafniejszych

FAQ

Czym jest kodowanie danych jakościowych?

To przypisywanie etykiet, czyli kodów, do fragmentów materiału jakościowego, na przykład do wypowiedzi z wywiadów czy akapitów dokumentów. Każdy kod w skrócie mówi, o czym dany fragment jest. Robisz to, żeby z surowego tekstu wydobyć powtarzające się wątki i zamienić wrażenia w systematyczną analizę. Z kodów budujesz potem kategorie, a z kategorii wnioski, które wpisujesz do rozdziału z wynikami.

Czym różnią się kody otwarte, osiowe i selektywne?

To trzy etapy kodowania w teorii ugruntowanej. Kodowanie otwarte to nadawanie kodów wszystkiemu, co istotne, bez planu, więc kodów jest dużo. Kodowanie osiowe to łączenie pokrewnych kodów w większe kategorie. Kodowanie selektywne to wybór głównej kategorii i zbudowanie wokół niej spójnej odpowiedzi na pytanie badawcze. Każdy etap porządkuje materiał bardziej niż poprzedni, od rozbioru tekstu po wniosek.

Czy muszę używać MAXQDA albo Atlas.ti?

Nie musisz, ale przy większym materiale programy bardzo ułatwiają pracę. Przy kilku krótkich wywiadach kodowanie ręczne na wydrukach się broni. Przy kilkunastu wywiadach MAXQDA albo Atlas.ti dają porządek, szybkie wyświetlanie wszystkich cytatów danego kodu i liczenie częstości, czego na papierze nie ogarniesz. Oba działają na tej samej zasadzie, czyli zaznaczasz fragment i przypisujesz mu kod, a różnią się głównie szczegółami interfejsu.

Jak sprawdzić rzetelność kodowania?

Najczęściej przez zgodność sędziów. Dajesz część materiału do niezależnego zakodowania drugiej osobie według tego samego klucza kodowego, a potem porównujecie, w ilu miejscach przypisaliście te same kody. Wysoka zgodność dowodzi, że Twoje kody są jednoznaczne i nie zależą od tego, kto patrzy na tekst. Wymaga to spisanego klucza kodowego z definicją każdego kodu. W pracy zgodność podaje się czasem jako współczynnik, na przykład kappa Cohena.

Podsumowanie

Kodowanie danych jakościowych przestaje przerażać, gdy zobaczysz w nim uporządkowany proces, a nie magię. Najpierw nakładasz kody na materiał, od kodowania otwartego, przez osiowe, po selektywne. Potem grupujesz kody w kategorie, a z kategorii wyciągasz wnioski poparte cytatami. Dbasz o rzetelność przez zgodność sędziów i spisany klucz kodowy, a na koniec opisujesz całą procedurę w metodologii na tyle dokładnie, żeby dało się ją odtworzyć. Kodowanie to nie streszczanie wywiadów, tylko wydobywanie z nich wzorców, których nie widać gołym okiem.

Program zakoduje materiał razem z Tobą, ale nie sprawdzi, czy rozdział metodologiczny i opis wyników są napisane poprawnym, zrozumiałym językiem i czy terminologia jest spójna od początku do końca. To zostaje po stronie redaktora. W ramach korekty pracy magisterskiej wychwycę niezręczne sformułowania, błędy w opisie procedury i niespójności terminologiczne, a przy okazji zwrócę uwagę, gdy opis kodowania brzmi mętnie albo dwuznacznie. Wyślij gotowy rozdział albo całą pracę do bezpłatnej wyceny, a dostaniesz konkretny termin, najczęściej z korektą w 24 godziny.

Natalia Witek-Dąbrowska
Natalia Witek-Dąbrowska
Redaktorka i korektorka z 20-letnim doświadczeniem

Specjalizuję się w korekcie prac naukowych i dyplomowych. Jeśli potrzebujesz pomocy z tekstem, napisz do mnie.

Przeczytaj również

Wyślij tekst, wycenię go za darmo

Natalia Witek-Dąbrowska, redaktorka, bezpłatna wycena korekty
Wystarczy, że prześlesz fragment tekstu lub całą pracę, a ja odezwę się z wyceną najszybciej jak mogę, zwykle tego samego dnia.
Natalia Witek-Dąbrowska Redaktorka i korektorka, 20+ lat z tekstem
Poprawki bez limitu
Realizacja nawet w 24 h
Faktura
Pełna poufność

Wypełnij formularz

Przeciągnij plik lub kliknij, aby wybrać .doc, .docx, .pdf, .odt, .rtf

Twoje dane są bezpieczne. Odpowiem osobiście.