Wiele informacji przekazywanych w trakcie rozmów ma znaczenie przede wszystkim w chwili, gdy padają dokładnie sprecyzowane słowa. Prędzej czy później pamięć uczestników może być niepełna, a ponowne odsłuchiwanie długiego pliku na prawdę często utrudnia szybkie odnalezienie potrzebnego fragmentu. Z tego powodu przygotowywana jest transkrypcja nagrań, czyli przeniesienie treści wypowiadanej w materiale audio albo wideo do formy pisemnej.
W współzależności od rodzaju nagrania zapis może dotyczyć jednej osoby lub wieloosobowej rozmowy, a trudność pracy zmienia się wraz z jakością dźwięku. Zupełnie inaczej wygląda materiał z wyraźną wymową i jednym rozmówcą, a przeciwnie spotkanie, w trakcie którego głosy nakładają się na siebie. Znaczenie mają także pauzy, urwane zdania, powtórzenia i fragmenty wypowiadane niewyraźnie (źródło: transkrypcja do sądu cennik). W takich przypadkach nie powinno się w sposób automatyczny zastępować niezrozumiałych słów własną interpretacją, ponieważ nawet niewielka zmiana może wpłynąć na sens całej wypowiedzi.
Szczególnego znaczenia nabiera zapis materiału, który ma zostać zastosowany w sprawie formalnej. Transkrypcja do sądu powinna być przygotowywana z uwzględnieniem charakteru nagrania oraz celu, któremu ma służyć dokument. Istotne może być dokładne wskazanie rozmówców, zachowanie kolejności wypowiedzi a także możliwość odnalezienia konkretnego miejsca w materiale źródłowym. Przy dłuższych nagraniach pomocne są oznaczenia czasu, ponieważ pozwalają sprawdzić, z jakiego fragmentu pochodzi dana część zapisu. Nie za każdym razem właściwe jest też poprawianie języka osób mówiących. Wypowiedzi ustne różnią się od tekstu pisanego, dlatego występują w nich usterki, powtórzenia czy zdania rozpoczęte i niedokończone. Ich nadmierne wygładzanie może spowodować, że dokument przestanie wiernie przedstawiać przebieg rozmowy. Sposób opracowania powinien zatem wynikać z tego, czego wymaga dokładnie określone użycie materiału.
W praktyce na prawdę dużo czasu może zająć nie samo wpisywanie słów, lecz rozstrzyganie miejsc problematycznych. Użyteczny stenogram nie powinien opierać się na zgadywaniu, gdy nagranie nie daje możliwość dobitnie ustalić wypowiedzi. Szum uliczny, odgłosy urządzeń, rozmowy prowadzone w tle czy duża odległość od mikrofonu umieją sprawić, że pojedyncze frazę staje się skomplikowane do rozpoznania. Jeszcze większym wyzwaniem są sytuacje, w których rozmówcy mówią równocześnie. Wówczas konieczne może być wielokrotne odsłuchanie krótkiego fragmentu i zestawienie go z kontekstem całej rozmowy. Kontekst pomaga zrozumieć wypowiedź, niemniej jednak nie powinien być traktowany jako podstawa do dopisywania treści, której rzeczywiście nie słychać. W dokumentach o charakterze formalnym szczególnie ważne jest rozdzielenie tego, co wynika bezpośrednio z nagrania, od tego, co mogłoby być jedynie domysłem osoby wykonującej zapis.
Znaczenie ma też sposób przygotowania materiału przed rozpoczęciem pracy. Oryginalne nagranie powinno pozostać dostępne, ponieważ zapis tekstowy nie zastępuje źródła i w razie potrzeby może wymagać porównania z konkretnym fragmentem audio albo wideo. Przydatne okazuje się również zachowanie jednolitego sposobu oznaczania osób, czasu a także fragmentów, których nie można ze starannością odczytać. W sytuacji kilku godzin materiału warto zwracać uwagę na ciągłość zapisu, ponieważ zmiana oznaczenia jednego rozmówcy może w przyszłości utrudnić interpretację całego dokumentu. Ważna jest też jakość samego pliku. Kompresja, bardzo cichy dźwięk albo nagranie wykonane z dużej odległości mogą ograniczać dokładność zapisu niezależnie od sposobu jego opracowania. Dlatego przy ocenie gotowego dokumentu powinno się brać pod uwagę nie tylko formę tekstu, lecz także możliwości i ograniczenia materiału, z którego został on sporządzony.
Sprawdź również informacje na stronie: transkrypcja nagrań.