Dergiler / Dilbilim Araştırmaları Dergisi / 2014 / Sayı: 1

Özel Amaçlı Derlemi Çevriyazmak: Bir Çevriyazı Modeli

Transcribing Special Purpose Corpus: A Transcription Model

Sayfa
1–30
DOI
—

Özet

nsanlar arasındaki etkileşim pek çok disiplinde çalışılan bir konudur. Bu etkileşimin sözlü ve yazılı dili içeren metinlerinin toplamı derlem (İng. corpus) olarak adlandırılır. Sözlü derlemlerin büyük çoğunluğu veriyi aynı fiziksel ortamda sundukları için tek-ortamlı (İng. mono-modal) ve metintemelli kayıtlardır. Böylesi tek-ortamlı derlemler dili ve etkileşimi metnin ötesinde yansıtamadıkları için kapsam bakımından sınırlıdırlar. Anlam, metin, jest ve bürün öğeleri gibi sözel ve sözel-olmayan özelliklerin birleşimi ile kurulduğu için etkileşimin, aslında, çok-ortamlı (İng. multi-modal) olduğu göz önüne alındığında, bu problem yaratmaktadır. Çok-ortamlı derlemler doğal konuşma kayıtlarından elde edilen etkileşimin video, ses ve metin kayıtlarından oluşmaktadır. Kayıt, etkileşimin sistematik bir incelemesi için tek başına yeterli değildir. Bu nedenle, çevriyazı sözlü dilin gösterimi ve incelenmesinde önemlidir. Sözlü etkileşimi incelemek için işitsel ya da görsel veri çevriyazı yoluyla yazılı metin biçimine getirilir. Çevriyazılar, verinin çalışmanın amacından bağımsız olarak oluşturulan yansız gösterimleri değildirler ve farklı aşamalarda farklı yollarla araştırmaya hizmet ederler. Bu çalışmada, derlem dilbilimine çok-ortamlı bir yaklaşım ile özel amaçlı bir derlemin gülmece ve gülme incelemesi için nasıl çevriyazılabileceği konusunda bir model önerilmiştir.

Abstract

The interaction between people is an issue studied in many disciplines. The compilation of texts including written and spoken language of this interaction is called corpus. A great majority of spoken corpora is mono-modal and textbased recordings since they instantiate the data in the same physical medium. Such mono-modal corpora are limited in scope because they are unable to represent language and interaction beyond the text. This is problematic given that interaction is in fact multi-modal, as meaning is constructed through the combination of verbal and non-verbal characteristics such as text, gesture and prosody. Multi-modal corpora are composed of the audio, video and text recordings of the interaction gathered from naturally occurring speech. Recordings are not sufficient by themselves for the systematic analysis of interaction. For this reason, transcription is important in representation and analysis of spoken language. To analyze spoken interaction, audio or video data is transcribed into a written form. Transcriptions are not unbiased representations of the data formed independently from the purpose of the analysis, and they serve the work of analysis in different ways at different stages. In this paper, by a multi-modal approach to corpus linguistics, a model transcription system is proposed concerning how a specialized corpus is transcribed for an analysis of humor and laughter.