Geri Dön

Mikrodizi verilerinde farklı yapı ve sayıda ortaya çıkan eksik verilerin 1.tip hata üzerine etkisinin araştırılması

Researching effect of missing values occured different structures and numbers onto TYPE I error in microarray datas

  1. Tez No: 417394
  2. Yazar: ASENA AYÇA ÖZDEMİR
  3. Danışmanlar: PROF. DR. EMİNE ARZU KANIK
  4. Tez Türü: Yüksek Lisans
  5. Konular: Biyoistatistik, Biostatistics
  6. Anahtar Kelimeler: Adenomlar, Biyoistatistik, Eksik veri, Gen ifadesi, Karsinoma, Mikrodizilim analizi, Veri analizi, İstatistik, İstatistiksel teknikler, Adenoma, Bioistatistics, Missing data, Gene expression, Carcinoma, Microarray analysis, Data analysis, Statistics, Statistical techniques
  7. Yıl: 2015
  8. Dil: Türkçe
  9. Üniversite: Mersin Üniversitesi
  10. Enstitü: Sağlık Bilimleri Enstitüsü
  11. Ana Bilim Dalı: Biyoistatistik ve Tıbbi Bilişim Ana Bilim Dalı
  12. Bilim Dalı: Belirtilmemiş.
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

Eş zamanlı olarak binlerce genin ekspresyon düzeylerini ölçmeye yarayan mikrodizi teknolojisi, son yıllarda önemli araçlardan biri olmuştur. Mikrodizi teknolojisinde arka plan pikselleri ve spot pikselleri arasındaki eşitsizlik, hibridizasyon sırasındaki hatalar, floresan yoğunluğu, slayt yetmezliği, slaytlarda bulunan toz ya da çizikler, görüntünün bozulması, çözünürlüğün yeterli olmaması, deneysel hatalar gibi pek çok sebep veri yapısında eksik/kayıp verilerin oluşmasına sebep olabilmektedir. Bu sebeplere göre eksik veri yapısı bazı setlerde %10 olabiliyorken bazı veri setlerinde bu oran %90'a kadar çıkabilmektedir. Bu çalışmamızda Princeton Üniversitesi Onkoloji Bölümü Mikrodizi veri tabanında bulunan araştırmacının kullanımına açık olarak yer alan, Adenoma ve Carcinoma mikrodizi setlerinde, farklı oranlarda meydana gelen eksik gözlem durumunda iki bağımsız grup ortalamalarının karşılaştırılması sonucu oluşan 1. Tip hatalar yorumlanmıştır. Çalışmada Matlab R2015a programından yararlanarak %1, %5, %10, %15, %20, %30, %40, %50, %60, %70, %80 ve %90 oranlarında rasgele eksik veri yapısı oluşturulmuştur ve her oran için 1000 tekrar gerçekleştirilmiştir. Oluşturulan eksik veri setlerinin her biri için Student t testi, Benjamini Hochberg ve Benjamini Yekutieli prosedürleri ve mikrodizi veri setleri için önerilen mikrodizi anlamlılık analizi (significance analysis of microarray) uygulanmıştır. Oluşturulan eksik veri oranlarına göre; eksiklik yüzdesi arttıkça 1. Tip hata oranlarında bozulma meydana gelmektedir. Gerçek veri setinde kullanılan dört yöntem birbiriyle karşılaştırıldığında beklenen %5 1. Tip hata oranına en yakın sonucu mikrodizi anlamlılık analizi vermiştir ve eksiklik oranlarından en az etkilenen testtir. Beklenen %5 1. Tip hata oranına ikinci olarak en yakın sonucu veren test Benjamini Yekutieli prosedürü olmuştur.Kullanılan bütün testler örneklem genişliğinden etkilenmektedir.

Özet (Çeviri)

Simultaneously, the means for measuring expression levels of thousands of genes microarray technology has been one of the major tools in recent years. There are many reasons such as inequality between background pixels and spot the pixels, error during hybridization, fluorescent intensity, slide failure, dust or scratches found on the slide, poor image, lack of adequate resolution may lead to missing or lost data for data structure in the microarray technology. For reasons like these, missing data structure in some data sets could 10%, this rate can reach up to 90%. In this study, in the Princeton University Department of Oncology Microarray database located as available to researchers, in the Adenoma and Carcinoma microarray sets, in case of missing observations seen at different rates resulting from the comparison of two independent group average Type 1 errors were interpreted. In proportion as 1%, 5%, 10%, 15%, 20%, 30%, 40%, 50%, 60%, 70%, 80% and 90% random missing data structure is formed and conducted 1000 repeated for each rate. According to the missing value rate generated, increasing missing data rate cause to deterioration in the Type I error rate. When comparising the four methods to each other in the real data, Significance Analysis of Microarray give the nearest results to expected 5% Type I error rate and the lowest effected from missing value rates. Benjamini Yekutieli procedure is the second test that give the nearest results to expected 5% Type I error rate. All of the test used effected from sample size.

Benzer Tezler

  1. Linking national business system with firm level innovation: The mediating role of intellectual capital and absorptive capacity

    Firma düzeyi yeniliği ile bağlantılı ulusal iş sistemi: Entelektüel sermaye ve özümseme kapasitesinin arabulucu rolü

    BASHİR AHMAD

    Doktora

    İngilizce

    İngilizce

    2017

    İşletmeİstanbul Teknik Üniversitesi

    İşletme Ana Bilim Dalı

    Assoc. Prof. Dr. MEHMET ERÇEK

  2. New forms of the creative economy: Creative hubs in Istanbul

    Yaratıcı ekonomı̇nı̇n yenı̇ formları: İstanbul'dakı̇ yaratıcı merkezler

    MELTEM PARLAK

    Doktora

    İngilizce

    İngilizce

    2021

    Şehircilik ve Bölge Planlamaİstanbul Teknik Üniversitesi

    Şehir ve Bölge Planlama Ana Bilim Dalı

    PROF. DR. TÜZİN BAYCAN

  3. Sayısal haritalama teknikleri kullanılarak DNA dizilimleri üzerinden lösemi hastalığının temel türlerinin yapay zeka tabanlı algoritmalar ile sınıflandırılması

    Classification of main types of leukemia disease with artificial intelligence-based algorithms on the DNA sequences using digital mapping techniques

    FATMA AKALIN

    Doktora

    Türkçe

    Türkçe

    2023

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolSakarya Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    PROF. DR. NEJAT YUMUŞAK

  4. Benzetilmiş tavlama algoritması ile adaptif ağ tabanlı bulanık mantık çıkarım sisteminin (ANFIS) eğitilmesi

    Training adaptive neuro-fuzzy inference system (ANFIS)using simulated annealing algorithm

    BÜLENT HAZNEDAR

    Doktora

    Türkçe

    Türkçe

    2017

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolErciyes Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    PROF. DR. ADEM KALINLI

  5. Genomik veri tabanlarında metin tabanlı deney geri getirimi

    Text-based experiment retrieval in genomic databases

    SELEN BAŞAK

    Yüksek Lisans

    Türkçe

    Türkçe

    2021

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolBaşkent Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    DR. ÖĞR. ÜYESİ DUYGU DEDE ŞENER