Suç veri setini analiz etmek için makine öğreniminde örnekleme teknikleri ve uygulaması
Sampling techniques and application in machine learning in order to analyse crime dataset
- Tez No: 739944
- Danışmanlar: PROF. DR. AYLA ŞAYLI
- Tez Türü: Yüksek Lisans
- Konular: Mühendislik Bilimleri, Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Matematik, Engineering Sciences, Computer Engineering and Computer Science and Control, Mathematics
- Anahtar Kelimeler: Makine öğrenmesi, Suç bilgileri, Sınıflandırma, Ön işlem, Örnekleme yöntemleri, Machine learning, Crime informations, Classification, Pretreatment, Sampling methods
- Yıl: 2022
- Dil: Türkçe
- Üniversite: Yıldız Teknik Üniversitesi
- Enstitü: Fen Bilimleri Enstitüsü
- Ana Bilim Dalı: Matematik Mühendisliği Ana Bilim Dalı
- Bilim Dalı: Matematik Mühendisliği Bilim Dalı
- Sayfa Sayısı: Belirtilmemiş.
Özet
Teknolojinin son derece gelişmiş ve hızlı bir şekilde gelişmekte olduğu bu çağlarda veri çok önemli bir konumdadır. Fakat sadece veriye sahip olmak tek başına bir anlam ifade etmez. Bu nedenle verilerin işlenmesi, analiz edilmesi ve bu verilerden tutarlı tahminler yapmak veriyi kıymetli hale dönüştürür. Makine öğrenmesi, makinelerin bilgiyi öğrenmesini ve öğrendiği bilgiyi kullarak çıkarımlar yapmasını sağlar. Bu makalede, beş yıla ait suç verileri ele alınarak analiz edildi ve makinenin elindeki verilerle öğreme işleminin tamamlanması sağlandı. Verinin analizi sürecinde One-Hot Encoding ve Min-Max Normalizasyon metotları ile Temel Bileşenler Analizi algoritması kullanıldı. Modelden suçlunun yakalanıp yakalanamaması, bölgenin güvenliği ve işlenen suçun tipini K En Yakın Komşu, Rastgele Orman ve Aşırı Gradyan Artırma Sınıflandırma algoritmaları kullanılarak tahmin etmesi istendi. Fakat dengesiz veri setlerinde model ne kadar başarılı olursa olsun sonuç yanıltıcı olur. Bu nedenle bu makalenin asıl amacı dengesiz verinin çeşitli metotlarla dengeli hale dönüştürülmesi ve veri için sınıflandırma metodu ile uyumlu en doğru örnekleme metodunu bulmaktır. Bu amaçla tutuklanma, suç tipi ve güvenlik hedef alanlarında verinin dengesizliğinin önüne geçmek için bir tane istatistiki örnekleme metodu (Tabakalaştırma), üç tane aşırı örnekleme metodu (Rastgele Üst Örnekleyici, Sentetik Azınlık Aşırı Örnekleme, Uyarlamalı Sentetik Azınlık Aşırı Örnekleme metotları), üç tane alt örnekleme metodu (Rastgele Alt Örnekleyici, Ramak Kala Alt Örnekleme, Yakın Komşu Temizleme Kuralı Alt Örnekleme metotları) ve bir tane alt ve bir tane aşırı örneklemenin beraber kullanıldığı hibrit örnekleme metodu (Smote Tomek) uygulanmıştır. Uygulanan örnekleme yöntemleri sonucunda verimli ve etkili sonuçlar elde edilmiştir.
Özet (Çeviri)
In these eras where technology is extremely advanced and developing rapidly, data is in a very important position. But just having data doesn't make sense on its own. Therefore, processing and analyzing data and making consistent predictions from these data turns data into valuable. Machine learning enables machines to learn information and make inferences using the information it has learned. In this article, five years of crime data were analyzed and the learning process was completed with the data in the machine's hands. One-Hot Encoding and Min-Max Normalization methods and Principal Component Analysis algorithm were used in the analysis of the data. The model was asked to predict whether the criminal could be caught, the security of the area, and the type of crime committed using the K-Nearest Neighborhood, Random Forest and Extreme Gradient Boosting algorithms. However, no matter how successful the model is in imbalanced datasets, the result will be misleading. Therefore, the main purpose of this article is to transform the imbalanced data into a balanced one by various methods and to find the most accurate sampling method for the data, which is compatible with the classification method. For this purpose, one statistical sampling method (Stratify), three over sampling method (Random Over Sampler, Synthetic Minority Over, Adaptive Synthetic), three under sampling method (Random Under Sampler, Near Miss, Neighborhood Cleaning Rule) and hybrid samplig method (Smote Tomek) have been applied to avoid imbalance of data in target areas such as Arrest, Crime Type, Security. As a result of the sampling methods applied, efficient and effective results were obtained.
Benzer Tezler
- Prediction of COVID 19 disease using chest X-ray images based on deep learning
Derin öğrenmeye dayalı göğüs röntgen görüntüleri kullanarak COVID 19 hastalığının tahmini
ISMAEL ABDULLAH MOHAMMED AL-RAWE
Yüksek Lisans
İngilizce
2024
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve KontrolGazi ÜniversitesiBilgisayar Mühendisliği Ana Bilim Dalı
PROF. DR. ADEM TEKEREK
- A composed technical debt identification methodology to predict software vulnerabilities
Yazılım zafiyetlerini tahmin etmek için kapsamlı bir teknik borç tanımlama yöntemi
RUŞEN HALEPMOLLASI
Doktora
İngilizce
2024
Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİstanbul Teknik ÜniversitesiBilgisayar Mühendisliği Ana Bilim Dalı
DOÇ. DR. AYŞE TOSUN KÜHN
- Bir liman işletmesi için kapasite yeterlilik analizi
Capacity availability analysis for a seaport company
HANDE GÜZEY
Yüksek Lisans
Türkçe
2019
Endüstri ve Endüstri MühendisliğiBursa Uludağ ÜniversitesiEndüstri Mühendisliği Ana Bilim Dalı
DR. ÖĞR. ÜYESİ MEHMET AKANSEL
- Core network anomaly detection using the LSTM model and comparison with various unsupervised learning methods
Telekomünikasyon merkezi şebekelerinde LSTM model ile anomali tespiti ve bazı denetimsiz öğrenme metotları ile kıyaslanması
SAMED ÇALIK
Yüksek Lisans
İngilizce
2025
Endüstri ve Endüstri Mühendisliğiİstanbul Teknik ÜniversitesiBüyük Veri ve İş Analitiği Ana Bilim Dalı
DR. ÖĞR. ÜYESİ MEHMET ALİ ERGÜN
- Predicting direction of stock price movement by using adaptive ensemble learning method
Hisse senedi fiyatı hareket yönünün adaptif topluluk öğrenmesi metodu ile tahmin edilmesi
ALİ ÖZKAN PEKMEZ
Yüksek Lisans
İngilizce
2022
Endüstri ve Endüstri Mühendisliğiİstanbul Teknik ÜniversitesiEndüstri Mühendisliği Ana Bilim Dalı
DR. ÖĞR. ÜYESİ MEHMET ALİ ERGÜN