İnternette heterojen veri kaynaklarından verinin toplanması, doğrulanması ve sorgulanması
Tezin Türü: Doktora
Tezin Yürütüldüğü Kurum: Gazi Üniversitesi, Bilişim Enstitüsü, Bilgisayar Eğitimi, Türkiye
Tezin Onay Tarihi: 2023
Tezin Dili: Türkçe
Öğrenci: SERDAR KÜRŞAT SARIKOZ
Danışman: Muhammet Ali Akcayol
Açık Arşiv Koleksiyonu: AVESİS Açık Erişim Koleksiyonu
Özet:Yapay zekâ alanındaki disiplinler arası araştırmalar ve teknolojik gelişmeler, heterojen veri kaynaklarından gelen büyük hacimli verilerin bilgi grafları sayesinde entegrasyonunu sağlayarak gerçek dünya sorunlarının çözümü ve büyük veri analitiğini olanaklı kılmıştır. Web üzerindeki heterojen veri kaynakları ile çalışmada, bağlantılı veri, anlamsal ağ ve bilgi graflarının entegrasyonu; veri kalitesi ve doğruluk keşfinin birlikte etkileşimini sağlam bir dijital çerçevede sunumunu sağlamaktadır. Bu çerçeve sadece bilginin zenginliğini ve erişilebilirliğini değil, aynı zamanda güvenilirliğini, doğruluğunu ve güvenilirliğini de sağlayarak bilgilerin tutarlılığını ve güvenilirliğini sağlayan dijital çağın önünü açmaktadır. Bir dil için KG oluşturmak, heterojen verilerin karmaşıklığı ve dinamik yapısı nedeniyle zorlukları beraberinde getirmektedir. Heterojen veri kaynakları üzerinden, heterojen bilgi ağlarının oluşturulmasında, saklanmasında, işlenmesinde, analiz edilmesinde ve karmaşık ilişkilerin çıkarılmasında; verimli ve etkin yeni algoritmalar geliştirilmesine ihtiyaç bulunmaktadır. Bu çalışmada, Türkçe diline yönelik olarak heterojen veri kaynaklarından bilgi çıkarımı, makine okunabilir formatta bilgi tabanının oluşturulması ve bilgilerin graf formatında gösterimini sağlayan özgün bir model geliştirilmiştir. Sistem, Wikipedia ve arama motorları üzerinden elde etmiş olduğu veriler üzerinden bilgi çıkarımını, bilgi tabanına eklenmesine yönelik gerekli işlemleri, oluşturmuş olduğu referans bilgi tabanı aracılığı ile bilgilerin doğrulanmasını gerçekleştirilmektedir. Çalışma kapsamında önerilen özgün modelin benzersiz mimarisi, farklı alanlardaki farklı problemlere ve görevlere uyarlanmasına olanak sağlamaktadır. Bu esneklik, modelin çeşitli alanlarda kullanılabilirliğini ve uygulanabilirliğini artırmaktadır. Bununla birlikte Türkçe dilinde Web ölçekli ve genel amaçlı bir bilgi grafı sunması nedeniyle mevcut literatürdeki bir boşluğu doldurmaktadır. Önerilen sistem aynı zamanda arama motorlarına özgün unutulma hakkı ve güvenli arama gösterimini de sunmaktadır.