Geri Dön

Information extraction and manipulation system for the web sources

Web kaynaklarından bilgi sağlanması ve manipülasyonu

  1. Tez No: 126562
  2. Yazar: SERHAN TATAR
  3. Danışmanlar: PROF. DR. M. AKİF EYLER
  4. Tez Türü: Yüksek Lisans
  5. Konular: Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrol, Computer Engineering and Computer Science and Control
  6. Anahtar Kelimeler: World Wide Web, Web kaynaklan, bilgi ayıklama Ağustos, 2002 Serhan TATAR, Bilgi kaynakları, WWW, İnternet, World Wide Web, Web sources, information extraction August, 2002 Serhan TATAR Vll, Information sources, WWW, Internet
  7. Yıl: 2002
  8. Dil: İngilizce
  9. Üniversite: Marmara Üniversitesi
  10. Enstitü: Fen Bilimleri Enstitüsü
  11. Ana Bilim Dalı: Bilgisayar Mühendisliği Ana Bilim Dalı
  12. Bilim Dalı: Belirtilmemiş.
  13. Sayfa Sayısı: Belirtilmemiş.

Özet

ÖZET WEB KAYNAKLARINDAN BİLGİ SAĞLANMASI VE MANİPÜLASYONU İnternette başlıca gezinim tekniği bağlantıları kullanarak bilgiye ulaşma ve anahtar kelimeleri kullanarak aramalar yapmaktır. Fakat, internetin devasa büyüklüğü düşünüldüğünde bu tekniklerin yeterli olmadığı görülmektedir. Ayrıca, diğer bir problem de heterojen yapılarda bulunan bilginin belirli bir veri modeli ve biçimi içinde sunulabilmesidir. Bu tezde, WebXtractor isimli sistem anlatılmış ve geliştirilmiştir. Sistem temel olarak Web kaynaklarından bilgi elde edilmesini ve elde edilen bilginin rafine hale getirilmesini sağlamaktadır. Özellikle, internetten veri aktarma işlemlerinde oldukça etkili bir şekilde kullanılabilmektedir. WebXtractor' un sahip olduğu başlıca özellikler aşağıda sıralanmıştır:. Kaynakların internetten otomatik olarak getirilmesi ve ayrıştırılması. Kaynaklardan otomatik olarak kullanıcının belirttiği bilginin ayıklanması. Kaynakların ilişkilendirilmesi. Veri modeli tasarımı. Görsel araçlar sayesinde hızlı ve kolay uygulama geliştirme imkanı WebXtractor sistemi içerisinde, kullanıcının sistemi kolayca yapılandırabilmesi için 3 araç geliştirilmiştir. Tez içerisinde bu araçların nasıl kullanıldığı ve WebXtractor ile nasıl uygulama geliştirileceği konulan da detaylı bir şekilde anlatılmıştır. Ayrıca sistemin kullanımını anlatan örnek uygulamalar gerçeklenmiş ve gösterilmiştir. Bu uygulamalardan ilkinde, Web üzerinde bulunan çoklu bir veri iv ÎSSSSRBSTkaynağından elde edilen bilgi entegre hale getirilmiş ve kullanıcının istediği veri modeli ve biçimi içerisinde kullanıcıya sunulmuştur. İkinci uygulamada ise tek bir dokümandan oluşan kaynaktan elde edilen bilgi sadece biçim değişikliği yapılarak kullanıcıya sunulmuştur.

Özet (Çeviri)

ABSTRACT INFORMATION EXTRACTION AND MANIPULATION SYSTEM FOR THE WEB SOURCES Clicking on links and using keyword search for links is the main navigation technique in the Internet. However, it seems that the method is not useful when we consider the enormous size of the Internet. Moreover, another important problem is presentation of the information, which is stored in heterogeneous structures, in a specified data model and format. In this thesis, WebXtractor system is described and developed. The system is used to extract information from the Web sources and refine the extracted information. Especially, when migrating data from the Web, the system can be used efficiently. Main features of WebXtractor include:. Automatic retrieval and parsing of the Web sources. Automatic information extraction. Source integration. Data model design. Easy and rapid application development facilities by the help of visual tools In WebXtractor system, three tools were developed for user to configure the system easily. In the thesis, the toolkit was analyzed in detail. In addition, application development in WebXtractor was explained. Sample applications that show the usability of the system were also implemented and shown. In the first example, data that is stored on a multiple-instance Web source was integrated and the integrated VIinformation was presented to user in user-specified data model and format. In the second example, data that is stored on a single-instance Web source was presented to user in user-specified format.

Benzer Tezler

  1. Sayısal haritaların coğrafi bilgi sistemlerinde kullanılması ve kordinat transformasyonu

    The usage of digital maps in geographical information systems and coordinate transformation

    HÜSEYİN KURŞUN

    Yüksek Lisans

    Türkçe

    Türkçe

    1997

    Jeodezi ve Fotogrametriİstanbul Teknik Üniversitesi

    Jeodezi ve Fotogrametri Ana Bilim Dalı

    DOÇ. DR. YUNUS KALKAN

  2. BIM-GIS integration focused on indoor navigation: automatic derivation of navigation network

    İç mekan navigasyonu amaçlı BIM-GIS entegrasyonu: Otomatik navigasyon ağı oluşturulması

    GÖRKEM TOSUN

    Yüksek Lisans

    İngilizce

    İngilizce

    2019

    Jeodezi ve Fotogrametriİstanbul Teknik Üniversitesi

    İnşaat Mühendisliği Ana Bilim Dalı

    PROF. DR. HANDE DEMİREL

    PROF. DR. MARTIN KADA

  3. A hybrıd approach for ransomware detectıon based on behavıoral and structural features

    Davranışsal ve yapısal özelliklere dayalı hibrit bir fidye yazılımı tespit yaklaşımı

    BÜŞRA ÇALIŞKAN

    Yüksek Lisans

    İngilizce

    İngilizce

    2025

    Bilgisayar Mühendisliği Bilimleri-Bilgisayar ve Kontrolİstanbul Teknik Üniversitesi

    Bilgisayar Mühendisliği Ana Bilim Dalı

    PROF. DR. ABDÜL HALİM ZAİM

  4. Pediatrik dental girişimlerde müzik dinletilmesinin sedasyon gereksinimi ve düzeyine etkisi

    The effects of music on sedation depth and necessity during pediatric dental procedures

    ÖZLEM ÖZKALAYCI

    Tıpta Uzmanlık

    Türkçe

    Türkçe

    2015

    Anestezi ve ReanimasyonBaşkent Üniversitesi

    Anesteziyoloji ve Reanimasyon Ana Bilim Dalı

    YRD. DOÇ. DR. COŞKUN ARAZ

  5. Sayısal arazi modeli ve batimetrik verilerin kıyı bilgi sistemine entegrasyonu

    Başlık çevirisi yok

    CİHANGİR AYDÖNER

    Yüksek Lisans

    Türkçe

    Türkçe

    1998

    Jeodezi ve Fotogrametriİstanbul Teknik Üniversitesi

    Uzaktan Algılama Ana Bilim Dalı

    PROF. DR. DERYA MAKTAV