Türkiye'nin akademik yayın altyapısını; anlamsal analiz, metadata çıkarımı, outlier tespiti ve atıf ilişkisi modelleme yöntemleriyle daha erişilebilir, doğrulanabilir ve zeki hale getirmeyi amaçlayan araştırma ve geliştirme platformu.
Platforma ait erişim noktaları ve entegre araçlar
Veri toplama sayaçları, scrapper ilerleme durumu ve S3 depolama özeti.
PDF'ten çıkarılan tam metin ve yapısal metadata verilerini yayın kimliği ile görüntüleyin.
Atıf sınıflandırma ve tam metin çıkarım veri setleri. Lisanslı ve kamuya açık.
Mimari kararlar, deney kartları, yöntemler ve operasyon rehberleri.
Tüm endpoint'lerin interaktif dokümantasyonu. Swagger UI ile doğrudan test edin.
Akademik atıf bağlamı çıkarma ve ilişki tipleri analizi platformu.
Platformun araştırma ve geliştirme odak alanları
Anahtar kelime yerine anlam tabanlı akademik yayın sorgulama. Embedding modelleri ve MTEB değerlendirme çerçevesi.
Detay →TR Dizin editörleri için metadata çıkarımı, outlier tespiti ve duplike eşleşme bileşenlerini kapsayan şemsiye domain.
Detay →YÖKTez veri tabanından PDF toplama, S3 depolama ve metadata yönetimi altyapısı.
Detay →Akademik atıfların bağlam bilgisiyle çıkarılması, ilişki tipi sınıflandırması ve atıf ağlarının modellenmesi.
Detay →Varlık-ilişki graph altyapısı üzerine kurulu akademik bilgi tabanı ve sorgulama servisleri.
Detay →Kurumsal bilgi tabanına dayalı doğal dil sorgularını yanıtlayan araştırma asistanları.
Detay →