
📌 Elsevier • SoftwareX • SCI-Expanded • Open Access
Kullanıcılar bize iki temel şey söylüyordu:
1. *”Terminalde Python betiği çalıştırmak yerine, tıklayarak yönetebileceğimiz modern bir web arayüzü istiyoruz ama verilerimizi de buluta yüklemek istemiyoruz (gizlilik).*
2. *”Sadece WoS ve Scopus’u birleştirmek yetmiyor; verideki eksik atıfları, kurum adlarındaki karmaşayı ve aynı isimli farklı yazarları (ORCID) otomatik çözebilir misiniz?”*
Bu çağrıya kayıtsız kalamazdık. Alperen Şahin ve Taşkın Dirsehan hocalarımla kolları sıvadık ve BibexPy’yi adeta baştan yaratarak **BibexPy v2.0**’ı inşa ettik.
Smart Merge ve Sınırda Kalan Kayıtlar Sorunsalı
v2.0 ile getirdiğimiz en devrimsel yeniliklerden biri **Smart Merge** motorudur. Eski sistemlerde iki makalenin aynı olup olmadığını anlamak için ya katı kurallar koyarsınız (bu durumda başlığında ufak bir yazım farkı olan aynı makaleyi kaçırırsınız) ya da gevşek kurallar koyarsınız (bu sefer de “Part 1” ve “Part 2” gibi gerçekten farklı olan iki makaleyi yanlışlıkla birleştirip birini silersiniz).
Biz bu ikilemi **Jaro-Winkler metin benzerlik puanlaması** ve **Kullanıcı Denetimli Sınırda İnceleme (Borderline Review)** kuyruğu ile çözdük. Sistem %95 üzeri benzerlikleri deterministik olarak tekilleştirirken, %85-%95 arasında kalan şüpheli durumları sessizce silmek yerine araştırmacının önüne zarif bir karşılaştırma kartı olarak getirir: *”Bu iki kayıt birbirine çok benziyor, sence bunlar aynı makale mi?”* Karar vericiyi sürecin merkezinde tutan bu yaklaşım, veri kaybı ve hata riskini sıfıra indirdi.
BibexPy v2.0 tarayıcı tabanlı yerel kullanıcı paneli ve veri sağlığı skorlama ekranı.
Yazar İsimleri Kaosu ve ORCID Kalkanı
Bibliyometride en büyük kabuslardan biri yazar belirsizliğidir (Author Disambiguation). Düşünün: “Yilmaz, M.” adında bir yazar gördünüz. Bu kişi Mehmet Yılmaz mı, Mustafa Yılmaz mı, yoksa Merve Yılmaz mı? Hepsini tek bir araştırmacı sayarsanız ortaya çıkan atıf haritası tamamen bir hayal ürününe dönüşür.
BibexPy v2.0’da resmi **ORCID** entegrasyonu kurduk. Eğer makalede ORCID varsa sistem bunu tartışmasız birincil kimlik kanıtı kabul eder. Eğer yoksa, yazarın çalıştığı kurum varyasyonlarını (örneğin *Amasya Univ.* vs *Univ. of Amasya*) sözlük tabanlı kümeleme algoritmalarıyla kanonik formlarına dönüştürerek yazar ağlarının bozulmasını engeller.
7 Otoriter Kaynaktan Otomatik Veri Zenginleştirme
Bazen indirdiğiniz bir makalenin özeti (abstract) veya kaynakçası eksik gelebilir. BibexPy v2.0, “Bir Kere Çek, Hepsini Doldur” (Fetch-Once-Fill-All) stratejisiyle donatıldı. Crossref, OpenAlex, Semantic Scholar gibi 7 küresel akademik kaynaktan veri setindeki eksik boşlukları otomatik olarak doldurur.
Ayrıca analiz öncesinde kullanıcıya bir **Veri Sağlık Skoru (Health Score)** sunar: *”Veri setinin eksiksizliği %94. Kaynakça alanların tam, ancak bazı dergilerin ISSN numaraları eksik.”* Böylece araştırmacı körlemesine analize dalmak yerine, elindeki malzemenin kalitesini bilerek yola çıkar.
Akıllı tekilleştirme motoru (Smart Merge) ve Jaro-Winkler sınırda kayıt inceleme kuyruğu.
Tek Satır Kodla Kendi Bilgisayarında Çalışan Bir Web Platformu
En sevdiğim kısım ise şu: Bütün bu devasa yetenekleri kullanmak için tek yapmanız gereken şey terminalinize `pip install bibexpy` ve ardından `bibexpy run` yazmak. Tarayıcınızda açılan yerel arayüzde dosyalarınızı sürükleyip bırakırsınız, temizlersiniz ve tek tıkla VOSviewer, Biblioshiny, CiteSpace veya Gephi formatlarında indirirsiniz. Verileriniz asla internete veya üçüncü parti bir buluta gitmez, tamamen sizin makinenizde kalır.
BibexPy v2.0 bizim için bir yazılım güncellemesinden çok, veri bilimini kütüphanecilik ve akademik şeffaflıkla buluşturan olgun bir platformun tescili oldu.
📖 Akademik Künye ve Atıf (APA 7)
Kara, B. C., Şahin, A., & Dirsehan, T. (2026). Version 2 – BibexPy: harmonizing the bibliometric symphony of scopus and web of science. SoftwareX, 35, 102944. https://doi.org/10.1016/j.softx.2026.102944






