Cinsiyet API'si nasıl seçilir
Bu kategorideki her sağlayıcı sana doğru olduğunu söyleyecek, ve hiçbiri bunu senin listende ölçmedi. Onları gerçekten ayıran şeyler burada — her birinin altında kendi yanıtımızla, ki bizi de aynı sorulara tabi tutabilesin.
Kısa yanıt
- Tek bir sonucun eline ne verdiğine göre karşılaştır — çıplak bir etikete eşik koyamazsın, olasılık artı örnek sayısına koyabilirsin. Bu, dosyanın bir kısmını otomatikleştirip mi yoksa tamamını elle mi yapacağını belirler.
- Manşetteki doğruluk yüzdelerini yok say, bizimkiler dahil — biz bir tane yayınlamıyoruz, çünkü yayınlanmış bir kıyaslama üzerinde ölçmedik. Onun yerine kendi satırlarından birkaç yüzü üzerinde kendin ölç.
- Daha büyük bir ad veritabanı kendiliğinden daha iyi değildir: bir ad, arkasında üç kayıt da olsa elli bin kayıt da olsa aynı şekilde sayılır.
- Sonra insanların unuttuğu dört şeyi kontrol et — ülkeye göre yerelleştirme, yanıtın yıllar içindeki kararlılığı, bilinmeyen bir ad için ne döndüğü ve verilerin nerede işlendiği.
Tek bir sonucun sana ne verdiğiyle başla
Ne kadar iş yapman gerektiğini değiştiren ölçüt bu, ve bir sağlayıcının örnek yanıtında hiçbir şey imzalamadan önce görünür.
Tek başına bir cinsiyet etiketi, hesabı gösterilmemiş bir karardır. Ya her yere uygularsın ya da her yerde kontrol edersin; ortası yok. Bir olasılık sana bir eşik verir. Arkasındaki kayıt sayısıyla birlikte gelen bir olasılık, o eşiğin önündeki satır için bir anlamı olup olmadığını söyler — çünkü üç kayda dayanan emin görünen bir yanıt ile binlerce kayda dayanan bir yanıt, biri sana sayıyı gösterene kadar birebir aynı görünür.
Bizim yanıtımız: her sonuç bir olasılık ve bir örnek sayısı taşır, ve CSV/Excel çıktısı bunları dosyana kolon olarak yazar; böylece aynı eşik, API'yi çağırırken de bir hesap tablosunu açarken de işler.
Kontrol etmeye değer altı boyut
Bu kategorideki sağlayıcıların genelde farklılaştığı altı nokta, her birinin yanında bizim ne yaptığımız. Sol kolon neye bakman gerektiğini söylüyor — başka kimseyi incelemedik, dolayısıyla hiçbiri belirli bir sağlayıcıya dair iddia değil. Kısa listendeki herkese sor, bize de.
Son ikisi hakkında: tek seferlik paket olarak alınan credit'lerin süresi dolmaz, aylık plan ise her ay yenilenir ve her an iptal edilebilir (paket değiştirmek, iptal edip başka birini seçmek anlamına gelir). İkisi de fiyat sayfasında tam olarak yazıyor, teklif almadan.
Bir kapsama sayısı neden meseleyi çözmez
9,124,598 ülkeden 192 ad tutuyoruz, ve bu sayıları herkes gibi ana sayfaya koyuyoruz. Tam olarak şu kadar değerleri var: ne sıklıkla hiç yanıt alacağını söylerler, belirli bir yanıtın kullanmaya değer olup olmadığı hakkında hiçbir şey söylemezler. Bunlara göre seçim yapma — ne bizimkilere ne de başkasının.
Meseleyi çözen test bir öğleden sonraya bakar: kendi verilerinden doğru yanıtını zaten bildiğin birkaç yüz satır al, zor olmasını beklediklerini de kat, ve kısa listendeki her sağlayıcıdan geçir. Herkesin doğru bildiği adlar sana hiçbir şey söylemez.
Kontrol listesi
Dokuz soru, genelde önem sırasına göre. Bizim yanıtımız sağ kolonda — baktığın herkese aynısını sor, ve yanıtları bir özellik tablosundan değil yazılı olarak iste.
| Sor | Neden önemli | Bizim yanıtımız |
|---|---|---|
| Tek bir sonuç ne içeriyor? | Emin satırları otomatikleştirip yalnızca kalanı elden geçirebilir misin, bunu belirler | Cinsiyet, bir olasılık ve arkasındaki kayıt sayısı |
| Aynı ad ülkeye göre farklı yanıtlanabiliyor mu? | Andrea İtalya'da erkek, Almanya'da kadın adıdır; tek bir küresel yanıt bunlardan birinde yanlıştır | Evet — ülke kodu, tarayıcı locale'i veya IP adresine göre |
| Aynı istek gelecek yıl aynı şekilde yanıtlanacak mı? | Bir denetim bir kaydın nasıl sınıflandırıldığını sorar, ve kayan bir yanıt açıklanamaz | Evet — bu, üretilmiş bir tahmin değil, saklanan kayıtlar üzerinde aritmetik |
| Bilmediği bir ad için ne dönüyor? | Boş bir alan filtrelenebilir; makul bir tahmin fark edilemez | Açık bir "bulunamadı" ve nedenini söyleyen bir örnek sayısı — asla uydurulmuş bir yanıt değil |
| Geliştirici gerektirmeyen bir yol var mı? | Listeye sahip olan kişi genelde API çağırabilen kişi değildir | Özgün çalışma kitabı korunarak CSV ve Excel yükleme |
| Veriler nerede işleniyor, ve veri işleme sözleşmesi var mı? | Müşteri adlarından oluşan bir liste kişisel veridir, ve satın alma birimi yayına almadan önce soracaktır | Alman şirketi, sunucular Almanya'da, işleme AB'de, talep üzerine veri işleme sözleşmesi |
| Kullanılmayan kapasitenin süresi doluyor mu? | Tek seferlik bir temizlik, kendisinden uzun ömürlü bir abonelik gerektirmemeli | Ön ödemeli credit'ler, ve süreleri dolmuyor |
| Kimseyle konuşmadan test edebilir miyim? | Değerlendirme satış görüşmesi gerektiriyorsa, kısa listeni bir öğleden sonrada karşılaştıramazsın | Ayda 100 ücretsiz sorgu, kart yok, görüşme yok |
| Yayınlanmış doğruluk oranı nedir? | Tek bir yüzde, ölçüldüğü ad kümesini anlatır, ve o küme senin değil | Biz bir tane yayınlamıyoruz — aşağıya bak |
Sana vermeyeceğimiz doğruluk oranı
Bu pazarda sana yüzdeler söylenecek. Söyleyecek ölçülmüş bir oranımız yok: etiketli bir ad kümesi üzerinde yayınlanmış bir kıyaslamamız yok, dolayısıyla basacağımız her sayı, beyaz önlük giymiş bir pazarlama sayısı olurdu. Bir sayıyı süslemek yerine bunu söylemeyi tercih ederiz.
Ayrıca kulağa geldiğinden daha az işe yarar. Bir ad-cinsiyet sorgusundaki doğruluk neredeyse tamamen hangi adları sorduğuna bağlıdır — yaygın Alman adlarından oluşan bir liste ile bir düzine yazı sisteminden çevriyazılmış soyadlarından oluşan bir liste, var olan hiçbir sağlayıcıdan aynı sayıyı vermez. Yani tek bir yüzde, ölçüldüğü küme hakkında bilgi verir, ve senin listen o küme değil.
Sana bir oran söylendiğinde onu anlamlı kılan soru şudur: hangi adlar üzerinde ölçüldü, kaç tane, kim etiketledi, ve "bilinmeyen" ne sayıldı? Bu yanıtlar yoksa, yüzde süstür.
Değerlendirmeyi bir öğleden sonrada nasıl yaparsın
Bu sayfa sana sürekli kendi verilerin üzerinde ölçmeni söylüyor, işte yöntem. Bir öğleden sonra sürer, kısa listendeki her sağlayıcı için aynı şekilde işler, ve projeye karar veren adım beşinci adımdır.
- 1. Cevabını zaten bildiğin 200–300 satır çek. Ünlü adlar listesinden değil, gerçek verilerinden. Zor olanları bilerek kat: nadir adlar, Batılı olmayan adlar, soyadı önce yazılmış kayıtlar, tek kelimelik adlar, tireli adlar ve evlilikle alınan adlar.
- 2. Önce temizlemeye kalkma. Sondaki boşluklar, unvanlar, "Dr." ve BÜYÜK HARFLER test ettiğin şeyin parçası. Yalnızca düzenli girdide çalışan bir sağlayıcı senin problemini çözmemiştir.
- 3. Yanıtın tamamını sakla, yalnızca etiketi değil. Beşinci adımda olasılığa ve örnek sayısına ihtiyacın olacak, ve bir sağlayıcı bunları döndürmüyorsa, testin sonucu zaten budur.
- 4. Üç sonucu ayrı ayrı say — doğru, yanlış ve yanıt yok. Değerlendirmelerin çoğu burada yanlış gider: "yanlış" ile "bilinmeyen"i tek bir sayıya indirmek, önemli olan farkı gizler. Filtreleyebildiğin bir bilinmeyen sana nötr bir hitap maliyetine gelir. Emin ama yanlış bir yanıt sana müşteriye mal olur.
- 5. Şimdi bir eşik uygula ve yeniden say. Yalnızca eşiğinin üstündeki satırları kabul et — diyelim arkasında en az 50 örnek olan 0,9 olasılık — ve iki şeyi ölç: bunun dosyanın yüzde kaçını kapsadığını, ve o kapsamın içindeki hata oranını. Gerçek yanıt bu ikili, çünkü sana işin ne kadarının yok olduğunu ve bununla ne kadar risk geldiğini söyler.
- 6. Hazır oradayken işletme tarafını da kontrol et. 300 satırın ne kadar sürdüğünü. Saçma bir girdi gönderdiğinde hata yanıtının nasıl göründüğünü. Aynı isteğin iki kez aynı yanıtı verip vermediğini. Denemenin telefon görüşmesi gerektirip gerektirmediğini.
Yanıtın biçiminin manşetteki herhangi bir sayıdan daha önemli olmasının nedeni beşinci adım: olasılık ve örnek sayısı olmadan uygulanacak bir eşik yoktur, dolayısıyla "bu dosyanın ne kadarını otomatikleştirebilirim?" sorusunun dürüst yanıtı "tamamını ya da hiçbirini" olur. Ayda 100 ücretsiz sorgu, 300 satırlık bir testi üç kez karşılar.
Bir dil modelini de tartıyorsan
Giderek artan biçimde seçim iki API arasında değil, bir API ile bir prompt arasında oluyor. O karşılaştırma başka şeylere bakar — milyon satır başına maliyet, aynı girdinin iki kez aynı çıktıyı verip vermediği, ve bir denetçiye ne gösterebildiğin — bu yüzden kendi sayfası var.
Entegrasyon gerçekte nasıl görünüyor
Değerlendirmeden sonra değil değerlendirme sırasında bakmaya değer, çünkü bir öğleden sonranın iki haftaya dönüştüğü yer burası. Sorgu başına bir credit, toplu istek başına 100 ad, ve kaç istek yaptığına dair bir üst sınır yok.
- PHP, Python, Node, Java, Go, Ruby, Rust, Perl ve .NET için resmi istemciler.
- OpenAPI açıklamasıyla tam v2 referansı, ayrıca hataların makine tarafından okunabilir olması için RFC 7807 problem yanıtları.
- Yerel bir Excel eklentisi ve bir Shopify uygulaması, Google Sheets, HubSpot, Salesforce, Zapier ve daha fazlası için hazır entegrasyonlar, ve AI araçları için barındırılan bir MCP sunucusu — tam liste.
- Tek seferlik bir dosya için toplu cinsiyet sorgusu, ve köken ihtiyacının parçasıysa addan uyruk.
Fiyatlar 1.000 sorgu için €0.35 ile başlıyor ve fiyat sayfasında tam olarak yazıyor — görmek için teklif almana gerek yok.
Sık sorulan sorular
Cinsiyet API'lerini neye göre karşılaştırmalıyım?
Manşetteki doğruluk oranına değil, tek bir sonucun eline ne verdiğine göre. Yalnızca bir etiket döndüren bir sağlayıcı seni ya her satıra güvenmeye ya da her satırı kontrol etmeye zorlar; olasılık ve arkasındaki kayıt sayısını döndüren bir sağlayıcı ise emin satırları otomatikleştirip yalnızca kalanına bakmanı sağlar. Sonra: aynı ad ülkeye göre farklı yanıtlanabiliyor mu, yanıt zaman içinde sabit kalıyor mu, ad bilinmediğinde ne oluyor ve veriler nerede işleniyor.
Bir API'yi düzgün nasıl test ederim?
Ünlü adlardan oluşan bir örnek üzerinde değil, kendi listende. Cevabını zaten bildiğin birkaç yüz satırı — zor olanlar da dahil — al ve geçir. Ayda 100 ücretsiz sorgu bunun için yeter, ve değerlendirmeye değecek her sağlayıcı aynısını görüşme olmadan yapmana izin verir.
Daha büyük bir ad veritabanı daha mı iyidir?
Tek başına değil. Bir ad, veritabanında üç kaydı da olsa elli bin kaydı da olsa toplama aynı şekilde girer; dolayısıyla toplam sana hangi satırlarına göre hareket edebileceğini söyleyemez. Sonuç başına kanıt söyleyebilir. Boyut, ne sıklıkla hiç yanıt aldığını belirler; örnek sayısı, o yanıtı kullanman gerekip gerekmediğini belirler.
Hangi doğruluk oranını yayınlıyorsunuz?
Bilinçli olarak ölçülmüş bir oran yok. Etiketli bir ad kümesi üzerinde yayınlanmış bir kıyaslama çalışması yapmadık, dolayısıyla bir yüzde vermek kanıt değil pazarlama olurdu. Bunun yerine sana her yanıtın kanıtını veriyoruz — her sonuçta bir olasılık ve bir örnek sayısı — böylece doğruluğu kendi verilerin üzerinde ölçebilirsin; senin durumunu anlatan tek sayı bu. Bir sağlayıcı sana tek bir doğruluk oranı söylüyorsa, hangi adlar üzerinde ölçüldüğünü sor.
Verilerin nerede işlendiği önemli mi?
Listen müşteri adlarından oluşuyorsa önemli, çünkü bunlar kişisel veri. Biz bir Alman şirketiyiz, tüm sunucular Almanya'da, işleme AB içinde yapılıyor ve hesabından bir veri işleme sözleşmesi talep edebilirsin. Kimi değerlendiriyorsan, bunu pilot çalışmadan sonra değil önce yazılı olarak iste.
İnsanların sormayı unuttuğu sorular neler?
Üç tane. Veritabanının bilmediği bir ada ne oluyor — filtreleyebildiğin boş bir alan, fark edemediğin makul bir tahminden daha değerlidir. Aynı isteğin gelecek yıl aynı yanıtı verip vermediği; bu, bir denetim bir kaydın nasıl sınıflandırıldığını sorduğu anda önem kazanır. Ve kullanılmayan kapasitenin süresinin dolup dolmadığı.
TESTİ KENDİ LİSTENDE YAP
Ayda 100 ücretsiz sorgu, kredi kartı yok, görüşme yok. Cevabını zaten bildiğin satırları getir — zor olanlar da dahil — ve her birinin yanında ne döndüğünü gör.
API dokümantasyonu · CSV ya da Excel dosyası yükle · Bize somut bir şey sor