Gender API
Δωρεάν Εγγραφή
Γλώσσα expand_more

Χώρισε ένα πλήρες όνομα σε μικρό όνομα και επώνυμο

Ένα συνδυασμένο πεδίο ονόματος, μία κλήση API, δύο καθαρά πεδία — τα μόρια, οι τίτλοι και η αντίστροφη σειρά που σπάνε έναν χειρόγραφο χωρισμό είναι ήδη αντιμετωπισμένα, και το φύλο βρίσκεται στην ίδια απάντηση.

Τελευταίος έλεγχος 2026-09-01 Γράφτηκε και συντηρείται από την ομάδα του Gender-API.com

Η σύντομη απάντηση

  • Στείλε το συνδυασμένο πεδίο και πάρε πίσω first_name και last_name — μαζί με το φύλο, την ακρίβεια και το πλήθος των samples, στην ίδια απάντηση, για ένα credit.
  • Τα μόρια («van der», «von den», «de la») και οι ακαδημαϊκοί και επαγγελματικοί τίτλοι αντιμετωπίζονται αντί να γίνονται εμπόδιο — και ένα αντεστραμμένο «Rossi, Andrea» λύνεται επίσης, από τα δεδομένα ονομάτων και όχι από το κόμμα.
  • Όπου και τα δύο μισά μπορούσαν να είναι το ένα ή το άλλο, η απόφαση προκύπτει από το πόσο συχνά κάθε μέρος εμφανίζεται ως μικρό όνομα σε σχέση με το πόσο συχνά ως επώνυμο — όχι από τη θέση του στη συμβολοσειρά.
  • Το strict mode επιστρέφει κενό επώνυμο αντί για εικασία όταν το επώνυμο δεν υπάρχει στη βάση, ώστε να βλέπεις το κενό.

Γιατί ο χωρισμός στο κενό δεν δουλεύει

Σχεδόν κάθε κώδικας έχει μια εκδοχή αυτού: πάρε το πεδίο ονόματος, χώρισε στα κενά, το πρώτο στοιχείο είναι το μικρό όνομα, το τελευταίο το επώνυμο. Περνά το review γιατί τα δοκιμαστικά δεδομένα είναι αγγλικά, και πάει σιωπηλά λάθος στον πρώτο πελάτη που δεν είναι.

Τρεις κανόνες εφαρμοσμένοι στο πλήρες όνομα «Anna van der Berg». Ο χωρισμός στο πρώτο κενό δίνει μικρό όνομα Anna και επώνυμο «van»: λάθος. Ο χωρισμός στο τελευταίο κενό δίνει μικρό όνομα «Anna van der» και επώνυμο Berg: επίσης λάθος. Η αναγνώριση του «van der» ως μορίου που ανήκει στο επώνυμο και ο έλεγχος κάθε υποψηφίου στις βάσεις μικρών ονομάτων και επωνύμων δίνει μικρό όνομα Anna και επώνυμο «van der Berg». Οι δύο πρώτοι κανόνες είναι αυτό που κάνει συνήθως ένας χειρόγραφος χωρισμός, και αποτυγχάνουν σιωπηλά.
Το ίδιο όνομα, τρεις κανόνες, δύο λάθος απαντήσεις — και καμία δεν βγάζει σφάλμα.

Ακριβό το κάνει ο τρόπος με τον οποίο αποτυγχάνει. Τίποτα δεν πετάει εξαίρεση. Καταλήγεις με μια βάση γεμάτη ανθρώπους με επώνυμο «van», μια μαζική αποστολή που τους χαιρετά έτσι, και ούτε μια γραμμή log που να δείχνει την αιτία.

Τι καθορίζει τον χωρισμό

Τέσσερα πράγματα, με αυτή τη σειρά — και το τελευταίο δεν μπορεί να το έχει ένας χωρισμός βασισμένος σε κανόνες, γιατί απαιτεί γνώση για το πώς κατανέμονται πραγματικά τα ονόματα.

Τέσσερις μορφές με τις οποίες φτάνει ένα συνδυασμένο πεδίο ονόματος, και τι καθορίζει κάθε χωρισμό. «Rossi, Andrea»: το κόμμα αφαιρείται και η σειρά διαβάζεται από τα δεδομένα ονομάτων αντί να συναχθεί από τη θέση. «Prof. Dr. Anna Maria de la Cruz»: οι τίτλοι αφαιρούνται βάσει γνωστής λίστας, το μόριο μένει με το επώνυμο και διατηρούνται και τα δύο μικρά ονόματα. «Andrea Rossi», όπου και τα δύο μέρη είναι εύλογα ονόματα: ζυγίζεται πόσο συχνά κάθε μέρος εμφανίζεται ως μικρό όνομα σε σχέση με το πόσο συχνά ως επώνυμο, οπότε η θέση δεν το καθορίζει. «Markus Stefan Nonexistent» με ενεργό strict mode: το επώνυμο δεν υπάρχει στη βάση, οπότε επιστρέφει κενό αντί να μαντευτεί.
Τέσσερις πραγματικές μορφές του ίδιου πεδίου, και τι λύνει την καθεμία.
  • Οι τίτλοι φεύγουν πρώτοι. Τα «Prof. Dr.», «Dipl.-Ing.», «Managing Director» και τα υπόλοιπα μιας συντηρούμενης λίστας αφαιρούνται πριν αποφασιστεί οτιδήποτε άλλο, ώστε να μην καταλήξουν ποτέ σε πεδίο ονόματος.
  • Τα μόρια μένουν με το επώνυμο. Τα «van», «van der», «van den», «von», «von der», «de», «de la», «du», «le», «di», «des» και τα συγγενικά τους αναγνωρίζονται ως μέρος του επωνύμου στο οποίο ανήκουν.
  • Η στίξη δεν αναλαμβάνει τη σειρά. Το κόμμα στο «Rossi, Andrea» αφαιρείται μαζί με τους τίτλους, και η σειρά διαβάζεται στη συνέχεια από τα δεδομένα ονομάτων — το κόμμα είναι συνήθεια μορφοποίησης, και πολλές λίστες το χρησιμοποιούν ασυνεπώς. Στο ανέβασμα CSV και Excel μπορείς να δηλώσεις αντ' αυτού τη σειρά της στήλης, και μια δηλωμένη σειρά χρησιμοποιείται όπως δηλώθηκε.
  • Την ασάφεια λύνουν τα δεδομένα. Κάθε υποψήφιο μέρος αναζητείται και στη βάση μικρών ονομάτων και στη βάση επωνύμων, και το μέρος που συμπεριφέρεται πολύ περισσότερο ως επώνυμο παρά ως μικρό όνομα είναι το επώνυμο.

Δώσε έναν κωδικό χώρας και η ίδια σύγκριση γίνεται ως προς εκείνη τη χώρα και όχι ως προς όλες μαζί — και αυτό θέλεις όταν ξέρεις ήδη από πού ήρθε η λίστα.

Πώς το καλείς

Δύο endpoints το κάνουν αυτό, και ποιο θέλεις εξαρτάται από το αν χρειάζεσαι strict mode.

v2 — το τρέχον API

POST https://gender-api.com/v2/gender/by-full-name
{ "full_name": "Anna van der Berg", "country": "NL" }
{
    "result_found": true,
    "first_name": "Anna",
    "last_name": "van der Berg",
    "gender": "female",
    "probability": 0.98,
    "details": { "credits_used": 1, "samples": 8961, "duration": "33ms" }
}

v1 — όταν χρειάζεσαι strict mode

Το strict mode υπάρχει μόνο στο endpoint χωρισμού v1. Αν ένα κενό επώνυμο μετράει για σένα περισσότερο από το να είσαι στο νεότερο API, πάρε αυτό.

GET https://gender-api.com/get?split=Anna%20van%20der%20Berg&strict=true&key=…

Πρώτα: περιέχει καν αυτή η στήλη πλήρη ονόματα;

Αξίζει να το ξέρεις πριν επεξεργαστείς ένα αρχείο που δεν έφτιαξες εσύ. Στείλε ένα δείγμα έως 100 τιμών και παίρνεις πίσω αν μοιάζουν με πλήρη ονόματα — και δεν κοστίζει credits.

POST https://gender-api.com/v2/name-format-detect
{ "names": ["Sophie Jones", "Lorenzo Carlos", "Anna van der Berg"] }
{
    "is_fullname": true,
    "fullname_probability": 1,
    "validHints": [ … ]
}

Να είσαι σαφής για το τι μετρά αυτό: το fullname_probability είναι το ποσοστό των τιμών που έστειλες οι οποίες αποτελούνται από περισσότερες από μία λέξεις, και το is_fullname είναι αυτό το ποσοστό πάνω από 0,6. Είναι κρίση για τη στήλη, όχι για κάθε όνομα χωριστά — ακριβώς αυτό που χρειάζεσαι όταν αποφασίζεις αν θα χωρίσεις καθόλου, και όχι υποκατάστατο του ίδιου του χωρισμού.

Μια μεικτή στήλη είναι επίσης έγκυρη απάντηση: κάποιες λίστες έχουν «Thomas» και «John Smith» δίπλα δίπλα, και ο χωρισμός τα βγάζει πέρα και με τα δύο χωρίς να τα ταξινομήσεις πρώτα.

Πού χρειάζεται ακόμη τη βοήθειά σου

Ένας χωρισμός που θα ισχυριζόταν ότι τα βγάζει πέρα με κάθε όνομα στον κόσμο θα έλεγε ψέματα. Αυτές είναι οι περιπτώσεις όπου κανένας κανόνας δεν λύνει τη συμβολοσειρά από μόνος του.

Αν ελέγχεις τη φόρμα, η φθηνότερη λύση δεν είναι καθόλου API: δύο πεδία αντί για ένα, ή μια υπόδειξη ότι η μορφή είναι «μικρό όνομα, επώνυμο». Όλα τα παρακάτω ισχύουν όταν δεν την ελέγχεις.

  • Επώνυμο πρώτα. Με ή χωρίς κόμμα, κερδίζει η ανάγνωση που στηρίζουν τα δεδομένα ονομάτων έναντι ενός κανόνα για τη θέση — και πέφτει σωστά πολύ πιο συχνά απ' όσο λάθος, αλλά δεν είναι εγγύηση. Αν ξέρεις ότι όλη η στήλη έχει το επώνυμο πρώτα, δήλωσέ το στο ανέβασμα αντί να βασιστείς στη στίξη.
  • Μονολεκτικά ονόματα. Σε ένα μονώνυμο δεν υπάρχει επώνυμο να βρεθεί. Το επώνυμο επιστρέφει κενό αντί να κοπεί στη μέση το μικρό όνομα.
  • Ασυνεπής μεταγραφή. Το ίδιο όνομα γραμμένο με τρεις τρόπους μέσα σε μια λίστα λύνεται ως τρία ονόματα, γιατί αυτό είναι στα δεδομένα.
  • Σύνθετα μικρά ονόματα χωρίς παύλα. Το «Anna Maria» μένει ενωμένο όπου τα δεδομένα το στηρίζουν, αλλά μια λίστα που ανακατεύει «Anna Maria Rossi» και «Anna Rossi» δεν θα είναι ομοιόμορφη.

Και στις τέσσερις περιπτώσεις ένας κωδικός χώρας στενεύει το πρόβλημα, και το strict mode κάνει τις αμφίβολες γραμμές ορατές αντί σιωπηλά εύλογες. Ένα κενό πεδίο που μπορείς να φιλτράρεις είναι καλύτερο από ένα λάθος που δεν εντοπίζεις.

Μια ολόκληρη στήλη μαζί

Αν τα ονόματα βρίσκονται σε λογιστικό φύλλο και όχι σε εφαρμογή, δεν χρειάζεσαι το API. Ανέβασε το αρχείο, δείξε τη στήλη με τα συνδυασμένα ονόματα, και τα χωρισμένα μέρη επιστρέφουν ως νέες στήλες δίπλα στα δεδομένα σου — έως 10,000,000 γραμμές ανά CSV ή 100,000 ανά βιβλίο εργασίας Excel, και το βιβλίο σου επιστρέφει άθικτο.

Συχνές ερωτήσεις

Γιατί να μην χωρίσεις απλώς στο κενό;

Γιατί το κενό δεν είναι το σύνορο. Το «Anna van der Berg» δίνει επώνυμο «van» στο πρώτο κενό και μικρό όνομα «Anna van der» στο τελευταίο. Και τα δύο είναι λάθος, και τα δύο φαίνονται μια χαρά σε δοκιμή με αγγλικά ονόματα, και και τα δύο αποτυγχάνουν σιωπηλά τη στιγμή που εμφανίζεται ένα ολλανδικό, γερμανικό, γαλλικό, ισπανικό ή πορτογαλικό επώνυμο.

Τι καθορίζει πού πέφτει ο χωρισμός;

Πρώτα αφαιρούνται οι γνωστοί τίτλοι, και τα μόρια όπως «van der», «von den» και «de la» μένουν με το επώνυμο. Στη συνέχεια ζυγίζεται πόσο συχνά κάθε μέρος εμφανίζεται ως μικρό όνομα σε σχέση με το πόσο συχνά εμφανίζεται ως επώνυμο — δεν το καθορίζει λοιπόν η θέση της λέξης, ούτε η στίξη: ένα κόμμα αφαιρείται μαζί με τους τίτλους αντί να διαβαστεί ως δείκτης «επώνυμο πρώτα». Στο ανέβασμα CSV και Excel μπορείς να δηλώσεις ρητά τη σειρά της στήλης, και τότε χρησιμοποιείται όπως τη δήλωσες.

Τι συμβαίνει όταν το επώνυμο δεν υπάρχει στη βάση δεδομένων;

Γι' αυτό υπάρχει το strict mode, στο endpoint v1. Με ενεργό strict mode το επώνυμο επιστρέφει κενό αντί να μαντευτεί, ώστε το κενό να φαίνεται στα δεδομένα σου. Χωρίς αυτό, εξάγεται πάντως ένα επώνυμο, όσο καλύτερα γίνεται.

Μου δίνει και το φύλο;

Ναι, στην ίδια απάντηση και για το ίδιο ένα credit — μαζί με το πλήθος των samples και την ακρίβεια πίσω από αυτό. Ο χωρισμός του ονόματος και η αναγνώριση φύλου είναι μία κλήση, όχι δύο.

Πώς ξέρω αν η στήλη μου περιέχει καν πλήρη ονόματα;

Στείλε ένα δείγμα έως 100 τιμών στο endpoint name-format-detect. Δεν κοστίζει credits και απαντά αν η στήλη μοιάζει με πλήρη ονόματα, μικρά ονόματα ή μείγμα — χρήσιμο πριν αποφασίσεις πώς θα επεξεργαστείς το αρχείο.

Πόσο κοστίζει ο χωρισμός;

Ένα credit ανά όνομα, το ίδιο με μια απλή αναγνώριση φύλου, από €0.35 ανά 1.000. Τα credits αγοράζονται προκαταβολικά και δεν λήγουν.

Τα βγάζει πέρα με μη δυτικά ονόματα;

Εν μέρει, και είναι καλύτερα να ξέρεις τα όρια. Τα ονόματα που γράφονται με το επώνυμο πρώτα χωρίς διαχωριστικό, τα μονολεκτικά ονόματα και τα ονόματα με ασυνεπή μεταγραφή είναι οι δύσκολες περιπτώσεις — κανένας κανόνας δεν τις λύνει από τη συμβολοσειρά μόνο. Το να στέλνεις κωδικό χώρας βοηθά, γιατί τότε το ερώτημα ζυγίζει τα μέρη ως προς εκείνη τη χώρα και όχι ως προς όλα.

ΔΟΚΙΜΑΣΕ ΤΟ ΣΤΑ ΟΝΟΜΑΤΑ ΠΟΥ ΣΠΑΝΕ ΤΟΝ ΧΩΡΙΣΜΟ ΣΟΥ

100 δωρεάν ερωτήματα τον μήνα, χωρίς κάρτα. Πάρε τις είκοσι γραμμές που ο τωρινός κώδικάς σου βγάζει λάθος και ξεκίνα από αυτές.

Συνομιλία