1 dépôt
Collections of relationship titles and kinship terms used for linguistic analysis.
Distinct from Relationship Data Storage: Shortlist candidates refer to database relationship tuples or ER diagrams, not linguistic kinship terms.
Explore 1 awesome GitHub repository matching data & databases · Kinship Lexicons. Refine with filters or upvote what's useful.
Ce projet est une collection organisée de noms, prénoms et termes de parenté chinois conçus pour l'analyse linguistique et le traitement du langage naturel (NLP). Il fonctionne comme un jeu de données de noms multilingue et une ressource d'entraînement pour la reconnaissance d'entités nommées, fournissant un dépôt unifié de noms à travers les langues chinoise, japonaise et anglaise. Le projet inclut un générateur de noms synthétiques qui crée des noms de personnes réalistes en appliquant des modèles de dénomination analysés et des données démographiques. Il fournit également un lexique d'idiomes chinois nettoyé, rassemblé et dédoublonné à partir de multiples sources. Les données disponibles prennent en charge une variété de tâches de traitement du langage naturel, incluant la segmentation de mots et le prétraitement de texte. Le corpus inclut des registres catégorisés de noms genrés, de noms de famille et de titres de relation pour aider au marquage d'entités et à la recherche linguistique.
Provides a comprehensive collection of Chinese kinship and relationship titles for entity tagging.