Etudes sur la géolocalisation de Tweets

Thibaud Martin


Abstract
La géolocalisation de textes non structurés est un problème de recherche consistant à extraire uncontexte géographique d’un texte court. Sa résolution passe typiquement par une recherche de termesspatiaux et de la désambiguïsation. Dans cet article, nous proposons une analyse du problème, ainsi que deux méthodes d’inférence pourdéterminer le lieu dont traite un texte : 1. Comparaison de termes spatiaux à un index géographique2. Géolocalisation de textes sans information géographique à partir d’un graphe de co-occurrencede termes (avec et sans composante temporelle) Nos recherches sont basées sur un dataset de 10 millions de Tweets traitant de lieux français, dont57 830 possèdent une coordonnée géographique.
Anthology ID:
2023.jeptalnrecital-rjc.8
Volume:
Actes de CORIA-TALN 2023. Actes des 16e Rencontres Jeunes Chercheurs en RI (RJCRI) et 25e Rencontre des Étudiants Chercheurs en Informatique pour le Traitement Automatique des Langues (RÉCITAL)
Month:
6
Year:
2023
Address:
Paris, France
Editors:
Marie Candito, Thomas Gerald, José G Moreno
Venue:
JEP/TALN/RECITAL
SIG:
Publisher:
ATALA
Note:
Pages:
114–130
Language:
French
URL:
https://aclanthology.org/2023.jeptalnrecital-rjc.8
DOI:
Bibkey:
Cite (ACL):
Thibaud Martin. 2023. Etudes sur la géolocalisation de Tweets. In Actes de CORIA-TALN 2023. Actes des 16e Rencontres Jeunes Chercheurs en RI (RJCRI) et 25e Rencontre des Étudiants Chercheurs en Informatique pour le Traitement Automatique des Langues (RÉCITAL), pages 114–130, Paris, France. ATALA.
Cite (Informal):
Etudes sur la géolocalisation de Tweets (Martin, JEP/TALN/RECITAL 2023)
Copy Citation:
PDF:
https://aclanthology.org/2023.jeptalnrecital-rjc.8.pdf