@inproceedings{li-gaussier-2023-adaptation,
title = "Adaptation de domaine pour la recherche dense par annotation automatique",
author = "Li, Minghan and
Gaussier, Eric",
editor = {Zargayouna, Ha{\"\i}fa},
booktitle = "Actes de CORIA-TALN 2023. Actes de la 18e Conf{\'e}rence en Recherche d'Information et Applications (CORIA)",
month = "6",
year = "2023",
address = "Paris, France",
publisher = "ATALA",
url = "https://aclanthology.org/2023.jeptalnrecital-coria.6",
pages = "93--110",
abstract = "Bien que la recherche d{'}information neuronale ait connu des am{\'e}liorations, les mod{\`e}les de recherche dense ont une capacit{\'e} de g{\'e}n{\'e}ralisation {\`a} de nouveaux domaines limit{\'e}e, contrairement aux mod{\`e}les bas{\'e}s sur l{'}interaction. Les approches d{'}apprentissage adversarial et de g{\'e}n{\'e}ration de requ{\^e}tes n{'}ont pas r{\'e}solu ce probl{\`e}me. Cet article propose une approche d{'}auto-supervision utilisant des {\'e}tiquettes de pseudo-pertinence automatiquement g{\'e}n{\'e}r{\'e}es pour le domaine cible. Le mod{\`e}le T53B est utilis{\'e} pour r{\'e}ordonner une liste de documents fournie par BM25 afin d{'}obtenir une annotation des exemples positifs. L{'}extraction des exemples n{\'e}gatifs est effectu{\'e}e en explorant diff{\'e}rentes strat{\'e}gies. Les exp{\'e}riences montrent que cette approche aide le mod{\`e}le dense sur le domaine cible et am{\'e}liore l{'}approche de g{\'e}n{\'e}ration de requ{\^e}tes GPL.",
language = "French",
}
<?xml version="1.0" encoding="UTF-8"?>
<modsCollection xmlns="http://www.loc.gov/mods/v3">
<mods ID="li-gaussier-2023-adaptation">
<titleInfo>
<title>Adaptation de domaine pour la recherche dense par annotation automatique</title>
</titleInfo>
<name type="personal">
<namePart type="given">Minghan</namePart>
<namePart type="family">Li</namePart>
<role>
<roleTerm authority="marcrelator" type="text">author</roleTerm>
</role>
</name>
<name type="personal">
<namePart type="given">Eric</namePart>
<namePart type="family">Gaussier</namePart>
<role>
<roleTerm authority="marcrelator" type="text">author</roleTerm>
</role>
</name>
<originInfo>
<dateIssued>2023-06</dateIssued>
</originInfo>
<typeOfResource>text</typeOfResource>
<language>
<languageTerm type="text">French</languageTerm>
<languageTerm type="code" authority="iso639-2b">fre</languageTerm>
</language>
<relatedItem type="host">
<titleInfo>
<title>Actes de CORIA-TALN 2023. Actes de la 18e Conférence en Recherche d’Information et Applications (CORIA)</title>
</titleInfo>
<name type="personal">
<namePart type="given">Haïfa</namePart>
<namePart type="family">Zargayouna</namePart>
<role>
<roleTerm authority="marcrelator" type="text">editor</roleTerm>
</role>
</name>
<originInfo>
<publisher>ATALA</publisher>
<place>
<placeTerm type="text">Paris, France</placeTerm>
</place>
</originInfo>
<genre authority="marcgt">conference publication</genre>
</relatedItem>
<abstract>Bien que la recherche d’information neuronale ait connu des améliorations, les modèles de recherche dense ont une capacité de généralisation à de nouveaux domaines limitée, contrairement aux modèles basés sur l’interaction. Les approches d’apprentissage adversarial et de génération de requêtes n’ont pas résolu ce problème. Cet article propose une approche d’auto-supervision utilisant des étiquettes de pseudo-pertinence automatiquement générées pour le domaine cible. Le modèle T53B est utilisé pour réordonner une liste de documents fournie par BM25 afin d’obtenir une annotation des exemples positifs. L’extraction des exemples négatifs est effectuée en explorant différentes stratégies. Les expériences montrent que cette approche aide le modèle dense sur le domaine cible et améliore l’approche de génération de requêtes GPL.</abstract>
<identifier type="citekey">li-gaussier-2023-adaptation</identifier>
<location>
<url>https://aclanthology.org/2023.jeptalnrecital-coria.6</url>
</location>
<part>
<date>2023-6</date>
<extent unit="page">
<start>93</start>
<end>110</end>
</extent>
</part>
</mods>
</modsCollection>
%0 Conference Proceedings
%T Adaptation de domaine pour la recherche dense par annotation automatique
%A Li, Minghan
%A Gaussier, Eric
%Y Zargayouna, Haïfa
%S Actes de CORIA-TALN 2023. Actes de la 18e Conférence en Recherche d’Information et Applications (CORIA)
%D 2023
%8 June
%I ATALA
%C Paris, France
%G French
%F li-gaussier-2023-adaptation
%X Bien que la recherche d’information neuronale ait connu des améliorations, les modèles de recherche dense ont une capacité de généralisation à de nouveaux domaines limitée, contrairement aux modèles basés sur l’interaction. Les approches d’apprentissage adversarial et de génération de requêtes n’ont pas résolu ce problème. Cet article propose une approche d’auto-supervision utilisant des étiquettes de pseudo-pertinence automatiquement générées pour le domaine cible. Le modèle T53B est utilisé pour réordonner une liste de documents fournie par BM25 afin d’obtenir une annotation des exemples positifs. L’extraction des exemples négatifs est effectuée en explorant différentes stratégies. Les expériences montrent que cette approche aide le modèle dense sur le domaine cible et améliore l’approche de génération de requêtes GPL.
%U https://aclanthology.org/2023.jeptalnrecital-coria.6
%P 93-110
Markdown (Informal)
[Adaptation de domaine pour la recherche dense par annotation automatique](https://aclanthology.org/2023.jeptalnrecital-coria.6) (Li & Gaussier, JEP/TALN/RECITAL 2023)
ACL