<?xml version="1.0" encoding="utf-8" standalone="yes"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom">
  <channel>
    <title>Association Francophone de Recherche d&#39;Information et Applications</title>
    <link>http://www.asso-aria.org/coria/2007/papers/</link>
    <description>Recent content on Association Francophone de Recherche d&#39;Information et Applications</description>
    <generator>Hugo</generator>
    <language>fr</language>
    <atom:link href="http://www.asso-aria.org/coria/2007/papers/index.xml" rel="self" type="application/rss+xml" />
    <item>
      <title>Considérations sur l&#39;évaluation de la robustesse en recherche d&#39;information.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.5/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.5/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Cette communication évalue et compare l&amp;rsquo;efficacité de modèles vectoriels, probabilistes ou de langue afin de dépister des articles de presse rédigés en langue française. En se basant sur un corpus créé durant trois campagnes d&amp;rsquo;évaluation CLEF et comprenant&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;This paper describes and evaluates vector-space, probabilistic and language IR models used to retrieve news articles from a corpus written in the French language. Based on three CLEF test-collections and 151 topics, we analyze the retrieval effectiveness of these approaches and analyze the poor retrieval results of hard topics.  An appropriate robust evaluation is not easy because both the mean average precision (MAP) or the geometric mean (GMAP) present some drawbacks. In order to obtain a better picture, we suggest using the First Relevant Score (or FRS, based on the rank of the first relevant item). We evaluate and compare these three measures in particular when using blind query expansion technique. MOTS-CLÉS : Evaluation de recherche robuste ; expansion aveugle ; requêtes difficiles. KEY WORDS : Robust evaluation; blind query expansion; hard queries.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Co-citations sur le Web : Recherche de Similarité entre les Articles Scientifiques.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.21/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.21/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans cet article nous introduisons une nouvelle méthode pour estimer la similarité entre les articles scientifiques en utilisant un moteur de recherche sur le Web. Dans cette mé- thode, la similarité entre deux articles est basée sur le nombre de fois où ils sont mentionnés ensemble sur le Web. Cette méthode est appelée la méthode des co-citations sur le Web. Nous avons fait des expérimentations pour comparer la performance de différentes méthodes de cita- tions: couplage bibliographique, co-citation traditionnelle avec la base de données de citation Web of Science, et notre méthode co-citations sur le Web avec le moteur de recherche Google. Les résultats des expérimentations ont montré que notre approche est efficace pour découvrir la similarité entre les articles scientifiques.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Apport des services Web dans l&#39;amélioration de l&#39;accès à l&#39;information sur le Web ?</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.35/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.35/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;La difficulté à trouver de l&amp;rsquo;information sur le Web croît et ceci même pour les plus experts des utilisateurs. Afin de mieux comprendre comment recherchent les internautes, nous avons observé cinq adultes et quatre enfants. Des protocoles d&amp;rsquo;observation différents, présentant tous deux des recherches imposées et libres, ont été définis pour les enfants et les adultes. Nous avons pu définir un certain nombre de comportements, d&amp;rsquo;attitudes et de difficultés. Le résultat de ces observations ainsi que l&amp;rsquo;analyse des comportements sont présentés dans ce papier dans le but d&amp;rsquo;introduire la contribution des services Web dans l&amp;rsquo;aide à l&amp;rsquo;accès à l&amp;rsquo;information et à la recherche sur le Web.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Une approche d&#39;extraction et de recherche d&#39;information spatiale dans les documents textuels - évaluation.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.53/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.53/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Ce papier propose une approche d&amp;rsquo;Extraction d&amp;rsquo;Information (EI) et de Recherche d&amp;rsquo;Information (RI) spatiales dans le cadre de bibliothèques numériques liées au patrimoine culturel local. L&amp;rsquo;approche proposée (implémentée dans le prototype PIV) est construite autour d&amp;rsquo;une analyse sémantique de tels corpus et de&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;This paper deals with Information Extraction and Retrieval in a Geographic oriented Digital Libraries environment. The proposed approach (implemented within PIV prototype) is based on a semantic analysis of digital corpora and free text queries. First, we&lt;/p&gt;</description>
    </item>
    <item>
      <title>Indexation sémantique et recherche d&#39;information interactive.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.65/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.65/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Parmi les différentes facettes de la recherche d&amp;rsquo;information en données textuelles, la recherche d&amp;rsquo;informations localisées dans l&amp;rsquo;espace et dans le temps constitue un domaine d&amp;rsquo;étude à part entière. Celle-ci nécessite en effet, pour l&amp;rsquo;indexation comme pour la recherche, des analyses linguistiques et des ressources spécifiques. Le projet GéoSem fut le cadre de conception  de  techniques  d&amp;rsquo;indexation  sémantique  d&amp;rsquo;informations  géographiques.  Ces techniques  se  trouvent  aujourd&amp;rsquo;hui  mises  en  oeuvre  au  sein  d&amp;rsquo;un  moteur  de  recherche permettant la localisation intra-documentaire des informations, indexées selon des u axes sémantiques » géographiques (temps, espace et phénomène), sa généricité permettant de le paramétrer pour d&amp;rsquo;autres axes. Une visualisation de la localisation spatiale et temporelle de l&amp;rsquo;information est également proposée. Cet article décrit les différentes facettes du moteur.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Combinaison des caractéristiques des termes pour l&#39;extension de requêtes en recherche d&#39;information dans les documents semi-structurés.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.77/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.77/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;En Recherche d&amp;rsquo;Information (RI), l&amp;rsquo;utilisateur a souvent recours, pour des raisons de simplicité, à de simples mots clés pour exprimer sa requête. Les requêtes composées de mots clés sont aussi très utilisées dans le cadre de la recherche d&amp;rsquo;information structurée (c&amp;rsquo;est à dire dans des documents structurés de type XML), puisqu&amp;rsquo;elles n&amp;rsquo;exigent pas une connaissance ap- profondie de la structure des documents. Ces requêtes sont cependant souvent insuffisantes pour décrire les besoins de l&amp;rsquo;utilisateur. Dans cet article, nous proposons une nouvelle approche de reformulation de requêtes à base de mots clés dans des documents XML. Cette approche permet d&amp;rsquo;une part d&amp;rsquo;enrichir la requête initiale en fonction des jugements de pertinence, et d&amp;rsquo;autre part d&amp;rsquo;exprimer des degrés de préférence pour chaque nouveau mot clé : c&amp;rsquo;est ce qu&amp;rsquo;on appelle la re- pondération. Notre approche est basée sur une combinaison de mesures caractérisant un terme dans les éléments jugés pertinents pour une requête donnée. Nos propositions ont été évaluées grâce à la campagne d&amp;rsquo;évaluation INEX et les résultats montrent l&amp;rsquo;intérêt de nos méthodes.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Apprentissage actif pour l&#39;annotation de documents.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.93/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.93/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans le cadre du projet LegDoc au Centre Européen de Recherche de Xerox, nous avons développé des composants pour l&amp;rsquo;annotation sémantique de documents semi-structurés. Alors que certaines entités sémantiques ont une forme régulière et peuvent être facilement ex- traites, d&amp;rsquo;autres collections plus complexes et hétérogènes nous ont amenés à déployer des méthodes d&amp;rsquo;apprentissage automatique. Dans les cas réels nous sommes souvent confrontés au problème technique de la non disponibilité de corpus annotés, pour des tâches d&amp;rsquo;annotations spécifiques. Comme l&amp;rsquo;annotation manuelle est coûteuse et propice à l&amp;rsquo;erreur, notre approche consiste à appliquer des méthodes d&amp;rsquo;apprentissage actif afin de considérablement réduire le corpus nécessaire à l&amp;rsquo;élaboration d&amp;rsquo;un modèle pertinent. Dans cet article, nous expliquons comment le principe de l&amp;rsquo;apprentissage actif est adapté à l&amp;rsquo;annotation interactive de documents orientés mise en page. Pour une utilisation efficace de l&amp;rsquo;apprentissage actif sur les grandes col- lections, nous déployons un classifieur probabiliste basé sur le principe de l&amp;rsquo;entropie maximum ainsi que trois métriques d&amp;rsquo;incertitude. Nous présentons le prototype ALDAI (Active Learning Document Annotation) et décrivons ses fonctionnalités ainsi que les choix d&amp;rsquo;implémentation. Le prototype offre une interface WYSIWYG, un haut langage pour la définition des attributs et intègre le composant d&amp;rsquo;apprentissage actif qui vise à assister l&amp;rsquo;utilisateur dans le processus d&amp;rsquo;annotation. Nous rapportons aussi des résultats de tests d&amp;rsquo;évaluation des techniques d&amp;rsquo;ap- prentissage actif sur une collection de données publiques (UCI) et une collection de documents internes.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Adaptation de XML et XQuery pour la représentation et l&#39;interrogation des documents multi-structurés.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.109/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.109/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Nous traitons dans cet article le problème de l&amp;rsquo;interrogation des documents à structures multiples, appelés aussi documents multi-structurés. Pour des besoins d&amp;rsquo;usages variés, plusieurs structurations différentes peuvent être associées à un même document initial. Par exemple, une première structure peut être définie pour organiser logiquement le contenu d&amp;rsquo;un document tandis qu&amp;rsquo;une deuxième explicitera les règles de sa mise en forme sur un support physique. Dans de précédents travaux, nous avons proposé une modélisation générique prenant en compte différents aspects de ce type de document. Partant de ce modèle nous avons également proposé un formalisme, basé sur XML, appelé MultiX permettant la sérialisation d&amp;rsquo;un document multi-structuré. Dans cet article, nous étudions l&amp;rsquo;exploitation de ces documents dans le contexte de la recherche d&amp;rsquo;information. Pour interroger efficacement les documents multi-structurés au format MultiX nous avons développé une extension du langage XQuery sous forme d&amp;rsquo;une bibliothèque de fonctions spécifiques permettant d&amp;rsquo;explorer les documents en prenant en compte la sémantique du format MultiX.&lt;/p&gt;</description>
    </item>
    <item>
      <title>L&#39;Agrégation en Recherche d&#39;Information.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.125/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.125/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Ce papier donne une nouvelle présentation des modèles standards de la recherche d&amp;rsquo;information, décrits selon deux dimensions. La première porte sur les sources d&amp;rsquo;évidence qu&amp;rsquo;utilisent les modèles et la manière dont ils les agrègent pour mesurer l&amp;rsquo;importance ou le poids d&amp;rsquo;un terme dans un document. La seconde concerne la manière dont ces poids sont agré- gés pour calculer un score de pertinence. Les mécanismes d&amp;rsquo;agrégation utilisés dans les deux cas sont alors explicités et critiqués motivant le recours à une nouvelle famille de méthodes basées sur de nouveaux mécanismes d&amp;rsquo;agrégation plus adaptés.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Intégration de règles d&#39;association pour améliorer la recherche d&#39;informations XML.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.137/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.137/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;La reformulation de requêtes constitue un moyen d&amp;rsquo;améliorer la recherche d&amp;rsquo;informations, en particulier lorsque cela concerne  des documents XML. Les approches existantes se basent sur une connaissance du domaine (thésaurus, ontologie) pour étendre la requête initiale. Nous proposons une approche de reformulation automatique basée sur une technique de datamining. Nous intégrons les règles d&amp;rsquo;association dans le système de recherche d&amp;rsquo;informations que nous avons développé pour les documents XML. Cela présente l&amp;rsquo;avantage de ne pas dépendre d&amp;rsquo;une connaissance du domaine préétablie qui n&amp;rsquo;est pas toujours disponible mais plutôt de s&amp;rsquo;appuyer sur une connaissance dynamique et cachée.&lt;/p&gt;</description>
    </item>
    <item>
      <title>La visualisation de données relationnelles au service de la recherche d&#39;informations.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.149/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.149/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans le cadre de la recherche d&amp;rsquo;informations, la restitution des documents s&amp;rsquo;effectue selon leur score de pertinence calculé, correspondant à une requête précise. Cependant des questions se posent quant à la représentation des documents et des requêtes ainsi que leur mise en correspondance. Le graphe est utilisé comme moyen de représentation et de visualisation de données, sans nécessiter de pré requis mathématique particulier. Cet article présente les apports de la visualisation d&amp;rsquo;information à la recherche d&amp;rsquo;information, en s&amp;rsquo;attachant au processus de conception d&amp;rsquo;un outil de visualisation et d&amp;rsquo;analyse développé par l&amp;rsquo;équipe SIG/EVI de l&amp;rsquo;IRIT le prototype VisuGraph. Dans ce contexte, nous proposons de nouvelles approches pour la visualisation des réseaux d&amp;rsquo;informations, afin d&amp;rsquo;en extraire avec facilité les documents les plus pertinents. Nous développons cette approche et nous illustrons notre contribution par des exemples concrets.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Filtrage Collaboratif avec un Algorithme d&#39;Ordonnancement.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.165/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.165/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;A ce jour, la plupart des travaux en filtrage collaboratif se basent sur la prédiction de notes pour générer des recommandations. Dans ce papier, nous choisissons d&amp;rsquo;explorer une autre voie, consistant à ordonner correctement les articles selon les goûts des utilisateurs. D&amp;rsquo;abord, nous définissons une erreur d&amp;rsquo;ordonnancement qui prend en compte les préférences par paires d&amp;rsquo;articles. Puis nous construisons un algorithme efficace qui optimise cette erreur. Enfin, nous testons notre approche sur une base standard de filtrage collaboratif. Pour cela, nous adap- tons le protocole d&amp;rsquo;évaluation initialement proposé par (Marlin, 2004a) pour la prédiction de notes à notre cas, où ce sont des préférences par paires qui sont prédites. Nous comparons nos performances avec celles de deux méthodes basées sur la prédiction de notes. Nous suggérons différentes directions pour continuer l&amp;rsquo;exploration de notre approche basée sur la prédiction d&amp;rsquo;ordres pour le filtrage collaboratif.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Vers une indexation personnalisée de photographies par apprentissage non supervisé de régularités.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.181/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.181/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Cet article propose une approche pour indexer des images photographiques avec pour objectif de permettre une bonne qualité d&amp;rsquo;annotation des images et aussi un moyen de visualiser, pour un utilisateur non expert, ce que le système apprend pour éventuellement corriger un apprentissage défectueux. Notre approche repose sur la génération de régularités dans l&amp;rsquo;espace des caractéristiques extraites en se basant sur un apprentissage non supervisé, puis sur un apprentissage supervisé afin d&amp;rsquo;associer ces régularités à des termes d&amp;rsquo;indexation. Des expérimentations préliminaires sur des photographies ont été menées et sont décrites.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Modèle évolutif d&#39;un profil utilisateur.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.197/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.197/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;La prise en compte des besoins, des intentions et des spécificités cognitives, cuturelles ou autres, qui caractérisent le profil d&amp;rsquo;un utilsiateur constitue un élément déterminant pour améliorer la pertinence des réponses lors d&amp;rsquo;une session de Recherche d&amp;rsquo;Information dans de grandes bases de documents. La modélisation des profils et la manière de les adapter à différents utilisateurs qui n&amp;rsquo;ont pas une idée précise sur l&amp;rsquo;information qu&amp;rsquo;ils recherchent, nous permet d&amp;rsquo;offrir un accès personnalisé au contenu de documents scientifiques fondé sur l&amp;rsquo;exploitation du profil d&amp;rsquo;utilisateur. Nous proposons dans cet article, un modèle de l&amp;rsquo;utilisateur fondé sur les connaissances et un système implémentant le raisonnement à partir des cas, pour acquérir ces connaissances, les structurer et les faire évoluer.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Un modèle pour l&#39;interrogation visuelle des documents structurés.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.211/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.211/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans cet article, nous présentons un modèle d&amp;rsquo;interrogation visuelle des documents structurés permettant de représenter graphiquement les requêtes utilisateurs sous forme de graphe, et d&amp;rsquo;effectuer ainsi des requêtes d&amp;rsquo;une rare complexité syntaxique et sémantique. Le modèle est validé par le développement d&amp;rsquo;un prototype XmlBrowser permettant d&amp;rsquo;explorer et d&amp;rsquo;interroger une collection de documents structurés (Xml).&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;In this article, we present a visual querying model of the structured documents making it possible to represent graphically the users query in the form of graph, thus to carry out query of a rare syntactic and semantic complexity.  The model is validated by the development of an XmlBrowser prototype for seamlessly browsing and querying a collection of structured document (Xml).&lt;/p&gt;</description>
    </item>
    <item>
      <title>Intégrer plus de connaissances linguistiques en recherche d&#39;information peut-il augmenter les performances des systèmes ?</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.223/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.223/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Cet article pose la question de l&amp;rsquo;intérêt en RI de la combinaison au&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;None&lt;/p&gt;</description>
    </item>
    <item>
      <title>Prédiction du SRI à utiliser en fonction des critères linguistiques de la requête.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.239/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.239/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;En recherche d&amp;rsquo;information (RI), plusieurs techniques existent et sont utilisées par les systèmes pour répondre de manière efficace aux requêtes des utilisateurs. Nous nous intéressons dans ce papier à comment utiliser les caractéristiques linguistiques des requêtes pour prédire le(s) meilleur(s) système(s) à utiliser pour une requête donnée. Pour ce faire, nous avons utilisé 13 critères linguistiques définis dans (Mothe et al, 2005) pour catégoriser les requêtes de la campagne TREC 3, 5, 6 et 7. Chaque catégorie de requête est ensuite associée à un ou plusieurs systèmes. Les résultats montrent que notre méthode permet d&amp;rsquo;améliorer les performances de la recherche en fonction des campagnes TREC de 2,31% à 6,81% pour la P@15 et jusqu&amp;rsquo;à 16,27% pour la MAP.&lt;/p&gt;</description>
    </item>
    <item>
      <title>DefAcro : mesure de qualité pour le choix de la définition des acronymes ambigus.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.255/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.255/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Cet article présente un ensemble de mesures de qualité pour déterminer le choix de la meilleure définition pour un acronyme non défini dans la page Web le contenant. L&amp;rsquo;approche contextuelle que nous proposons utilise des statistiques calculées à partir de pages Web pour déterminer la définition appropriée. Les premiers résultats sont très satisfaisants car la défini- tion pertinente des acronymes est trouvée dans 92 à 98% des cas.&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;This paper offers a set of quality measures to determine the choice of the best ex- pansion for an acronym not defined in the Web page that uses it. The contextual approach we promote uses statistics computed on Web pages to determine the appropriate definition. The first results are very satisfactory because the relevant acronym expansion is found in 92 to 98% of the time.&lt;/p&gt;</description>
    </item>
    <item>
      <title>D&#39;une compacité positionnelle à une compacité probabiliste pour un système de Questions / Réponses.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.271/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.271/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans cet article, nous présentons une discussion sur la définition d&amp;rsquo;un score de compacité pour permettre l&amp;rsquo;extraction d&amp;rsquo;une réponse dans un système de Questions/Réponses. Ce score de compacité qui peut être succinctement décrit comme une fonction liée a la densité des termes de la question dans le voisinage d&amp;rsquo;une réponse candidate, est présenté en détail. Ensuite, une discussion nous amène à envisager une extension de ce score, initialement défini d&amp;rsquo;un point de vue positionnel, vers un modèle probabiliste ; cela afin de mieux prendre en compte des critères d&amp;rsquo;importance variable pour les mots de la question. Cette discussion est validée par des expériences où ce critère d&amp;rsquo;importance est modélisé à l&amp;rsquo;aide d&amp;rsquo;un calcul d&amp;rsquo;IDF (u Inverse Document Frequency »), et nous montrons que nous obtenons des résultats similaires à ceux obtenus lors de notre participation à la campagne d&amp;rsquo;évaluation EQueR des systèmes de Questions/Réponses.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Evaluation modulaire d&#39;un système de questions-réponses sur un corpus de questions semi-spontanées.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.287/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.287/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Cet article présente une évaluation séquentielle du système de questions-réponses modulaire et stochastique SQuALIA. L&amp;rsquo;évaluation se fonde sur un corpus de question semi- spontanées obtenu en faisant poser 20 questions de référence à des adultes francophones, non francophones ou dyslexiques. Les expériences montrent que ce sont les fautes d&amp;rsquo;orthographe qui ont le plus d&amp;rsquo;impact sur les modules d&amp;rsquo;analyse. En moyenne le système parvient à ne trouver des réponses qu&amp;rsquo;à 60% des questions posées, ce qui conduit à imaginer l&amp;rsquo;intégration d&amp;rsquo;un correc- teur orthographique en amont des systèmes, plus de souplesse dans l&amp;rsquo;analyse, et la conservation de l&amp;rsquo;incertitude tout au long du processus en le formalisant à l&amp;rsquo;aide d&amp;rsquo;un modèle probabiliste.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Traduction automatique de termes biomédicaux pour la recherche d&#39;information interlingue.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.303/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.303/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans cet article, nous présentons une méthode de traduction automatique de termes biomédicaux. Cette méthode s&amp;rsquo;appuie sur une technique originale d&amp;rsquo;apprentissage supervisé de règles de réécriture et sur l&amp;rsquo;utilisation de modèles de langue. Les évaluations présentées montrent que notre technique est très performante et permet de traduire à partir et à desti- nation de n&amp;rsquo;importe quelle langue pourvu que leurs différences soient suffisamment régulières pour être apprises. Cette méthode de traduction est appliquée et évaluée sur une tâche de RI interlingue dans le domaine biomédical avec des requêtes dans différentes langues (français, espagnol, portugais, russe, italien); les bons résultats obtenus démontrent l&amp;rsquo;intérêt de cette ap- proche automatique pour la recherche d&amp;rsquo;information.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Recherche d&#39;information et analyse bibliographique appliquées à la mise à jour automatique de Swiss-Prot.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.319/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.319/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;But : Le but de cette étude est de découvrir de nouveaux articles scientifiques utiles pour la mise à jour de l&amp;rsquo;information dans la base de données de biologie moléculaire UniProtKB/Swiss-Prot. Notre hypothèse de base est qu&amp;rsquo;un article qui cite un autre article déjà référencé dans une entrée Swiss-Prot pour une protéine donnée est un bon candidat pour mettre à jour l&amp;rsquo;information de l&amp;rsquo;entrée de cette protéine dans la base. Méthodes : La procédure expérimentale pour tester cette hypothèse est la suivante : dans chaque entrée UniProtKB/Swiss-Prot nous séparons l&amp;rsquo;ensemble des références bibliographiques connues (ERB) en deux ensembles : l&amp;rsquo;ensemble des références connues (ERC) et l&amp;rsquo;ensemble des références à découvrir (ERD) par notre système. Notre système va proposer un ensemble de références possibles (ERP). Nous évaluons la performance de deux différentes méthodes en comparant la précision de notre détecteur de nouveauté, c&amp;rsquo;est-à-dire en mesurant le rapport entre ERD et ERP. La première méthode, guidée par les références (GR) analyse les références bibliographiques d&amp;rsquo;un article donné pour prévoir son intérêt pour la mise à jour de UniProtKB/Swiss-Prot. Pour cette approche, nous utilisons un analyseur HTML de bibliographie afin d&amp;rsquo;identifier dans notre corpus les articles citant des articles contenus dans ERB. La deuxième méthode, guidée par la recherche documentaire (GD) utilise un moteur de recherche pour classer par ordre de pertinence un ensemble d&amp;rsquo;articles en fonction d&amp;rsquo;une requête contenant le nom de la protéine et ses synonymes. Pour cette approche, nous avons récupéré l&amp;rsquo;ensemble des champs MEDLINE; résumé, titre, termes MeSH (Medical Subject Headings ou Mots clés médicaux) et les noms chimiques correspondants à ces PMID afin de les indexer dans le moteur de recherche. Résultats : On trouve une importante corrélation (0.74) entre les deux méthodes GR et GD. Toutefois des différences demeurent, en particulier, la précision des premiers documents retournés par méthode GD est sensiblement supérieure (0.46) à celle de la méthode GR (0.31). La fusion des deux méthodes par combinaison linéaire, qui obtient un gain significatif&lt;/p&gt;</description>
    </item>
    <item>
      <title>Une approche de représentation de l&#39;information en RI basée sur les sousarbres.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.335/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.335/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Ce papier propose une approche de recherche d’information basée sur l’utilisation&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;The paper proposes an approach to information retrieval based on the use of a conceptual structure both for indexing document and expressing user queries. The conceptual structure is hierarchical and it is formally represented as a weighted tree. In this approach, the evaluation of queries is based on the comparison of minimal sub-trees containing the two sets of nodes corresponding to the concepts expressed in the document and the query respectively. The comparison is based on the computation of a multiple-valued degree of inclusion. Some candidate implications are discussed on the basis of their respective semantics. The proposed approach generalizes standard fuzzy information retrieval and its evaluation on benchmark example is also presented.&lt;/p&gt;</description>
    </item>
    <item>
      <title>EDOLA : Une nouvelle méthode d&#39;alignement d&#39;ontologies OWL-Lite.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.351/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.351/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;L&amp;rsquo;alignement d&amp;rsquo;ontologies revêt toute son importance dans des applications nécessi- tant la prise en compte d&amp;rsquo;une interopérabilité sémantique. Plusieurs approches d&amp;rsquo;alignement d&amp;rsquo;ontologies existent dans la littérature. Elles sont basées sur les mesures de similarités. Dans ce papier, une nouvelle méthode d&amp;rsquo;alignement d&amp;rsquo;ontologies OWL-Lite est décrite. Le module d&amp;rsquo;alignement implémente une nouvelle approche d&amp;rsquo;alignement d&amp;rsquo;ontologies qui défi- nit un modèle global de calcul de similarité, tout en remédiant au problème de l&amp;rsquo;intervention de l&amp;rsquo;utilisateur dans le processus d&amp;rsquo;alignement. Les tests expérimentaux réalisés sur les ontologies de benchmark montrent une nette amélioration des métriques de rappel et de précision.&lt;/p&gt;</description>
    </item>
    <item>
      <title>AGATHE : une architecture générique à base d&#39;agents et d&#39;ontologies pour la collecte d&#39;information sur domaines restreints du Web.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.367/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.367/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;La collecte pertinente d&amp;rsquo;information sur le Web est une tâche très complexe et les moteurs de recherche actuels, reposant sur des méthodes d&amp;rsquo;indexation et de recherches basées sur des mots-clés, ont de très faibles taux de précision. Les recherches qu&amp;rsquo;ils réalisent sont essentiellement lexicales statistiques et ne prennent pas en compte leurs contextes sous- jacents. En se limitant à des domaines restreints, la prise en compte de ces contextes est possible et doit conduire à des collectes plus pertinentes. Dans ce papier, est proposée une collecte coopérative d&amp;rsquo;information à base d&amp;rsquo;agents logiciels et d&amp;rsquo;ontologies. Ensuite, une architecture logicielle générique, AGATHE, mettant en oeuvre ce type de collecte et permettant le développement de systèmes de collecte relatif à un ou plusieurs domaines, est présentée en détail.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Indexation de documents multimédia par réseaux d&#39;opérateurs.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.385/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.385/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Le franchissement du fossé sémantique entre les descriptions au niveau signal et au niveau sémantique est le principal problème à résoudre pour l&amp;rsquo;indexation multimédia. Les ap- proches les plus avancées prennent en compte plusieurs types de descripteurs, plusieurs moda- lités et/ou le contexte pour améliorer la détection des concepts. Afin de maîtriser la complexité liée à l&amp;rsquo;intégration de données et de traitement hétérogènes que cela suppose, nous proposons une approche à base d&amp;rsquo;opérateurs organisés en réseaux flots de données. Un type unique de don- nées, les numcepts, et un type unique d&amp;rsquo;unités de traitements, les opérateurs, sont utilisés à tous les niveaux dans ces réseaux. Cette approche offre une grande flexibilité pour la conception des systèmes d&amp;rsquo;indexation et elle facilite les expérimentations sur les architectures correspondantes. Nous décrivons une instance de ce modèle et plusieurs numcepts et opérateurs. L&amp;rsquo;approche a été testée sur les corpus TRECVID 2004 et 2005. Nous avons implémenté 7 réseaux et étudié l&amp;rsquo;influence de variations sur la précision moyenne des concepts détectés.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Connaître la Couleur des Objets pour Segmenter les Images et Améliorer la Recherche d&#39;Images sur le Web.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.401/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.401/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Les résultats des moteurs actuels de recherche d&amp;rsquo;images sur le web sont très bruités, c&amp;rsquo;est-à-dire que quand nous cherchons un objet précis, un grand nombre d&amp;rsquo;images retournées par le système ne concerne pas la requête : environ 50% de ces images sont hors-sujet. Dans cet article, nous expliquons comment utiliser la connaissance de la couleur des objets pour trouver l&amp;rsquo;objet recherché dans les images, et nous proposons également deux méthodes pour connaître automatiquement la couleur d&amp;rsquo;un objet, afin que le traitement dans son ensemble puisse être complètement automatique. Les résultats obtenus montrent que cette méthode permet de réduire le bruit dans les images retournées d&amp;rsquo;environ 20% si nous gardons 25% des images, et fournit en même temps une segmentation automatique de l&amp;rsquo;objet qui pourrait servir par exemple pour le groupement ou pour l&amp;rsquo;apprentissage d&amp;rsquo;objets.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Recherche d&#39;information dans les bases d&#39;images de manuscrits anciens par une caractérisation multiéchelle des écritures.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.413/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.413/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;-Dans cet article, nous proposons une approche originale de la caractérisation des écritures&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;The aim of this scientific work is to propose an original approach of writers characterization based on the handwriting multi scale decomposition into two main features: curvature and orientation. For every shape point, those two dimensions are extracted by a Curvelets analysis before getting joined together in a compact signature. Curvelets are a specialised version of anisotropic wavelets which are well adapted to the representation of discontinuities along shapes. This is a new geometric multi scale transform for which  atoms  are  indexed  by  their  position,  scale  and  orientation. They  integrate  the  concept  of directionnality and allow a sparse representation of images containing objects with many borders, as it is the case of handwritings. For each image, this characterization is synthesized in a compact and single signature used in our information retrieval system dedicated to medieval and humanistic writings. This tool provides very promising results to the use of experts in histories, literatures and palaeographers.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Fusion d&#39;informations pour l&#39;indexation de photos.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.425/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.425/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Cet article présente une méthode d&amp;rsquo;indexation de photos appliquée à la reconnaissance de personnes dans des photos personnelles afin de permettre à un utilisateur de les retrouver à partir de requêtes correspondant à des identifiants de personnes. Cette méthode utilise la fusion d&amp;rsquo;index-FUSINDEX- issus de l&amp;rsquo;analyse de la photo elle-même et de l&amp;rsquo;analyse des com- mentaires textuels et oraux qui lui ont été associés. Ces analyses sont effectuées par différents moteurs d&amp;rsquo;indexations dédiés qui sont intégrés au sein d&amp;rsquo;un système global d&amp;rsquo;indexation et de recherche de photos. Le cadre théorique utilisé par la méthode de fusion définie est celui des fonctions de croyance afin de gérer au mieux l&amp;rsquo;incertitude et l&amp;rsquo;imprécision des moteurs.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Exploitation des connaissances d&#39;UMLS pour la recherche d&#39;information médicale. Vers un modèle bayésien d&#39;indexation.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.443/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.443/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;La recherche d&amp;rsquo;information à base de connaissances est largement étudiée, mais avec peu de succès. Dans cet article, nous étudions l&amp;rsquo;impact de l&amp;rsquo;exploration d&amp;rsquo;une base de connais- sance, nommée méta thésaurus UMLS pour la recherche d&amp;rsquo;information médicale. D&amp;rsquo;abord, l&amp;rsquo;in- dexation par concepts d&amp;rsquo;UMLS extrait dans des textes ne montre qu&amp;rsquo;une légère amélioration de MAP(Mean Average Precision) par rapport à l&amp;rsquo;indexation par termes. Nous intégrons ensuite les étiquettes sémantiques des concepts dans une indexation multicouche qui donne des résul- tats encourageants pour la collection ImageCLEF 2006. Pourtant, nous notons un problème de rappel dans les cas où le concept de la requête est plus général que celui des documents. Afin de résoudre ce problème, nous proposons un modèle basé sur un réseau bayesien pour capturer les liens générique-spécifique entre concepts de la requête et ceux des documents.&lt;/p&gt;</description>
    </item>
    <item>
      <title>La recherche d&#39;information évolutive dans des documents de type encyclopédique : l&#39;apport de techniques linguistiques.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.449/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.449/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans cet article nous présentons la notion d&amp;rsquo;information évolutive : le développement de ce concept s&amp;rsquo;inscrit dans le cadre d&amp;rsquo;un projet de recherche industriel visant la recherche automatique de segments textuels nécessitant une mise à jour de l&amp;rsquo;information dans un but éditorial. Pour répondre à cet objectif nous faisons l&amp;rsquo;hypothèse de la nécessité d&amp;rsquo;associer des techniques issues de la recherche d&amp;rsquo;information à des techniques linguistiques.&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;In this article we present the concept of evolving information : the development of this concept lies within the scope of an industrial research project aiming at the automatic search for textual segments requiring an update of information with a leading aim. To meet this aim we make the assumption of the need for associating techniques resulting from the search for information linguistic techniques.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Validation syntaxique de relations sémantiques pour la RI.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.455/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.455/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Avec l&amp;rsquo;objectif d&amp;rsquo;améliorer la précision des systèmes de recherche d&amp;rsquo;information, c&amp;rsquo;est-à-dire les premiers résultats retrouvés par le système, des travaux se sont basés sur des indexations structurées des documents, à base d&amp;rsquo;arbres ou de graphes. La plupart de ces travaux utilisent comme index des structures uniques et certaines. Les décisions qui ont amené à la sélection de certaines informations lors de la création de la structure à partir du texte ne sont plus disponibles et ne sont pas utilisées. Ce type d&amp;rsquo;information nous parait pourtant essentiel pour obtenir des résultats précis. Nous proposons ici une méthode permettant de donner un poids d&amp;rsquo;extraction à des relations sémantiques à partir des éléments syntaxiques qui les composent dans le texte. Pour valider ce poids, nous intègrerons cette pondération dans un modèle de recherche d&amp;rsquo;information basé sur des graphes de concepts et nous évaluerons ce modèle sur la collection CLEF-Image 2005.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Association d&#39;un détecteur de visages et d&#39;un détecteur d&#39;entités nommées pour l&#39;annotation automatique d&#39;images.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.461/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.461/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans cet article, nous proposons une méthode d&amp;rsquo;annotation d&amp;rsquo;images de visages dans un grand corpus réel de documents texte-images. Cette méthode s&amp;rsquo;appuie sur l&amp;rsquo;utilisation conjointe d&amp;rsquo;un détecteur de visages et d&amp;rsquo;un détecteur d&amp;rsquo;entités nommées : les images contenant des visages sont annotées par les entités nommées les plus fréquentes dans le texte accompa- gnant les images. Bien que basique, cette méthode donne de bons résultats. Elle constitue un premier pas vers des méthodes d&amp;rsquo;indexation textuelle des images plus élaborées et basées sur des caractéristiques haut-niveau des documents.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Recherche contextuelle d&#39;information.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.467/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.467/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;La recherche contectuelle d&amp;rsquo;information a pour objectif de mieux répondre aux besoins de l&amp;rsquo;utilisateur et de lui délivrer de l&amp;rsquo;information pertinente selon son contexte spécifique de recherche. Ce papier présente un contexte de recherche à deux dimensions: le contexte de l&amp;rsquo;utilisateur et le contexte de la requête. On vise à intégrer ces deux dimensions du contexte dans un processus de recherche d&amp;rsquo;information afin d&amp;rsquo;asseoir un système de recherche d&amp;rsquo;information contextuelle.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Annotation d&#39;images sur de grands corpus réels de données.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.473/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.473/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans cet article, nous vérifions les limitations des techniques d&amp;rsquo;annotation d&amp;rsquo;images sur un corpus réel et de grande taille. Pour cela, nous utilisons un corpus de documents texte- images composé de plus de 25000 articles de presse, sur lequel nous évaluons la similarité entre une recherche basée sur le texte et une recherche basée sur l&amp;rsquo;image. Les systèmes de recherche que nous utilisons sont des outils communs de la Recherche d&amp;rsquo;Information (RI). Les résultats montrent que les systèmes de RI utilisés donnent des résultats différents : l&amp;rsquo;association simple des descripteurs utilisés ici ne semble donc pas appropriée pour l&amp;rsquo;annotation de données réelles. Cela met en avant la nécessité de développer un modèle permettant de prendre en compte, de manière cohérente, des descripteurs textuels et visuels pour réaliser l&amp;rsquo;indexation sémantique d&amp;rsquo;images.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Propositions pour la recherche contextuelle d&#39;images dans des documents XML.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.479/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.479/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Cet article s&amp;rsquo;inscrit dans le cadre de la recherche d&amp;rsquo;images dans des documents XML. Ce type de recherche peut utiliser des informations sémantiques en plus des informations vi- suelles de l&amp;rsquo;image. Nous nous proposons ici d&amp;rsquo;explorer des pistes pour la recherche de ces informations sémantiques au sein des documents XML, en supposant qu&amp;rsquo;une image peut être présentée par les autres éléments non images du document XML. Nous proposons d&amp;rsquo;une part une méthode pour choisir quels sont les éléments d&amp;rsquo;un document XML pouvant participer au mieux à la représentation de l&amp;rsquo;image, et d&amp;rsquo;autre part, une mesure qui évalue pour chaque élé- ment non image sa participation dans la représentation de l&amp;rsquo;image.&lt;/p&gt;</description>
    </item>
    <item>
      <title>Indexation relationnelle pour la recherche de documents structurés interreliés.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.485/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.485/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;En recherche d&amp;rsquo;information, dans le cas de documents structurés sans inter-relations, se pose le problème de naviguer dans la structure des documents résultats. Si nous ajoutons la prise en compte de relations entre doxels qui ne sont pas des relations de composition, le pro- blème de la navigation dans l&amp;rsquo;espace résultat est encore accru. Dans cet article, nous décrivons une indexation relationnelle du corpus basée sur des valeurs d&amp;rsquo;exhaustivités et de spécificités relatives entre doxels inter-reliés ; ajoutée à l&amp;rsquo;indexation structurelle, elle permet d&amp;rsquo;enrichir l&amp;rsquo;index des doxels et permettra de favoriser la navigation dans l&amp;rsquo;espace résultat.&lt;/p&gt;</description>
    </item>
    <item>
      <title>L&#39;arbre recouvrant dans l&#39;interrogation de documents XML.</title>
      <link>http://www.asso-aria.org/coria/2007/papers/coria.2007.491/</link>
      <pubDate>Mon, 01 Jan 0001 00:00:00 +0000</pubDate>
      <guid>http://www.asso-aria.org/coria/2007/papers/coria.2007.491/</guid>
      <description>&lt;h1 id=&#34;résumé&#34;&gt;Résumé&lt;/h1&gt;&#xA;&lt;p&gt;Dans cet article nous présentons un modèle d&amp;rsquo;interrogation flexible de données&lt;/p&gt;&#xA;&lt;h1 id=&#34;abstract&#34;&gt;Abstract&lt;/h1&gt;&#xA;&lt;p&gt;In this paper, we propose a fuzzy model to querying the XML documents, by taking into account not only the document contents, but also their structure. The concept of minimal size spanning tree is employed to determine the fragments of documents which coincide as much as possible with a query tree and the fuzzy logic framework is used to represent a user&amp;rsquo;s criteria through weighted formulas according to the level of user&amp;rsquo;s knowledge in documents structures&lt;/p&gt;</description>
    </item>
  </channel>
</rss>
