Aujourd’hui, le Web est devenu une source d’information incontournable grâce à la quantité et à la diversité des contenus textuels porteurs d’opinions exprimés par les internautes. Ces contenus sont multiples : blogs, commentaires, forums, réseaux sociaux, réactions ou avis, de plus en plus centralisés par les moteurs de recherche. Devant cette abondance de données et de sources, le développement d’outils pour extraire, synthétiser et comparer les opinions exprimées sur un sujet donné devient crucial. L’intérêt de ce type d’outils est considérable, pour les sociétés qui souhaitent obtenir un retour client sur leurs produits ou leur image de marque comme pour les particuliers souhaitant se renseigner pour un achat, une sortie ou un voyage.
C’est dans ce contexte que l’analyse d’opinions (communément appelée
sentiment analysis
ou
opinion mining
en anglais) a vu le jour. Les premiers travaux en extraction automatique d’opinions remontent à la fin des années 1990 avec, en particulier, des études traitant de la détermination de la polarité des adjectifs dans les documents, c’est-à-dire la détermination du caractère positif ou négatif de l’opinion véhiculée par les adjectifs. Depuis les années 2000, un grand nombre de travaux ont été publiés sur le sujet, faisant de l’extraction d’opinions l’un des domaines les plus actifs en Traitement Automatique des Langues (TAL)
[H7258]
et en fouille de données, avec plus de 26 000 publications recensées sur Google Scholar. Il est important de noter qu’avant d’être un domaine de recherche en informatique, l’analyse d’opinions a été largement étudiée en linguistique
, psychologie