Repository logo

Infoscience

  • English
  • French
Log In
Logo EPFL, École polytechnique fédérale de Lausanne

Infoscience

  • English
  • French
Log In
  1. Home
  2. Academic and Research Output
  3. Reports, Documentation, and Standards
  4. Indexation de Documents Manuscrits
 
Loading...
Thumbnail Image
report

Indexation de Documents Manuscrits

Vinciarelli, Alessandro  
2006

Les systèmes de reconnaissance automatique de l'écriture permettent de transfomer des collections de documents manuscrits en archives de documents numériques. L'avantage n'est pas tellement la réduction de l'espace nécéssaire pour stoquer les données, mais plutôt la possibilité d'appliquer les technologies de gestion du contenu normalement utilisées pour des textes numériques tels que pages web et e-mails. Le problème principal dans une telle démarche est que les transcriptions sont généralement bruitées, c'est-à-dire qu'elles sont caracterisées par un taux d'erreur qui peut atteindre, dépendemment des cas, les 50 pour cent. Cet article montre que cela ne constitue pas un problème majeur dans deux cas importants: Information Retrieval et Text Categorization. Une comparaison des résultats obtenus avec les mêmes technologies d'indexation sur les transcriptions manuelles (sans erreur) et automatiques (environ 40% de Term Error Rate) des mêmes documents montre en effet que l'impact sur la performance de l'application finale est négligeable.

  • Files
  • Details
  • Metrics
Loading...
Thumbnail Image
Name

vinciarelli-idiap-rr-06-31.pdf

Access type

openaccess

Size

133.64 KB

Format

Adobe PDF

Checksum (MD5)

e40248c6e418dfc553016dc66e61717d

Logo EPFL, École polytechnique fédérale de Lausanne
  • Contact
  • infoscience@epfl.ch

  • Follow us on Facebook
  • Follow us on Instagram
  • Follow us on LinkedIn
  • Follow us on X
  • Follow us on Youtube
AccessibilityLegal noticePrivacy policyCookie settingsEnd User AgreementGet helpFeedback

Infoscience is a service managed and provided by the Library and IT Services of EPFL. © EPFL, tous droits réservés