5-9 juin 2023 PARIS (France)
Jeu de données de tickets de caisse pour la détection de fraude documentaire
Beatriz Martínez Tornés  1@  , Théo Taburet  1, *@  , Emanuela Boros  2, *@  , Kais Rouis  1, *@  , Petra Gomez-Krämer  1, *@  , Nicolas Sidere  1, *@  , Antoine Doucet  1, *@  , Vincent Poulain D'andecy  3, *@  
1 : Laboratoire Informatique, Image et Interaction - EA 2118
La Rochelle Université
2 : CMCS-EPFL
3 : Yooz
Yooz
* : Auteur correspondant

L'utilisation généralisée de documents numériques non sécurisés par les entreprises et les administrations comme pièces justificatives les rend vulnérables à la falsification. En outre, les logiciels de retouche d'images et les possibilités qu'ils offrent compliquent les tâches de la détection de fraude d'images numériques. Néanmoins, la recherche dans ce domaine se heurte au manque de données réalistes accessibles au public. Dans cet article, nous proposons un nouveau jeu de données pour la détection des faux tickets contenant 988 images numérisées de tickets et leurs transcriptions, provenant du jeu de données SROIE (scanned receipts OCR and information extraction). 163 images et leurs transcriptions ont subi des modifications frauduleuses réalistes et ont été annotées. Nous décrivons en détail le jeu de données, les falsifications et leurs annotations et fournissons deux baselines (basées sur l'image et le texte) sur la tâche de détection de la fraude.


Personnes connectées : 1 Vie privée
Chargement...