¡AdvanThink pone en marcha una cátedra de investigación internacional!

más información
Logotipo
  • Usted es
    • Fraude, ciberdelincuencia y ALD
      • Banca minorista: proteger todos sus medios de pago
      • Banca digital: asegurar el viaje del cliente
      • PSP & ACQUIRER: el servicio antifraude, un elemento diferenciador
      • RBA y DSP2, una ventaja competitiva
      • Lucha contra el blanqueo de capitales y la financiación del terrorismo (AML/CFT)
    • Biología y Salud
      • Investigación médica: análisis multiómico
      • Salud pública: indicadores médico-económicos
    • Sector públicoNuevo
      • Agregación, preparación de datos y control de calidad
      • Dirigir y evaluar las políticas públicas
      • Sector público y detección del fraude
      • Minería de textos y explotación de datos textuales
    • Marketing y empresa
      • Puntuación predictiva
      • Análisis del rendimiento de las ventas
      • Dirección proactiva
    • Finanzas y contabilidad
      • Calificación crediticia
      • Gestión de garantías
  • Una oferta modular
    • Amadea
    • FraudManager
    • Ayuda
  • ¿Quiénes somos?
    • Nuestra razón de ser
    • Innovación I+D
    • AdvanThink en el mundo
  • Recursos
    • Blog
      • Forbes: "Brice Perdrix: neuronas y corazón".
      • 13 de septiembre de 2024: Rugby XV en silla de ruedas
      • AGEFI: AdvanThink pone la IA al alcance de todos los bancos
    • Guías prácticas
      • INTERPRETABILIDAD DE LA IA: El reto de la confianza
      • AI INTERPRETABILIDAD Guía 2/3: Una o varias interpretabilidades
      • AI INTERPRETATION Guía 3/3: Enfoques para interpretar los modelos de IA
  • Carreras
    • La vida en AdvanThink
    • Ofertas de empleo
    • Estudiantes y recién licenciados
  • Contacto
  • Comunidad AdvanThinker
  • icono Solicitar en
  • icono Solicitar una demostración
  • icono Ser llamado de nuevo
Logotipo
  • ¿Quién es usted?
    Todos nuestros sectores
    Fraude, ciberdelincuencia y ALD
    Biología y Salud
    Sector públicoNuevo
    Marketing y empresa
    Finanzas y contabilidad
    Casos prácticos
    Banca minorista: proteger todos sus medios de pago
    Banca digital: asegurar el viaje del cliente
    PSP & ACQUIRER: El servicio antifraude, un elemento diferenciador
    RBA y DSP2, una ventaja competitiva
    Lucha contra el blanqueo de capitales y la financiación del terrorismo (AML/CFT)
    Una solución para
    Gestor de riesgos
    Científico de datos
    Jefe de Datos
    Director de comercio electrónico
    Distribuidor de TI
    Compradores
    Casos prácticos
    Investigación médica: análisis multiómico
    Salud pública: indicadores médico-económicos
    Una solución para
    Director del laboratorio
    Doctor
    Farmacéutico
    Investigador científico
    Biólogos médicos
    Director de TI
    Director General
    Ministerio de Sanidad
    Casos prácticos
    Agregación, preparación de datos y control de calidad
    Orientar las políticas públicas
    Detección de fraudes
    Minería de textos y explotación de datos textuales
    Una solución para
    DSI
    Departamentos de datos
    Analista de datos
    Divisiones de negocio
    Científico de datos
    Ingeniero de datos
    Casos prácticos
    Puntuación predictiva
    Análisis del rendimiento de las ventas
    Dirección proactiva
    Una solución para
    Director / Gerente de Marketing (CMO)
    Director Comercial
    Director de ventas
    Director de TI
    Compradores
    Casos prácticos
    Calificación crediticia
    Gestión de garantías
    Una solución para
    Director Financiero (CFO)
    Director de Control de Gestión
    Director de TI
    Compradores
    Otros proyectos en ia
  • Una oferta modular
    La plataforma
    Amadea
    Gestor de fraudes
    Ayuda
    Amadea
    Descubra nuestra plataforma de ciencia de datos
    Amadea
    Descubra nuestros libros electrónicos sobre Amadea
    FraudManager
    Aprendizaje automático para prevenir la delincuencia financiera
    FraudManager
    Centrarse en la transformación de datos
    Nuestro apoyo
    Formación, asistencia y vigilancia tecnológica, eventos...
    Ayuda
    Nuestros cursos de formación certificados por Qualiopi
  • ¿Quiénes somos?
    ¿Quiénes somos?
    Nuestra razón de ser
    Innovación I+D
    AdvanThink en el mundo
    Nuestra razón de ser
    Nuestra historia, nuestro ADN
    Más de 30 años de experiencia: nuestra razón de ser
    historia
    Nuestra historia
    Innovación e I+D
    ¿Cómo construyen el futuro nuestros AdvanThinkers?
    I+D
    DataMorphing
    Advanthink worldwild
    Nuestra conquista del mundo
    en todo el mundo
    Más de 170 países usuarios
  • Recursos
    Recursos
    Blog
    Guías prácticas
    Blog
    AdvanThink pone en marcha FraudShift, una cátedra de investigación en IA dedicada a la detección del fraude
    AGEFI: AdvanThink pone la IA al alcance de todos los bancos
    Ver todos nuestros artículos
    13 de septiembre de 2024: Rugby XV en silla de ruedas
    Guías prácticas
    INTERPRETABILIDAD DE LA IA: El reto de la confianza
    AI INTERPRETABILIDAD Guía 2/3: Una o varias interpretabilidades
    AI INTERPRETATION Guía 3/3: Enfoques para interpretar los modelos de IA
    Ver todas nuestras guías prácticas
    INTERPRETABILIDAD DE LA IA: El reto de la confianza
  • Carreras
    Carrera profesional
    La vida en AdvanThink
    Ofertas de empleo
    Estudiantes y recién licenciados
    La vida en AdvanThink
    Nuestros valores
    Nuestra calidad de vida en el trabajo
    La vida en AdvanThink
    El polo de innovación - París Saclay
    Ofertas de empleo
    ¡Atrévete con la aventura!
    oferta de empleo
    Razones para unirse a nosotros
    Estudiantes y recién licenciados
    Un trampolín para tu carrera
    estudiantes jóvenes licenciados
    Nuestros testimonios
  • Contacto
Comunidad AdvanThinker
Linkedin-in

Home > [Paroles d’experts] Mettre en qualité des données en volume : un défi d’hier, d’aujourd’hui et de demain

[Paroles d’experts] Mettre en qualité des données en volume : un défi d’hier, d’aujourd’hui et de demain

Compartir
  • 15.01.2026

Cet article a été rédigé par Invenis, avant l’acquisition de la société par AdvanThink

Les enjeux techniques sont aujourd’hui très importants et les DSI, mécaniquement, sont sous pression.
La capacité d’exploitation des données, toutes les données, longtemps stockées dans des bases de données froides, fait aujourd’hui la différence et représente un enjeu de taille.

Ce mois-ci, nous avons eu le plaisir d’échanger avec Thomas Petit, Directeur des Systèmes d’Information et membre de l’Association des DSI & CDO et de l’Agora des DSI/ CDO.

Invenis – En ce début d’année 2024, quel est aujourd’hui d’après vous le plus gros challenge des DSI en termes d’exploitation de la donnée ? Et quel sera le plus gros challenge de demain ?

Le premier enjeu vise à savoir traiter le volume considérable de données disponibles. L’explosion de l’usage du Cloud depuis dix ans a rendu possible le stockage de données, mais leur exploitation reste toujours un défi de taille pour les DSI.

Aujourd’hui, on est capable de stocker des données, pas forcément structurées, mais on n’arrive pas encore à rendre cohérent ce stockage de données pour en tirer des informations. 

Depuis quelques années, nous produisons et stockons des volumes de données considérables. Par exemple, nous devrions produire l’année prochaine 180 zettaoctets de données ! C’est colossal !

Aujourd’hui ces données ne sont peu ou pas traitées, même par des acteurs dont la maturité Data est avancée. Celles qui le font, analysent une partie des données et le font de façon « mono-canal » et sur des données particulièrement normées.

Pourtant, la variété des données stockées a aussi explosé et aujourd’hui, des informations précieuses se trouvent dans d’autres données (e-mails, appels téléphoniques, réseaux sociaux…). La richesse de ces données se déploiera lorsque l’on sera vraiment capable de croiser ces différents types de données.  Ce chantier de traiter, croiser des données de tout volume, de toute nature est le premier grand chantier des DSI.

Et dans les faits, c’est effectivement extrêmement difficile !

Le traitement et l’exploitation des données ne sont pas le cœur de métier de la plupart des entreprises. Pour ces entreprises-là, externaliser cette compétence semble difficile tant l’usage de la donnée est lié à la connaissance métier de chaque acteur.  D’où l’émergence depuis quelques années du rôle de CDO, le Chief Data Officer, dont le rôle est de recenser (car elles peuvent être dans des bases différentes, sous des formats différents, parfois les équipes n’en ont pas connaissance !) catégoriser, structurer les données disponibles de l’entreprise. Le CDO va pouvoir cartographier ces données pour coordonner les actions et visualiser l’écosystème de données.

Ensuite, il faudra qu’il travaille avec les équipes métiers et IT pour voir comment transformer ces informations pour en en faire quelque chose d’intéressant, c’est-à-dire, comment tirer de la valeur de ces données.

Je pense donc que l’enjeu des cinq prochaines années ne sera pas une révolution mais un démarrage : les outils sont là, l’Intelligence Artificielle est là mais il faudra exploiter ses données ou prendre le risque de disparaitre.

Ceux qui ont un train d’avance sur ces sujets-là pourront proposer des services dont d’autres n’ont même pas encore conscience. Pour cela, il faudra également réussir l’industrialisation de ces projets Data et être capable de gérer du temps réel.

Imaginons un monde dans lequel on peut faire de la recommandation hyper-contextualisée en couplant toutes sortes de données : données de ventes, données comportementales, données en Open Data type météo, données socio-économiques… À la fin, on pourra définir l’ensemble des critères qui poussent à l’achat à un instant T, être très pertinents en termes de messages et d’offres et maximiser ses ventes.

Cela peut faire un peu peur, mais c’est aussi un gage de compréhension des besoins des consommateurs. Ceux qui prendront ce virage pourront se différencier de façon extrêmement forte et c’est à mon sens fondamental.

Invenis – Selon Gartner, 25% des données critiques exploitées par les entreprises sont erronées, faute de Data Quality.

Quelles actions concrètes menez-vous en tant que DSI pour surpasser ce problème de Data Quality ?

Pourquoi est-ce si difficile pour les organisations de mettre en qualité leurs données ?

Nous l’avons vu précédemment : la quantité des données explose.

Et c’est un problème de gérer ce volume et de le gérer en temps réel.
Aujourd’hui, on empile des données dans des bases de données, sans les trier, les filtrer, les préparer au fur et à mesure. Et une fois que nous sommes face à ces milliards de données, il est difficile de savoir par où commencer et comment mettre en qualité ces données.
Parfois même, il est impossible de les mettre en qualité.

Par exemple, si le problème de qualité est lié à la façon dont sont collectées les données, c’est quasiment impossible de retraiter ces informations. Prenons l’exemple de données qui seraient collectées par des humains. S’il manque des informations, comment retrouver l’information vérifiée, 2 ans après sa collecte ? Si la donnée a été mal normée, comment la normaliser après autant de temps ?

En parallèle, toutes les données qu’on a collectées il y a 10 ans ne sont pas forcément utiles aujourd’hui et on ne peut pas toujours reconstituer de la donnée créée il y a quelques années.

Pour mettre en qualité des données collectées et stockées il y a de cela des années, le chantier est colossal… Et souvent, les organisations ne savent pas comment s’y prendre.

En revanche, on peut préparer l’avenir et le temps présent en proposant des aides à la saisie, ou en travaillant avec de l’Intelligence Artificielle pour corriger les données au moment où elles sont saisies. La préparation des données en temps réel, au moment de la collecte permettrait de de mieux qualifier les données et lutter contre ce problème de Data Quality à la racine.

Mais même l’IA n’est pas infaillible aujourd’hui !

Il faut donc cadrer au maximum les informations dès lors qu’elles rentrent dans les bases de données. Les capteurs d’IoT (Internet of Things) le font très bien par exemple : les données sont formatées et qualifiées en amont de manière très fines en vue de leur utilisation future.

Une des solutions est donc normaliser cette collecte, et encore plus lorsqu’elle implique une intervention Homme-Machine.

L’industrialisation des projets Data fait encore figure d’exception dans les organisations. Pourquoi n’arrive-t-on pas encore à industrialiser les projets ? Est-ce un problème et comment y remédier ?

Pour bien comprendre de quoi il s’agit, je vous propose qu’on se pose cette question : que signifie « industrialiser » un projet Data ?

Si l’on prend l’exemple de la production de voitures chez Ford, il s’est agi de découper l’ensemble des tâches en opérations unitaires facilement réplicables.
La notion de réplicabilité est fondamentale quand on parle d’industrialisation.

Pour industrialiser, il faut être capable de répliquer, de recommencer les opérations, sans changer à chaque fois le moule en entrée et en sortie.

Pour l’exploitation de la Data, c’est pareil. Pour industrialiser un projet Data, il faut que le moule d’entrée soit le plus homogène possible, de même pour le moule de sortie.

Et c’est là que les problèmes se posent.

Le volume et la diversité des données rendent très compliquée l’industrialisation de la récupération de toutes ces informations. Dans des structures de taille moyenne, on peut avoir parfois jusqu’à 20 Systèmes d’Informations, chacun apportant des types de données différents (CRM, comptabilité, logistique…), tous d’éditeurs différents, exploités par des gens différents, collectées différemment.

Parfois, il faudra recréer des systèmes d’information et ce sont des projets lourds.

On peut bien sûr externaliser la production d’un projet et d’un écosystème Data, mais ce sont des projets longs et chers, tant en termes de ressources humaines que de ressources techniques (et le cloud, ça coûte cher !).

Si ce n’est pas le fondement de l’entreprise, c’est difficile et du coup, les projets ne s’industrialisent pas.

Le no-code est en pleine expansion dans les organisations et certaines études promettent que les applications no-code vont progressivement équiper de nombreuses organisations. Quels sont les avantages et les limites de s’équiper de solutions no-code d’après vous ?

Le no-code, en termes de traitement de données, a cet avantage d’accélérer l’accès à certaines analyses. Il permet aussi à des profils non experts de la donnée, comme les métiers, de s’emparer des sujets de la donnée, d’agencer leurs données pour produire des résultats très rapides. C’est donc un facteur de démocratisation de la donnée au niveau de l’utilisateur final et permet de gérer, pour les équipes Data comme métiers, le goulet d’étranglement des besoins en matière d’exploitation de la donnée.


Mais il faut que l’accès au no-code soit cadré, notamment pour éviter les risques de Shadow IT et donc mise en danger des données. Il peut être tentant pour aller plus vite, de contourner les règles d’achat IT et d’utiliser des outils accessibles en ligne.

Ces outils librement accessibles peuvent envoyer les données sur le Cloud, à des endroits qui ne sont pas maitrisés.  En matière de cyber sécurité et de protection des données sensibles de l’organisation, cela peut vraiment être problématique.

Et en même temps, le Shadow IT comprend un paradoxe : le risque qu’il engendre va parfois permettre de démontrer un ROI ! Par exemple, une petite expérience réalisée dans un coin qui va fonctionner et permettre une prise de conscience collective, preuve à l’appui…

Donc le no-code est vraiment pertinent, mais dans le cadre de l’exploitation de la donnée, il faut vraiment veiller à limiter le Shadow IT !

Les enjeux de souveraineté numérique semblent aujourd’hui importants.

En tant que professionnel de l’IT, choisir des sous-traitants Français souverains est-il un facteur important selon vous ? Pourquoi ?

À titre personnel, je pense que choisir des sous-traitants Français est important à deux niveaux :

  • D’abord, pour l’image de marque de mon entreprise. Choisir le « Made in France » peut être un argument marketing de mon entreprise, à mettre en avant. Par exemple, le « Made in France » va rassurer les clients quand on parle de traitement de données personnelles même si je trouve personnellement ce côté chauvin un peu désuet à l’heure de l’Europe.
  • Ensuite, dans certains cas, l’aspect règlementaire prime et le choix est limité. Par exemple, dans le cadre du RGPD, on est contraint de respecter par exemple des règles d’hébergement, ce qui limite le choix et pousse à se tourner vers des hébergeurs souverains.

En France, nous avons un bel écosystème Tech et je pense que c’est important de les consulter, à la fois pour faire tourner l’économie nationale mais aussi pour financer l’innovation.

Notre « French Tech » innove, mais les entreprises sont souvent petites et la question qui se pose alors est : « Vais-je être capable de travailler de façon industrielle avec cet acteur ? ». La limite, c’est la pérennité des projets et malheureusement, c’est souvent plus rassurant de travailler avec de gros acteurs plutôt qu’avec de plus petits.

Après, par expérience, dans la Tech de niche, on peut avoir des bonnes surprises, notamment car les petits acteurs, plus agiles, vont pouvoir accélérer le « Time-to-Market ».

Enfin, faire appel à des prestataires souverains permet de maintenir une excellence française et aujourd’hui, il est important de se dire qu’on peut être en autarcie sur certains sujets sans être dépendants de certains acteurs étrangers qui vont nous imposer des conditions commerciales ou qui vont avoir accès à des informations critiques. Mais il faut faire attention de ne pas choisir français juste parce que c’est français. Il faut à mon sens, toujours comparer à qualité équivalente.

Donc pour répondre à votre question : souveraineté numérique, européenne, oui, mais la performance et la qualité des services avant tout !

Thomas Petit est DSI avec plus de 25 ans d’expérience dans des organisations diverses (au sein de domaines IT aussi variés que la banque (BNP Paribas, Crédit Agricole), l’industrie (Saverglass), la formation (Demos, Aston Groupe SQLi), la santé (CHU d’Amiens, CH du Mans, mentorat européen EIT Health de start-up en santé) ou le service (Altran, ManpowerGroup Talent Solutions).

Depuis 25 ans, il veille à créer du dialogue entre les équipes métiers et les équipes techniques, en vue de maximiser l’efficacité de la fonction IT et de positionner la DSI au cœur des enjeux métiers de l’entreprise. Pour sortir de la « technique pour la technique », et devenir un véritable acteur de la croissance de l’activité.

Il est également membre de l’Association Nationale des DSI & CDO ainsi que de l’Agora des DSI/CDO pour des échanges constructifs entre pairs.

Cet article est issu d’une interview de l’équipe Invenis d’AdvanThink

Images : Photo de Diego PH sur Unsplash, de Claudio Schwarz sur Unsplash

Leer también

Manténgase al día de nuestras últimas noticias y descubra las novedades que darán forma a su experiencia con nosotros.

Todas las noticias
  • 09.07.2026

AdvanThink ha obtenido la certificación «Sustainable Provider» del programa Pacto Mundial de las Naciones Unidas

AdvanThink se une al programa de formación del Pacto Mundial de Estados Unidos Las cuestiones relacionadas con la responsabilidad social ya no afectan únicamente a las grandes empresas. Hoy en día, las organizaciones también esperan que sus socios y proveedores compartan los mismos requisitos en materia de ética, medio ambiente, gobernanza y respeto de los derechos humanos.
  • 21.05.2026

AdvanThink pone en marcha FraudShift, una cátedra de investigación en IA dedicada a la detección del fraude

AdvanThink anuncia la creación de la cátedra de investigación «FraudShift: Trusted, Adaptive & Robust AI for Fraud Detection», en colaboración con la Universidad de Amberes. Inaugurada oficialmente el 12 de mayo de 2025 durante una ceremonia académica celebrada en el Campus Ville de la Universidad de Amberes, esta colaboración de tres años aúna la experiencia de la Facultad de Ciencias de la Universidad de Amberes y las capacidades de I+D de AdvanThink en torno a un reto fundamental: detectar el fraude de forma más rápida, fiable y adaptativa gracias a la inteligencia artificial.
  • 03.02.2026

Subcontratación de datos: ¿cómo proteger tus datos?

En 2022, Francia fue el segundo país del mundo con mayor densidad de violaciones de datos, con 23 451 violaciones por cada 100 000 habitantes y más de 15 000 000 de violaciones* en total. Por lo tanto, Francia constituye un objetivo privilegiado en lo que respecta a los ciberataques.
Todas las noticias
logotipo
Comunidad Advanthinkers
solicite una demostración
Contacto

Usted es

Fraude, ciberdelincuencia y ALD

Biología y Salud

Sector público

Marketing y empresa

Finanzas y contabilidad

Industria

Datos y ciencia de datos

+ otros 4

^ mostrar menos

Una oferta modular

Amadea

Gestor de fraudes

Ayuda

Quiénes somos

Nuestra razón de ser

Innovación I+D

Presencia internacional

Recursos

Blog

Glosario AI

Carreras

Vida @AdvanThink

Ofertas de empleo

Estudiantes y recién licenciados

Conectar

Pulse

Youtube

Twitter

LinkedIn

Suscríbase a nuestro boletín

Siga nuestras noticias sobre IA cada mes

AdvanThink ©2023

Información jurídica

-

Política de privacidad

-

Condiciones generales de uso

Solicitar en
Solicitar una demostración
Ser llamado de nuevo