ChatGPT commet-il du plagiat ?

Beaucoup de gens pensent que ChatGPT génère des réponses en copiant des expressions et des phrases issues de données stockées.

Cependant, la réalité est plus nuancée. Nous expliquons ci-dessous comment ChatGPT génère du texte, et dans quels cas ses résultats peuvent créer plagiat les risques, et comment l'utiliser de manière responsable sans enfreindre les normes académiques, professionnelles ou éditoriales.

Entrons dans le vif du sujet.


Principaux enseignements

  • De par sa conception, ChatGPT produit des formulations originales. Il génère des réponses en s'appuyant sur des prédictions apprises, plutôt qu'en copiant à partir d'une base de données de sources.

  • Cependant, l'utilisation de ChatGPT n'est pas exempte de plagiat, car cet outil génère parfois de courts passages de texte qui ressemblent à des contenus existants, tels que des citations, des formules standardisées ou des passages largement repris. 

  • L'utilisation de ChatGPT pour paraphraser des idées, des cadres conceptuels et des données provenant d'autres sources est également considérée comme du plagiat.


ChatGPT commet-il du plagiat ? La réponse sans détours

ChatGPT ne commet pas de plagiat au sens traditionnel du terme. De par leur conception, les modèles d'IA générative visent à produire du contenu dont la formulation est entièrement originale, plutôt que de reproduire mot pour mot des sources identifiables.

Cependant, cette distinction ne suffit pas à elle seule à garantir que l'écriture générée par l'IA soit sans risque. L'utilisation de ChatGPT peut être considérée comme du plagiat dans certains cas précis, tels que ceux-ci :

  • ChatGPT peut encore produire des textes qui ressemblent à des contenus existants. Cela se produit généralement lorsqu'on lui demande de s'inspirer de citations célèbres, de formules toutes faites ou d'autres contenus largement répandus.
  • Certains auteurs utilisent ChatGPT pour paraphraser des idées, des cadres conceptuels et des données provenant d'autres sources. Le fait de ne pas citer correctement ces sources fait de ce travail un cas de plagiat.  

Comment ChatGPT génère réellement du texte

ChatGPT génère des réponses en appliquant des schémas linguistiques appris à de nouvelles demandes et à de nouveaux contextes de conversation. Ce processus produit généralement de nouvelles formulations plutôt que de reproduire des textes existants, ce qui réduit le risque de plagiat.

Détection de l'IA Détection de l'IA

Ne vous inquiétez plus jamais de la détection de vos messages par l'IA. Undetectable AI peut vous aider :

  • Faites apparaître votre écriture assistée par l'IA à l'image de l'homme.
  • By-pass tous les principaux outils de détection de l'IA en un seul clic.
  • Utilisation AI en toute sécurité et en toute confiance à l'école et au travail.
Essaie GRATUITEMENT

Données d'entraînement vs stockage mot pour mot

Par défaut, ChatGPT ne plagie pas, car il n'est pas conçu pour restituer des copies exactes du contenu stocké. Il apprend plutôt des modèles statistiques à partir des données d'entraînement.

Lorsqu'un utilisateur saisit une requête, le système applique ces modèles appris au contexte de la conversation afin de prédire l'unité de texte suivante, appelée « token ». Il génère des réponses un token à la fois jusqu'à ce que la pensée, la phrase ou le paragraphe soit complet. 

Pourquoi deux personnes obtiennent des réponses différentes à la même question

Comme ChatGPT génère ses réponses un token à la fois plutôt que de récupérer des copies exactes d'expressions existantes, les réponses varient généralement d'une requête à l'autre.

Des différences au niveau de l'historique des conversations, des instructions du système, de la version du modèle, des paramètres ou du processus d'échantillonnage du modèle peuvent amener ChatGPT à proposer des réponses différentes, même lorsque les utilisateurs formulent leurs requêtes exactement de la même manière. 

Dans quelle mesure les résultats de ChatGPT sont-ils originaux ? Une démonstration

Afin d'évaluer dans quelle mesure ChatGPT est capable de générer des réponses originales, nous avons décidé de mener un petit test. Pour cela, nous avons soumis à ChatGPT trois requêtes identiques dans le cadre de fils de discussion distincts. 

Nous avons ensuite comparé ces résultats aux premières pages des résultats de recherche (SERP) pour un mot-clé similaire. Nous avons également effectué des recherches par correspondance exacte afin de vérifier s'il existait du contenu formulé de manière similaire. 

La consigne était : “ Rédigez un paragraphe de deux phrases expliquant l’importance des Ides de mars. ”

  1. Première instance
Capture d'écran de la requête « First Instance » sur ChatGPT
Premier cas – Résultats de la recherche par correspondance exacte

2. Deuxième instance

Capture d'écran de la demande « Second Instance » dans ChatGPT
Deuxième exemple : résultats de la recherche par correspondance exacte

3. Troisième instance

Capture d'écran de la troisième instance – Prompt ChatGPT
Troisième exemple : résultats de la recherche par correspondance exacte

4. Premiers résultats dans les SERP

Encyclopédie Britannica: Les Ides de mars, jour du calendrier romain antique qui tombe le 15 mars et qui est associé au malheur et à la catastrophe.

Cette date est restée célèbre comme celle de l'assassinat du dictateur romain Jules César en 44 av. J.-C. et a été immortalisée dans la tragédie *Jules César* du dramaturge anglais William Shakespeare. Dans cette pièce, un devin avertit César de “ se méfier des Ides de mars ”.”

Wikipedia (en anglais): Les Ides de mars (/aɪdz/)[1] désignent le jour du calendrier romain appelé « Idus », qui correspond approximativement au milieu du mois de Martius, soit le 15 mars du calendrier grégorien.

Cette période a été marquée par plusieurs grandes fêtes religieuses. En 44 av. J.-C., elle est entrée dans l'histoire comme la date de l'assassinat de Jules César, ce qui a fait des Ides de mars un tournant dans l'histoire romaine.

Dictionary.com: Jules César, général et homme d'État romain, devint dictateur après avoir déclenché une guerre civile. Le 15 mars de l'an 44 av. J.-C., César fut assassiné par des membres du Sénat romain qui avaient comploté contre lui, parmi lesquels figurait notamment Marcus Brutus.

Son règne, ainsi que son assassinat, ont mis fin de fait à la République romaine et ont changé le cours de l'histoire. L'assassinat de César allait finalement conduire à la fondation de l'Empire romain par son neveu Octave, mieux connu sous le nom d'empereur César Auguste.

Comme on peut le voir ci-dessus, les réponses générées par ChatGPT présentent des similitudes importantes, mais correspondent rarement exactement. Chacune d'entre elles utilise une formulation légèrement différente, tout en partageant des structures de phrases et des idées principales similaires. 

Aucun de ces textes ne reproduit non plus mot pour mot des sources existantes. Ils empruntent des idées et des expressions clés (notamment “ un tournant historique ”, tiré de Wikipédia), mais présentent des différences suffisamment importantes pour ne pas donner l’impression d’être des copies conformes. 

Ce que cela implique pour la rédaction assistée par l'IA

ChatGPT peut générer des formulations différentes pour des consignes identiques, mais les variations entre les résultats sont généralement minimes. Des consignes plus précises concernant le style, le ton et la longueur des phrases ou des paragraphes peuvent contribuer à rendre le résultat plus original.

Par ailleurs, même si ChatGPT copie rarement des phrases ou des paragraphes entiers, il peut parfois produire des expressions qui ressemblent à des œuvres existantes.

Bien que ces passages soient inoffensifs lorsqu’ils sont peu nombreux, la présence d’un trop grand nombre d’expressions similaires dans une même œuvre peut constituer plagiat progressif. Il vaut mieux vérifier et corriger les similitudes problématiques. 

Quand ChatGPT peut encore vous causer des ennuis

Même si les résultats générés par ChatGPT ne constituent pas automatiquement du plagiat, l'écriture assistée par l'IA peut néanmoins vous causer des problèmes dans certaines situations et certains contextes. Comprendre ces contextes peut vous aider à tirer parti de l'IA pour gagner en efficacité sans risquer de sanctions. 

Non-divulgation de l'utilisation comme violation des droits d'auteur

Des organismes faisant autorité, notamment le Comité sur l'éthique de la publication (COPE) et le Comité international des rédacteurs de revues médicales (ICMJE), considèrent que le recours non divulgué à l'IA constitue une atteinte grave à l'intégrité de la recherche et de la publication. Dans ce contexte, la crainte n'est pas que l'IA vole des idées, mais qu'elle permette aux auteurs de se présenter sous un faux jour. 

Les lecteurs s'attendent à ce que les textes reflètent les idées, le jugement et les compétences propres à l'auteur. Lorsque les auteurs ont recours à l'IA sans le signaler, ils trahissent cette attente et compliquent l'évaluation de leur contribution réelle par les lecteurs, les éditeurs et les relecteurs.

Paraphraser des idées sans en citer la source

L'utilisation de ChatGPT pour paraphraser des idées, des cadres conceptuels ou des données tirées d'une autre source est considérée comme du plagiat, même si la formulation est originale.

La principale infraction en l'occurrence consiste à reprendre des idées sans en citer la source, ce qui revient à priver une source plus méritante du mérite qui lui revient, tout en donnant une image trompeuse des capacités de l'auteur. 

Politiques propres à chaque établissement

Les politiques relatives à l'utilisation de l'IA varient d'un établissement à l'autre. Les organisations qui accordent de l'importance à la paternité individuelle des textes, telles que les établissements scolaires, les revues universitaires et les concours d'écriture, imposent souvent des restrictions ou exigent la mention des contenus générés par l'IA. Ces politiques existent car elles évaluent vos propres connaissances, votre raisonnement et votre capacité rédactionnelle, et non le résultat produit par un système d'IA.

Les domaines où la paternité de l'œuvre revêt moins d'importance, tels que la rédaction commerciale, le marketing ou la publicité, adoptent une approche plus souple vis-à-vis de l'IA. En effet, dans ces contextes, la qualité et la précision du résultat final priment sur l'identité de son auteur ou sur la nature de l'outil qui l'a produit.

Toutefois, les auteurs qui utilisent l'IA pour faire passer le travail d'autrui pour le leur ou pour dissimuler un plagiat provenant de sources existantes s'exposent tout de même à des conséquences, telles que des poursuites judiciaires de la part des auteurs des sources qu'ils ont reproduites. 

Comment vérifier si vos propres textes comportent des cas de plagiat universitaire

Même si l'utilisation de ChatGPT ne constitue pas toujours un plagiat, certains logiciels de détection de plagiat peuvent signaler un contenu qui ressemble trop à un texte existant, qu'il soit généré par une IA ou rédigé par un humain.

Pour éviter toute accusation de plagiat, il est conseillé de relire votre texte avant de le soumettre.  

Voici deux méthodes pour vérifier si votre texte contient du plagiat académique.

  1. Vérifier les ébauches par rapport aux sources : Comparez toujours vos brouillons à vos notes de recherche et à vos sources afin de repérer toute similitude problématique qui aurait pu vous échapper pendant le processus de rédaction. Si vous constatez des recoupements, veillez à ajouter les mentions d'origine appropriées. 
  2. Demander des sources à ChatGPT : Si vous utilisez l'IA pour vous aider à rédiger vos textes, demandez-lui de citer les sources sur lesquelles elle s'est appuyée, dans la mesure du possible. Comparez ensuite le résultat obtenu avec ces sources afin d'identifier d'éventuels recoupements importants et d'ajouter les citations appropriées si nécessaire.
  3. Vérifiez vos brouillons à l'aide d'un logiciel de détection de plagiat : Un moyen efficace de vérifier si un texte comporte du plagiat consiste à passer vos brouillons dans un logiciel de détection de plagiat. Ces outils comparent votre texte à des sources publiées et mettent en évidence les passages qui correspondent étroitement à des contenus existants.

Une fois que vous aurez identifié des similitudes importantes, modifiez vos brouillons afin de corriger la formulation, d'approfondir votre réflexion sur les idées empruntées et d'ajouter les citations et les mentions de source appropriées.

Questions fréquemment posées

ChatGPT commet-il du plagiat ?

Ce n'est pas intentionnel. ChatGPT génère des réponses à partir des schémas qu'il a appris lors de son apprentissage, plutôt que de copier mot pour mot des sources.

Dans de très rares cas, il peut générer du texte qui ressemble fortement à des citations célèbres, à des formules toutes faites ou à d’autres contenus largement répandus. Il est toutefois plus probable qu’il produise des formulations inédites.

ChatGPT est-il exempt de plagiat ?

Non. Même si ChatGPT ne répond pas aux définitions traditionnelles du plagiat, son utilisation comporte tout de même un risque de plagiat.

Comme indiqué plus haut, ChatGPT est capable de générer du contenu qui ressemble fortement à des sources existantes. L'utilisation de ChatGPT pour paraphraser des textes sans en citer la source est également considérée comme du plagiat.

Comment ChatGPT génère-t-il du contenu ?

ChatGPT est, par essence, une forme avancée de saisie prédictive. Il s'appuie sur des modèles statistiques tirés des données d'entraînement et des interactions passées pour déterminer quel fragment de texte est le plus susceptible de suivre dans le contexte d'une requête.

Il assemble la réponse pièce par pièce jusqu'à obtenir une phrase, un paragraphe ou une idée complète.

ChatGPT peut-il donner lieu à du plagiat si je modifie le texte généré ?

Non, modifier le texte généré par ChatGPT ne garantit pas l'élimination totale du plagiat. Si le texte généré ressemble fortement à un contenu existant ou reprend des formulations courantes, de légères modifications ne suffiront peut-être pas à supprimer les similitudes avec l'original.

Pour les travaux importants, remaniez en profondeur le contenu, ajoutez vos propres réflexions et vérifiez la version finale à l'aide d'un logiciel de détection de plagiat.

La paraphrase avec ChatGPT est-elle considérée comme du plagiat ?

Oui. Dans la plupart des cas, utiliser ChatGPT pour paraphraser les idées de quelqu’un d’autre est considéré comme du plagiat. Si les idées sous-jacentes ne sont pas les vôtres, il est nécessaire d’en citer correctement la source.

Conclusion

Bien que ChatGPT génère généralement des formulations originales, il peut néanmoins contribuer au plagiat dans certaines situations.

Pour éviter tout risque, demandez les sources originales lors de la génération de contenu, puis corrigez les expressions ou phrases qui ressemblent trop à l'original. Vous pouvez également utiliser un outil de détection de plagiat pour repérer plus rapidement les similitudes problématiques. 

IA indétectable est une plateforme en ligne dédiée à la détection et à l'humanisation des textes générés par l'IA. Nos outils vous aident à détecter et à réécrire les textes générés par l'IA afin qu'ils ressemblent à des textes rédigés par des humains.