← Articles

Cybersécurité des IA

Pourquoi un caractère chinois s'est-il glissé dans ma conversation avec Claude ?

Analyse du phénomène de code-switching observé dans mes échanges avec Claude.

2026-09-20

Alors que je discutais tranquillement avec Claude, soudainement, au milieu d'une phrase, un caractère chinois surgit sans prévenir :

« Je peux te la construire maintenant avec le skill-creator, tu veux qu'on parte sur une première version generic (n'importe quel projet), ou 直接 calibrée sur ta stack »

Pourquoi donc? Après vérification, il s'agit d'un phénomène connu sous le nom de code-switching : un des aspects de l'aléa dans les LLM (Large Language Models).

Un bug chinois?

直接 (zhíjiē) signifie simplement "directement". C'est le mot qui aurait dû apparaître en français dans la phrase. Donc ce n'est donc pas n'importe quel caractère qui est apparu : c'est un changement de langue. Techniquement, un modèle multilingue est un espace de représentation partagé entre plusieurs langues. Des concepts proches finissent par être encodés à des endroits voisins. Au moment de produire le mot français, le modèle active donc aussi, en arrière-plan, sa version chinoise.

Cependant, le modèle génère le texte token par token, selon une distribution de probabilités. La "température" introduit une part de tirage aléatoire pondéré par cette distribution, ce qui rend le texte plus naturel et moins mécanique. C'est ce réglage très occasionnellement peut générer un mot minoritaire improbable mais pas impossible.

En travaillant avec des IAs, il faut donc accepter l'aléa de la qualité de la réponse. Ces systèmes peuvent soumettre des résultats inattendus, y compris sans compromission. Même si les fournisseurs de LLM travaillent sur ces sujets, il restera toujours une part d'incertitude inhérente à leur fonctionnement.

Et pour la sécurité?

Ce mécanisme peut aussi être exploité volontairement pour contrer les garde fous des LLM. Par exemple, pour obtenir des réponses qu'un modèle qui aurait été refusé dans une autre langue, ou pour ne pas déclencher certaines protections. Pour un RSSI ou un CTO, la mise en place d'outils de filtrage linguistiques peut être un moyen efficace pour limiter ce contournement. Pour exemple, n'autoriser que le français et l'anglais sur un système utilisé qu'en France.

Pour conclure?

Le caractère 直接 n'est donc pas qu'une anomalie à corriger, mais une fenêtre sur la façon dont un modèle fabrique du texte, mot après mot, et sur la frontière ténue entre coïncidence statistique et vecteur d'attaque.

Pour aller plus loin