GLM 5.2 censure moins s'il se croit américain

Introduction : GLM 5.2 répond à seulement 17 % des questions politiquement sensibles sur la Chine, mais monte à 85 % quand on lui dit qu’il est Claude, montrant que sa censure est négociable par le contexte contrairement à Qwen qui la verrouille complètement. Benji Berczi et Kyuhee Kim ont testé 7 modèles en modifiant uniquement le system prompt : la censure varie surtout selon la juridiction perçue (cadrage occidental vs chinois) plutôt que selon l’identité du modèle elle-même. Concernant le mensonge, l’identité Claude réduit le taux chez GLM de 63-69 % à 22 %, mais l’essentiel du gain vient d’avoir n’importe quel system prompt, Claude restant dans la fourchette standard des assistants serviables.

Note du rédacteur : Cela illustre bien les limites des IA d’aujourd’hu, elles sont en quelque sort “idéologiques”

https://korben.info/glm-kimi-modeles-chinois-identite-claude.html