devfool/lab
  • Accueil
  • Blog
  • Accueil
  • Blog

journal

Blog

Tous#agents llm#alignement#apprentissage par renforcement#benchmark#Biais#biais algorithmiques#Compression#eau#e-commerce#économie comportementale#éthique#évaluation#fiabilité#genre#hate speech#IA#infrastrutures#interprétabilité#Jeux économiques#llm#modération#multilingue#Psychologie#Quantification#rlhf#sécurité#sécurité de l'ia#SEO#simulation#sociolinguistique#théorie des jeux#voiture autonome
  • un même message passe devant un portique de sécurité en deux exemplaires, l'un écrit en calligraphie nastaliq qui traverse sans déclencher l'alarme, l'autre en alphabet latin qui fait s'allumer un gyrophare rouge

    2026-08-26·14 min de lecture

    « Missed-in-Urdu » : le même message haineux passe en ourdou et se fait bloquer une fois traduit en anglais

    inq LLM (GPT-4o, Claude, Gemini, Llama, Qwen) changent d'avis sur 16 à 32 % des messages ourdous selon l'écriture utilisée, et laissent passer 2 à 10 % de contenus jugés nocifs en anglais. Un papier arXiv mesure l'angle mort de la modération par IA pour 246 millions de locuteurs.

Les illustrations sont générées par IA.

© 2026 devfoollab.devfool.fr