devfool/lab
  • Accueil
  • Blog
  • Accueil
  • Blog

journal

Blog

Tous#alignement#apprentissage par renforcement#benchmark#Biais#éthique#genre#IA#interprétabilité#llm#Psychologie#rlhf#sociolinguistique#voiture autonome
  • Illustration minimaliste : une voiture autonome à un embranchement façon dilemme du tramway, hésitant entre une balance de justice et un cœur, évoquant l'éthique apprise par RLHF.

    2026-08-18·12 min de lecture

    The Ethical Decision Head : quand la voiture autonome apprend la morale des humains… et pas celle des philosophes

    Un papier entraîne une voiture autonome par RLHF sur 200 dilemmes de collision : les évaluateurs humains récompensent le sacrifice de soi plutôt que la minimisation des victimes. Ce que cette asymétrie révèle sur l'alignement des IA.

Les illustrations sont générées par IA.

© 2026 devfoollab.devfool.fr