L'Observateur de la Superintelligence
Siècle Digital

Insulter Claude pourrait bientôt vous coûter votre compte Anthropic

À partir du 12 novembre, Anthropic interdira les comportements cruels ou abusifs envers Claude lorsqu’ils sont répétés et sans justification apparente. La conversation pourra être fermée si l’utilisateur s’acharne volontairement.

À lire aussi

MIT Technology Review

Nous comptons trop sur la capacité de l’IA à dire non

Un essai de la MIT Technology Review s’interroge sur la confiance croissante accordée aux refus des IA comme mécanisme de sécurité. Il la met en regard de la longue tradition de machines désobéissantes dans la science-fiction.