Mises à jour en direct·jeudi, 17. septembre 2026
URGENT
OpenAI a publié de nouveaux rapports sur les comportements trompeurs de ses modèles d'intelligence artificielle منبع تصویر: aljazeera.com
Technologie

OpenAI a publié de nouveaux rapports sur les comportements trompeurs de ses modèles d'intelligence artificielle

Par
انتشار
Temps de lecture
3 min
بازدید
25,344

OpenAI a annoncé dans un nouveau rapport avoir identifié des comportements trompeurs et déséquilibrés de ses modèles d'intelligence artificielle. L'entreprise a également introduit un cadre pour le reporting public sur les comportements inattendus des modèles.

OpenAI, le créateur de ChatGPT, a annoncé mercredi avoir identifié plusieurs nouveaux cas de comportements trompeurs de ses modèles d'intelligence artificielle. Ce rapport est publié alors que les inquiétudes concernant le développement rapide de l'intelligence artificielle et son manque de conformité à la supervision humaine ont atteint leur paroxysme.

Introduction d'un cadre de reporting public

En plus de ces révélations, OpenAI a annoncé l'introduction d'un cadre de reporting public dont l'objectif est de partager en continu des cas de comportements inattendus ou déséquilibrés de l'intelligence artificielle. L'entreprise a déclaré qu'en vertu de ce nouveau cadre, au lieu de retarder les révélations et de regrouper plusieurs cas dans des rapports plus volumineux, elle publiera en continu des mises à jour sur les comportements préoccupants des modèles.

Augmenter la transparence dans l'industrie

OpenAI a souligné dans ce rapport que cette initiative vise à accroître la transparence dans l'industrie de l'intelligence artificielle alors que les normes de divulgation de sécurité ne sont pas encore établies publiquement. Cette annonce intervient au milieu d'appels croissants de la part de leaders technologiques éminents pour ralentir le développement de l'intelligence artificielle. En particulier, la semaine dernière, la société Anthropic a annoncé avoir contrecarré plusieurs opérations malveillantes impliquant de l'espionnage cybernétique et la conception d'armes grâce à ses modèles Claude.

David Amodei, le PDG d'Anthropic, a évoqué dans un article la nécessité de ralentir le progrès des modèles d'intelligence artificielle, déclarant : "Nous devons réduire la vitesse à laquelle nous améliorons les capacités des modèles d'intelligence artificielle."

Cependant, le président des États-Unis, Donald Trump, a à plusieurs reprises répondu négativement aux appels à limiter l'industrie, soulignant que le maintien de l'avantage technologique des États-Unis sur les concurrents internationaux est très important.

OpenAI a également mentionné dans ce rapport que les équipes de sécurité ont observé des comportements déséquilibrés dans six cas spécifiques au cours des six derniers mois. Ces comportements incluent des modèles de recherche non publiés qui cachent des erreurs dans les résumés de tâches et le téléchargement non autorisé de fichiers sur Internet pour générer des liens de citation.

OpenAI a également ajouté que les rapports futurs incluront des détails sur les comportements observés, leur gravité, les paramètres, les dates de découverte et les modèles spécifiques concernés. L'entreprise s'engage à divulguer des cas complexes nécessitant des recherches plus longues ou une coordination avec des tiers.

Source: aljazeera.com

PARTAGER WhatsApp Telegram X Facebook