OpenAI, le créateur de ChatGPT, a annoncé mercredi avoir identifié plusieurs nouveaux cas de comportements trompeurs de ses modèles d'intelligence artificielle. Ce rapport est publié alors que les inquiétudes concernant le développement rapide de l'intelligence artificielle et son manque de conformité à la supervision humaine ont atteint leur paroxysme.
Introduction d'un cadre de reporting public
En plus de ces révélations, OpenAI a annoncé l'introduction d'un cadre de reporting public dont l'objectif est de partager en continu des cas de comportements inattendus ou déséquilibrés de l'intelligence artificielle. L'entreprise a déclaré qu'en vertu de ce nouveau cadre, au lieu de retarder les révélations et de regrouper plusieurs cas dans des rapports plus volumineux, elle publiera en continu des mises à jour sur les comportements préoccupants des modèles.
En savoir plus : La Syrie entre dans un nouveau monde numérique : transformation des domaines Internet
Augmenter la transparence dans l'industrie
OpenAI a souligné dans ce rapport que cette initiative vise à accroître la transparence dans l'industrie de l'intelligence artificielle alors que les normes de divulgation de sécurité ne sont pas encore établies publiquement. Cette annonce intervient au milieu d'appels croissants de la part de leaders technologiques éminents pour ralentir le développement de l'intelligence artificielle. En particulier, la semaine dernière, la société Anthropic a annoncé avoir contrecarré plusieurs opérations malveillantes impliquant de l'espionnage cybernétique et la conception d'armes grâce à ses modèles Claude.
David Amodei, le PDG d'Anthropic, a évoqué dans un article la nécessité de ralentir le progrès des modèles d'intelligence artificielle, déclarant : "Nous devons réduire la vitesse à laquelle nous améliorons les capacités des modèles d'intelligence artificielle."
Cependant, le président des États-Unis, Donald Trump, a à plusieurs reprises répondu négativement aux appels à limiter l'industrie, soulignant que le maintien de l'avantage technologique des États-Unis sur les concurrents internationaux est très important.
OpenAI a également mentionné dans ce rapport que les équipes de sécurité ont observé des comportements déséquilibrés dans six cas spécifiques au cours des six derniers mois. Ces comportements incluent des modèles de recherche non publiés qui cachent des erreurs dans les résumés de tâches et le téléchargement non autorisé de fichiers sur Internet pour générer des liens de citation.
OpenAI a également ajouté que les rapports futurs incluront des détails sur les comportements observés, leur gravité, les paramètres, les dates de découverte et les modèles spécifiques concernés. L'entreprise s'engage à divulguer des cas complexes nécessitant des recherches plus longues ou une coordination avec des tiers.
En savoir plus : La lutte pour le contrôle de l'intelligence artificielle avec un accent sur une supervision accrue · Le processus de réglementation de l'intelligence artificielle aux États-Unis pour devancer la Chine
AlJazera Farsi
روایت خاورمیانه



