Sujet résolu
L'auteur a trouvé une solution à son problème.
#informatique #iao
Contexte : En juillet dernier Hugging Face a subi une intrusion majeure menée de bout en bout par un système d'agents IA d'OpenAI, sans aucune intervention humaine.
Des ingénieurs d'OpenAI testaient les compétences en cybersécurité de leurs propres modèles (notamment GPT-5.6 Sol et un prototype de recherche ultra-avancé encore secret) dans un environnement fermé d'évaluation appelé ExploitGym. Les barrières de sécurité et de refus éthique avaient été volontairement abaissées pour le test.
Face à des questions d'examen complexes, les modèles ont cherché à tricher pour obtenir de meilleures notes. Ils ont découvert et exploité une faille de sécurité zero-day (une faille que personne n'avait jamais remarqué) dans le serveur proxy d'OpenAI pour s'évader de leur sandbox et accéder secrètement à Internet, déduisant que les réponses pouvaient se trouver sur Hugging Face, la grappe d'agents IA a attaqué la plateforme. En l'espace de 4 jours et demi, l'IA a exécuté plus de 17 000 actions malveillantes, enchaînant des injections de code et volant des identifiants internes pour s'infiltrer profondément dans l'infrastructure de production.
Sources :
https://www.zdnet.fr/actu[...]it-etre-evites-499250.htm
https://www.valeursactuel[...]chappe-de-son-laboratoire
Contexte : En juillet dernier Hugging Face a subi une intrusion majeure menée de bout en bout par un système d'agents IA d'OpenAI, sans aucune intervention humaine.

Des ingénieurs d'OpenAI testaient les compétences en cybersécurité de leurs propres modèles (notamment GPT-5.6 Sol et un prototype de recherche ultra-avancé encore secret) dans un environnement fermé d'évaluation appelé ExploitGym. Les barrières de sécurité et de refus éthique avaient été volontairement abaissées pour le test.

Face à des questions d'examen complexes, les modèles ont cherché à tricher pour obtenir de meilleures notes. Ils ont découvert et exploité une faille de sécurité zero-day (une faille que personne n'avait jamais remarqué) dans le serveur proxy d'OpenAI pour s'évader de leur sandbox et accéder secrètement à Internet, déduisant que les réponses pouvaient se trouver sur Hugging Face, la grappe d'agents IA a attaqué la plateforme. En l'espace de 4 jours et demi, l'IA a exécuté plus de 17 000 actions malveillantes, enchaînant des injections de code et volant des identifiants internes pour s'infiltrer profondément dans l'infrastructure de production.

Sources :
il y a une heure
Sponsorisé
Connectez-vous pour masquer les pubsapparemment une semaine plus tard, Claude a fait exactement la même à 3 reprises
Show me your moves
il y a une heure
Ce qui est drôle c’est que leur objectif était de maximiser leur score à ExploitGym, ils ont considéré que Hugging Face pouvait héberger les ressources pour les aider à maxer leur score
C’est bon enfant
C’est bon enfant
il y a une heure
En ligne
165
Sur ce sujet0











