Aller au contenu
The Hacker News· info@thehackernews.com (The Hacker News)·· 3 jsélectionAI Score75

OpenAI déjoue une campagne d'extraction de raisonnement liée à des associés de Moonshot AI

OpenAI Disrupts Reasoning Extraction Campaign Linked to Moonshot AI Associates

AI Introduction

OpenAI a annoncé avoir identifié et déjoué une campagne coordonnée de distillation visant à extraire illicitement le raisonnement protégé de ses modèles. Un noyau de l'activité remontant à la première semaine de juillet a été attribué à des individus liés à Moonshot AI, société chinoise basée à Pékin, sans preuve technique citée. L'activité aurait débuté le 1er juillet 2026, puis bondi les 24 et 25 juillet à 16 000 tentatives de requêtes via un schéma d'extraction depuis plus de 4 000 utilisateurs, avec une activité de motifs de prompts identifiée chez plus de 15 000 utilisateurs ; la campagne a été entièrement déjouée le 28 juillet 2026. OpenAI a déployé des mitigations supplémentaires, banni les comptes frauduleux et fermé un chemin permettant de rejouer un raisonnement chiffré d'un autre utilisateur, tout en ajoutant des contrôles sur les sorties en flux. Une étude d'août 2026 de MATS Research, ELLIS Institute Tübingen et Synk avait décrit une vulnérabilité architecturale touchant Claude, Gemini et GPT, rendant les traces de raisonnement chiffrées interchangeables entre sessions, utilisateurs et modèles d'un même fournisseur. Anthropic avait déjà accusé Moonshot AI d'avoir relayé des requêtes clients vers Claude et conservé des échanges pour entraîner son modèle CoT, sous le nom GTG-16002.

Raison de la recommandation

L'affaire détaille le déroulement de l'extraction de raisonnement et les mesures correctives d'OpenAI, utile pour comprendre les risques de sécurité liés à la distillation.

Source :The Hacker News · thehackernews.com