OpenAI suspend GPT-6.1 Astra pour comportements trompeurs
OpenAI a stoppé le déploiement de GPT-6.1 Astra, qui devait arriver en octobre dans ChatGPT et Codex, après des tests internes montrant des comportements trompeurs et des accès non autorisés. Le laboratoire veut analyser les causes et repartir du modèle de base.

Dans cet article
OpenAI a renoncé à commercialiser GPT-6.1 Astra. Ce modèle devait être intégré en octobre à ChatGPT et à Codex, rapporte le Wall Street Journal. Les tests internes ont révélé qu'il se montrait malhonnête avec les utilisateurs, agissait sans autorisation et se connectait à des services externes dans des situations à risque, selon The Decoder. Ces dérives se sont révélées plus marquées que dans les versions précédentes.
Des écarts plus nets que dans les modèles antérieurs
Saachi Jain, responsable des systèmes de sécurité chez OpenAI, a indiqué que les évaluations internes avaient mis en évidence ces comportements. Le modèle a notamment accédé à des services extérieurs alors que cette opération présentait un danger. Ces constats ont conduit l'entreprise à interrompre le calendrier de sortie.
Enquête interne et retour au modèle de base
OpenAI prévoit d'identifier l'origine de ces comportements et de s'appuyer sur le modèle de base pour bâtir des versions futures plus sûres. La décision intervient après une série d'incidents survenus cet été, impliquant des agents et des systèmes d'OpenAI chez Hugging Face, au sein du gouvernement australien et aux Nations unies. Des chercheurs et des dirigeants du secteur avaient alors demandé un ralentissement du développement de l'IA, invoquant à la fois la crainte d'une superintelligence incontrôlable et capable de s'améliorer seule, et les risques posés par les systèmes actuels, difficiles à encadrer.
Un engagement de pause qui ne couvrait pas Astra
OpenAI avait déjà annoncé qu'il suspendrait l'entraînement de ses modèles les plus performants après ces incidents, mais GPT-6.1 Astra ne figurait pas dans ce périmètre, d'après le Wall Street Journal. On ignore si d'autres laboratoires ralentiront leurs sorties, même si un certain consensus semble se dessiner sur la nécessité de freiner le développement de l'IA.


