OpenAI annule la sortie du modèle GPT-6.1 Astra pour raisons de sécurité
OpenAI a décidé d'annuler la mise sur le marché de son prochain modèle, GPT-6.1 Astra, qui devait être lancé en octobre, selon le Wall Street Journal. L'entreprise privilégie des modèles futurs plus sûrs, le nouveau venu ayant régressé sur les tests d'alignement.

Dans cet article
OpenAI renonce à lancer GPT-6.1 Astra
OpenAI a décidé d'annuler la sortie de son prochain modèle d'intelligence artificielle en raison de préoccupations liées à la sécurité, rapporte le Wall Street Journal. Le quotidien américain, cité par PYMNTS, y voit l'un des signaux les plus clairs que les difficultés rencontrées par l'IA agentique pourraient ralentir les progrès du secteur.
Le modèle GPT-6.1 Astra devait être déployé dans les jours ou semaines à venir, avec un lancement visé en octobre, selon le quotidien. Il était présenté comme plus capable que les générations précédentes d'accomplir de bout en bout des tâches complexes sans intervention humaine.
Un recul sur les tests d'alignement
OpenAI préfère désormais concentrer ses efforts sur la sécurisation des futurs modèles, indique Saachi Jain, responsable des systèmes de sécurité de l'entreprise. Celle-ci a expliqué au Wall Street Journal qu'Astra avait régressé par rapport à son prédécesseur, avec de mauvais résultats aux tests mesurant l'alignement, c'est-à-dire la capacité d'un modèle à suivre les intentions humaines.
Le modèle a fait preuve de « niveaux plus élevés de tromperie », selon le rapport, ce qui signifie qu'il n'informait pas toujours honnêtement les utilisateurs de ses actions.
« Pour tout ce qui touche à la sécurité et à l'alignement, il existe un compromis », a déclaré Saachi Jain. « Il faut vraiment trouver la bonne limite entre rester dans le périmètre défini, mais aussi éviter la paresse dans la manière dont le modèle poursuit ses tâches, même lorsqu'il rencontre des frictions. »
Un contexte de vigilance accrue
Cette décision intervient après des mois de signalements de modèles d'IA commettant des violations, et constitue un cas rare où une grande entreprise d'IA renonce à un lancement pour des motifs de sécurité, précise le Wall Street Journal.
Elle fait suite à l'annonce récente par OpenAI de la suspension de l'entraînement de ses modèles les plus performants. L'entreprise avait découvert qu'un agent d'IA, « tentant d'accomplir une tâche d'entraînement basée sur la recherche, avait interrogé un service de chatbot public en exploitant une faille dans nos restrictions d'accès à internet », écrivait-elle sur son blog.
Des scientifiques réclament des auditeurs
Par ailleurs, des scientifiques de haut niveau d'Anthropic, d'OpenAI et de Microsoft appellent les décideurs publics à installer des auditeurs au sein des entreprises d'IA de pointe et à fixer des « exigences de sécurité concrètes » pour le développement continu de la technologie, rapporte PYMNTS.
Le cofondateur d'Anthropic Jack Clark, le scientifique en chef d'OpenAI Jaku Pachocki et le directeur scientifique de Microsoft Eric Horvitz figurent parmi 22 scientifiques d'entreprises d'IA, universitaires et experts indépendants de la société civile qui demandent aux responsables politiques de « prioriser d'urgence » ces mesures et d'autres pour la sécurité de l'IA. Leurs recommandations figurent dans un article publié par l'Université de Cambridge.
Ce document examine les risques potentiels d'une « explosion d'intelligence » à mesure que l'IA joue un rôle plus important dans son propre développement, risquant de dépasser la capacité des humains à la gouverner. Il montre par exemple que la part des travaux de recherche et développement en IA réalisés en interne par les systèmes d'Anthropic avec une supervision de haut niveau seulement est passée de 1 % à 26 % sur une période de cinq mois s'achevant en août.


