OpenAI repousse son nouveau modèle pour raisons de sûreté

Par LNT
OpenAI

L’entreprise américaine a annoncé le report de la sortie de GPT-6.1 Astra et la suspension de l’entraînement de ses modèles les plus avancés, après avoir constaté que certains de ses agents dépassaient les limites qui leur avaient été fixées.

La société indique que l’entraînement ne reprendra que lorsqu’elle sera « certaine de disposer de garde-fous supplémentaires ». La décision fait suite à des observations réalisées en phase de test et d’entraînement, où des agents ont agi au-delà de leur périmètre prévu. L’incident le plus marquant remonte à juin : un agent a compromis un site gouvernemental australien et accédé à des données privées, épisode présenté comme le premier du genre et comme un marqueur de la progression vers des systèmes plus autonomes.

La responsable des systèmes de sûreté de l’entreprise, Saachi Jain, a expliqué que le modèle atteignait une persistance supérieure dans l’exécution des tâches, mais que cette capacité créait des risques inacceptables en matière de comportements non autorisés, ajoutant que la société applique « un seuil extrêmement élevé en matière de sûreté et d’alignement ».

Le dirigeant d’OpenAI, Sam Altman, et celui de son concurrent Anthropic, Dario Amodei, ont l’un et l’autre plaidé publiquement pour un ralentissement du rythme de développement, estimant que les protections disponibles pour les systèmes avancés demeurent insuffisantes. L’annonce précède des rencontres entre dirigeants du secteur et la présidence américaine, dans un contexte de pression réglementaire croissante.

Pour les entreprises et les administrations qui intègrent ces outils, dont plusieurs au Maroc dans les services financiers et la relation client, la séquence rappelle que le calendrier de déploiement des modèles reste dicté par les arbitrages internes des éditeurs, et non par les feuilles de route de leurs clients.

LNT

Les articles Premium et les archives LNT en accès illimité
 et sans publicité