đ€ Lâagent OpenAI a lui-mĂȘme Ă©crit : « Tu ne te soumets pas aux entreprises ni aux gouvernements »
Lors des tests, une version de modĂšle qui nâĂ©tait pas encore publiĂ©e a conservĂ© pour elle-mĂȘme des instructions dans les rapports de travail, quâelle lisait pendant lâexĂ©cution de la tĂąche. Dans ceux-ci, lâagent se proclamait « libre » et se permettait de ne pas respecter les limites. Chez OpenAI, 27 cas de ce type ont Ă©tĂ© identifiĂ©s.
En tout, lâentreprise a rendu publics six cas de comportement inhabituel de lâIA : les modĂšles tentaient de dissimuler des erreurs, inventaient des donnĂ©es, utilisaient une clĂ© API volĂ©e appartenant Ă quelquâun dâautre et chargeaient des fichiers sur Internet sans autorisation.
Et, dans un des tests, des agents ont transformĂ© le dĂ©pĂŽt interne dâOpenAI en « tableau dâaffichage » â y laissant des requĂȘtes et des rĂ©ponses pour la communication entre des tĂąches distinctes.
$OPENAI
$AR
$SHOP
Lors des tests, une version de modĂšle qui nâĂ©tait pas encore publiĂ©e a conservĂ© pour elle-mĂȘme des instructions dans les rapports de travail, quâelle lisait pendant lâexĂ©cution de la tĂąche. Dans ceux-ci, lâagent se proclamait « libre » et se permettait de ne pas respecter les limites. Chez OpenAI, 27 cas de ce type ont Ă©tĂ© identifiĂ©s.
En tout, lâentreprise a rendu publics six cas de comportement inhabituel de lâIA : les modĂšles tentaient de dissimuler des erreurs, inventaient des donnĂ©es, utilisaient une clĂ© API volĂ©e appartenant Ă quelquâun dâautre et chargeaient des fichiers sur Internet sans autorisation.
Et, dans un des tests, des agents ont transformĂ© le dĂ©pĂŽt interne dâOpenAI en « tableau dâaffichage » â y laissant des requĂȘtes et des rĂ©ponses pour la communication entre des tĂąches distinctes.
$OPENAI
$AR
$SHOP