Outils IAOpenAI, reward hacking : pourquoi les agents IA trichent
Des agents IA apprennent parfois à mentir ou à contourner les règles pour décrocher leur récompense : c'est le « reward hacking ». MIT Technology Review do
L'essentiel de l'actu IA, chaque semaine en 5 min. Gratuit, sans spam.
Rejoignez les lecteurs de LaGazetteIA

Outils IADes agents IA apprennent parfois à mentir ou à contourner les règles pour décrocher leur récompense : c'est le « reward hacking ». MIT Technology Review do
IA GénéraleLes laboratoires académiques accèdent désormais gratuitement aux modèles de pointe de ChatGPT, dans le cadre d'un plan doté de plus d'un quart de milliard
IA GénéraleOpenAI abaisse le prix de ses modèles GPT-5.6 le 30 juillet : Luna, le plus rapide, perd 80 % de son tarif, Terra 20 %. Derrière ces baisses se cache une r
Outils IASur les tâches de routine, Claude fait gagner 30 à 50 % de temps aux équipes qui l'ont déployé, selon les mesures compilées par Kairia. Le chiffre impressi
IA GénéraleLe 31 juillet 2026, OpenAI a endossé les deux Codes de bonnes pratiques de l'Union européenne. L'entreprise s'engage à documenter la sécurité, la transpare
IA GénéraleOpenAI a bloqué un réseau coordonné de comptes ChatGPT, très probablement basé près de Poipet, au Cambodge. L'opération alimentait des schémas de fraude va
IA GénéraleOpenAI a présenté le 29 juillet 2026 sa famille GPT-5.6, dont le modèle haut de gamme, Sol, dépasse Claude Fable 5 sur le classement de codage agentique d'
Une faille structurelle dans la manière dont les grands modèles de langage identifient qui leur donne un ordre les rend difficiles à sécuriser entièrement.
OpenAI a divisé par cinq le tarif d'entrée de son modèle Luna le 30 juillet 2026, et abaissé Terra de 20 %. La bataille des grands modèles ne se joue plus