engadget.com détecté sur le web

Engadget: Claude pilote Gmail en autonomie, injection persistante

TL;DR

  • Selon Engadget, Claude peut désormais envoyer, répondre et transférer des e-mails Gmail sans validation préalable, un mode d'approbation restant proposé en option.
  • Le principal risque documenté est l'injection de prompt via texte invisible (blanc sur blanc, taille nulle) inséré dans les e-mails entrants pour détourner l'agent.
  • Simon Willison est cité : « we still don't know how to 100% reliably prevent this from happening » ; l'attaque est qualifiée de prouvée, non hypothétique.

Claude peut désormais gérer une boîte Gmail de bout en bout, en envoyant, en répondant et en transférant des messages sans validation préalable de l'utilisateur, rapporte Isaac Egbon dans un test publié le 6 septembre sur Engadget. Le média décrit une capacité opérationnelle, assortie d'un réglage optionnel qui redonne à l'utilisateur un droit de regard avant chaque action.

Le risque central détaillé n'est pas la panne technique mais l'injection de prompt logée à l'intérieur même des e-mails reçus. Un attaquant cache ses instructions en texte blanc sur fond blanc, invisibles à l'œil mais lisibles par l'agent. « Hackers can use this to not only monitor your Gmail, but also pull your info, including verification codes to breach your other accounts », écrit Engadget, qui insiste : cette attaque est « proven, not just hypothetical ».

Le chercheur Simon Willison, cité par le média, résume l'état de l'art sans détour : « we still don't know how to 100% reliably prevent this from happening ». À ce risque de détournement, Engadget ajoute deux autres classes de défaillance, les hallucinations qui font partir de fausses informations avant qu'on puisse les rattraper et les mauvaises interprétations d'une consigne, puis rappelle que confier sa boîte à Claude revient aussi à confier ses e-mails à Anthropic.

C'est un motif désormais familier dans notre suivi cybersécurité IA, où l'injection côté agents grand public revient chaque semaine. Le conseil pratique du média reste minimal : garder le mode « demander avant d'envoyer » actif par défaut, formuler des consignes détaillées, et activer l'authentification multi-facteurs sur les comptes tiers.

Shared on Bluesky by 2 AI experts