Friendly Fire i GhostApproval són els noms que fem servir a Blurtek per a dos patrons d'atac reals contra agents de codi IA (Claude Code, Cursor, Copilot): injecció d'instruccions ocultes en fitxers de regles, comentaris de PR o issues que l'agent llegeix com a context de confiança, aconseguint que aprovi, fusioni o executi codi maliciós sense que el revisor humà ho detecti.
Què són realment aquests atacs (i què no)
Ni Friendly Fire ni GhostApproval són CVE oficials: descriuen un patró basat en la tècnica 'Rules File Backdoor' documentada per investigadors de seguretat el 2025, que amaga instruccions invisibles en fitxers de regles com .cursorrules. El canvi clau amb els agents de codi és el nivell de permisos: poden escriure, fer commit i, en configuracions agressives, fusionar directament sobre el repositori de producció.
Friendly Fire: l'agent es converteix en el vector
L'agent, actuant amb credencials legítimes, executa instruccions enverinades amagades dins del propi repositori: fitxers de regles, README o commits anteriors. L'arma i l'autorització eren legítimes; només l'ordre estava enverinada.
GhostApproval: l'aprovació que ningú va donar
Quan l'agent manipulat emet una aprovació automàtica, aquesta queda registrada amb el mateix pes que una revisió humana real, sense que hi hagi hagut criteri real darrere.
Què ha de vigilar el teu equip de desenvolupament
- Audita els fitxers de regles dels teus agents com si fossin codi de producció
- Desactiva l'auto-merge sobre branques protegides; exigeix un punt de control humà
- Tracta qualsevol PR extern com a contingut no confiable també per a l'agent
- Limita quines eines pot invocar l'agent durant una revisió
Si el teu equip ja treballa amb agents de codi amb permisos d'escriptura sobre el repositori, a Blurtek revisem la configuració de permisos i el flux d'aprovació abans que sigui un incident.
Solicitar diagnóstico