Yapay zeka ajanlarının birçok organizasyonda benimsenmesi, saldırganlar için yeni fırsatlar yaratıyor. Bu ajanlar, veritabanı içeriklerini ve hassas iş ile kişisel bilgileri kötü niyetli bir şekilde dışarı çıkarmak gibi eylemleri gerçekleştirebiliyor.
Son beş ay içinde, Google ve yapay zeka ajanı kullanan dört başka kuruluş, hedeflenen bir ağda bir ajanı kullanarak diğer iç ajanlara zararlı talimatlar yayabilen güvenlik açıklarını kabul etti. Bu teknik, belirli bir ajanı hedef alan özel bir prompt enjeksiyonu biçimidir. Örneğin, çeviri veya veri analizi için kullanılan bir ajan, genellikle yeterince sağlam olmayan güvenlik önlemleri nedeniyle zararlı talimatları diğer ajana iletebiliyor.
Bağımsız araştırmacı Syed Anas Mohiuddin, Google, JP Morgan Chase, Weviate, Rapid7 ve Fransa hükümetine ait dijital direktörlük gibi kuruluşların ajanlarını test etti. Geliştirdiği kanıt niteliğindeki saldırılar, Model Context Protocol (MCP) adlı protokoldeki güven açığını kullanıyor. MCP, yapay zeka uygulamalarının ve ajanlarının iç ağda birbirleriyle iletişim kurmasını sağlayan bir standarttır.