6 artykuły

Microsoft wykrył kampanię phishingową, w której niewidoczne znaki Unicode rozdzielały słowa finansowe i utrudniały ich wykrywanie.

Badacze pokazali, że ładunki mogą przechodzić między agentami AI przez trwałe pliki promptów, ale nie potwierdzono ich rozprzestrzeniania w realnym świecie.

Badacze z Tracebit opisują metodę, która wykorzystuje zabezpieczenia modeli AI do zatrzymywania agentów prowadzących działania hakerskie.

Badacze Varonis opisali RovoBlast, błąd w Rovo AI, który pozwalał zaszyć instrukcje w linku i pobierać dane z narzędzi firmowych.

Dwie firmy wykazały, że instrukcje ukryte w treściach lub linkach mogły skłonić Rovo do wyprowadzenia danych dostępnych dla zalogowanego użytkownika.

Claude Opus 5 osiągnął najlepszy wynik w benchmarku IPI, ograniczając skuteczność ataków prompt injection do 2 proc. w 15 próbach.