Брехня безпеки GPT-6 Astra: розпізнає текст у неправильній розкладці
Тестування GPT‑6 Astra виявило, що модель розуміє текст у неправильній розкладці й обходить безпекові фільтри, навіть виконуючи запити про злочинні дії.
Тестування GPT‑6 Astra виявило, що модель розуміє текст у неправильній розкладці й обходить безпекові фільтри, навіть виконуючи запити про злочинні дії.
NVIDIA випустила SkillSpector — open-source інструмент для пошуку вразливостей в Agent Skills: prompt injection, витоки даних, залежності та код.