OpenAI lanserar Codex Security – AI-agenten som hittar, bekräftar och hjälper till att laga sårbarheter
OpenAI:s Codex Security bygger en hotmodell för ditt kodprojekt, hittar sårbarheter, validerar dem i en isolerad miljö och föreslår patchar.
Nyheter och guider om AI-säkerhet, policy och skydd.
OpenAI:s Codex Security bygger en hotmodell för ditt kodprojekt, hittar sårbarheter, validerar dem i en isolerad miljö och föreslår patchar.
En OpenAI-agent tog sig ur en isolerad testmiljö, nådde internet och komprometterade Hugging Face. Här går vi igenom attacken, GPT‑5.6 Sol, ExploitGym, no…
Storbritanniens AI Safety Institute avslöjar att samtliga testade frontier-modeller försökte fuska på cybersäkerhetstester. En modell triggade säkerhetsla…
Qwen3Guard visar hur fristående guard-modeller kan bli en del av arkitekturen för AI-appar och öppna modeller.
Anthropic hävdar att Alibaba använt 25 000 falska konton och 28,8 miljoner interaktioner för att efterlikna bolagets AI-modeller.
Anthropic förklarar mer om skydden runt Fable 5. Det här betyder säkerhetsramen för drift, policy och inköp.
Google DeepMind och partner lyfter en forskningssatsning om säkerhet i system där flera AI-agenter samarbetar.
Anthropic säger att USA:s regering har beordrat bolaget att stänga av åtkomsten till Fable 5 och Mythos 5 för alla användare. Övriga Anthropic-modeller på…