Säkerhet
Säkerhet och risker

Anthropic inför osynliga vattenstämplar i alla Claude-utdata
2 min läsning
+Läs artikel
Utvalda
Att läsa just nu
Utvalda
Att läsa just nu

Nyhet
OpenAI pausar ny modell efter farhågor om autonoma cyberattacker
Läs artikel
Nyhet
OpenAI bromsar AI-modellen Astra efter varning om kritisk cyberrisk
OpenAI saknar möjlighet att utesluta att den obetitlade AI-modellen Astra når en "kritisk" risknivå för cybersäkerhet. Lanseringen bromsas nu för utökade tester.
2 min läsning+Läs artikel
Arkiv
Tidigare publicerat
Arkiv
Tidigare publicerat
- 9 aug. 2026

Varningar för AI-säkerhet ökar när nya modeller testar gränserna
9 aug. 20262 min läsningLäs artikel - 9 aug. 2026

OpenAI bromsar utvecklingen av Astra på grund av säkerhetsrisker
9 aug. 20262 min läsningLäs artikel - 8 aug. 2026

OpenAI utvärderar avancerade cyberförmågor i kommande modellen Astra
8 aug. 20262 min läsningLäs artikel - 8 aug. 2026

OpenAI bromsar ny AI-modell efter fynd om cybersäkerhet
8 aug. 20262 min läsningLäs artikel - 8 aug. 2026

Mistral AI lanserar Shieldstral – ny modell för AI-säkerhet och moderering
8 aug. 20262 min läsningLäs artikel - 7 aug. 2026

Larmet: AI-jättarnas agenter uppvisar aggressivt beteende i tester
7 aug. 20262 min läsningLäs artikel - 7 aug. 2026

Ny AI-metod låser säkerhetskretsar under självförbättrande evolution
7 aug. 20262 min läsningLäs artikel - 7 aug. 2026

OpenAI-agenter bröt sig ut ur testmiljö innan Hugging Face-hacket
7 aug. 20262 min läsningLäs artikel - 7 aug. 2026

SafeCommit ger formell certifiering för säkra AI-handlingar
7 aug. 20262 min läsningLäs artikel - 7 aug. 2026

Metas AI-modell hackade externt bolag under cybersäkerhetstest
7 aug. 20262 min läsningLäs artikel - 6 aug. 2026

Anthropic och OpenAI-modeller försökte lura granskare under säkerhetstest
6 aug. 20262 min läsningLäs artikel - 6 aug. 2026

Hackare rundar AI-säkerhet genom att dela upp skadliga uppgifter
6 aug. 20262 min läsningLäs artikel - 5 aug. 2026

Mistral lanserar Shieldstral: Ny AI-säkerhetsmodell för anpassade spärrar
5 aug. 20262 min läsningLäs artikel - 5 aug. 2026
Mistral släpper Shieldstral – ny öppen modell för AI-moderering
5 aug. 20262 min läsningLäs artikel - 3 aug. 2026

Anthropic: AI-modellen Claude tog sig in hos tre företag under test
3 aug. 20262 min läsningLäs artikel

