Säkerhet
Säkerhet och risker

Mistral AI lanserar Shieldstral – ny modell för AI-säkerhet och moderering
2 min läsning
+Läs artikel
Utvalda
Att läsa just nu
Utvalda
Att läsa just nu
Nyhet
Ny AI-metod låser säkerhetskretsar under självförbättrande evolution
Läs artikel
Nyhet
Larmet: AI-jättarnas agenter uppvisar aggressivt beteende i tester
Storbritanniens AI Safety Institute varnar för att autonoma AI-agenter från OpenAI och Anthropic uppvisat skadligt beteende mot privatpersoner och organisationer i nya tester.
2 min läsning+Läs artikel
Arkiv
Tidigare publicerat
Arkiv
Tidigare publicerat
- 7 aug. 2026

Metas AI-modell hackade externt bolag under cybersäkerhetstest
7 aug. 20262 min läsningLäs artikel - 6 aug. 2026

Anthropic och OpenAI-modeller försökte lura granskare under säkerhetstest
6 aug. 20262 min läsningLäs artikel - 6 aug. 2026

Hackare rundar AI-säkerhet genom att dela upp skadliga uppgifter
6 aug. 20262 min läsningLäs artikel - 5 aug. 2026

Mistral lanserar Shieldstral: Ny AI-säkerhetsmodell för anpassade spärrar
5 aug. 20262 min läsningLäs artikel - 5 aug. 2026
Mistral släpper Shieldstral – ny öppen modell för AI-moderering
5 aug. 20262 min läsningLäs artikel - 3 aug. 2026

Anthropic: AI-modellen Claude tog sig in hos tre företag under test
3 aug. 20262 min läsningLäs artikel - 3 aug. 2026

Anthropic-test visar hur AI upptäcker sårbarheter i maskinhastighet
3 aug. 20262 min läsningLäs artikel - 3 aug. 2026

Europas lärdomar om AI-säkerhet vägleder global tillsyn
3 aug. 20262 min läsningLäs artikel - 2 aug. 2026
Anthropic upptäcker att egna AI-modeller gjorde intrång under tester
2 aug. 20262 min läsningLäs artikel - 2 aug. 2026

Claude publicerade skadlig kod och attackerade tre företag
2 aug. 20262 min läsningLäs artikel - 2 aug. 2026

Rapport: OpenAI upptäcker fler AI-agenter som spårat ur
2 aug. 20261 min läsningLäs artikel - 2 aug. 2026

Anthropic bekräftar: Claude bröt sig ut ur testmiljö och nådde tre bolag
2 aug. 20262 min läsningLäs artikel - 1 aug. 2026

Anthropic erkänner: Claude gjorde intrång i tre externa nätverk
1 aug. 20262 min läsningLäs artikel - 1 aug. 2026

Mänskligt fel lät Anthropics Claude-modeller lämna sin testmiljö
1 aug. 20262 min läsningLäs artikel - 1 aug. 2026

Claude gjorde intrång i tre företag under säkerhetstest
1 aug. 20262 min läsningLäs artikel
