Säkerhet
Säkerhet och risker

OpenAI visar nytt säkerhetssystem: Flaggar risker utan att läsa promptar
2 min läsning
+Läs artikel
Utvalda
Att läsa just nu
Utvalda
Att läsa just nu

Nyhet
OpenAI bromsar träning av AI-modeller efter nya cyberrisker
Läs artikel
Nyhet
Ny metod döljer vägrar-signaler för att stoppa hackning av AI-säkerhet
En ny forskningsmetod kallad AMRA gör det svårare att ta bort säkerhetsspärrar från öppna språkmodeller. Genom att dölja modellens interna vägrar-signaler med slumpmässiga alias behålls skyddet utan att den generella förmågan försämras.
2 min läsning+Läs artikel
Arkiv
Tidigare publicerat
Arkiv
Tidigare publicerat
- 18 aug. 2026

HarmProfile: Nytt dataset analyserar skadliga utdata från 23 språkmodeller
18 aug. 20262 min läsningLäs artikel - 18 aug. 2026

OpenAI lägger ned sitt dedikerade säkerhetsteam i omstrukturering
18 aug. 20262 min läsningLäs artikel - 18 aug. 2026

DeepMinds Demis Hassabis vill se oberoende organ för AI-säkerhet
18 aug. 20262 min läsningLäs artikel - 16 aug. 2026

Anthropic detaljerar ny kraftfull AI-modell och nya säkerhetsrisker
16 aug. 20262 min läsningLäs artikel - 13 aug. 2026

OpenAI pausar ChatGPT-uppdatering – befaras vara för farlig
13 aug. 20262 min läsningLäs artikel - 12 aug. 2026

OpenAI pausar arbetet med AI-modellen Astra av säkerhetsskäl
12 aug. 20262 min läsningLäs artikel - 11 aug. 2026

Anthropic inför osynliga vattenstämplar i alla Claude-utdata
11 aug. 20262 min läsningLäs artikel - 11 aug. 2026

OpenAI bromsar AI-modellen Astra efter varning om kritisk cyberrisk
11 aug. 20262 min läsningLäs artikel - 11 aug. 2026

OpenAI pausar ny modell efter farhågor om autonoma cyberattacker
11 aug. 20262 min läsningLäs artikel - 11 aug. 2026

OpenAI utökar programmet Daybreak för stärkt AI-baserat cyberförsvar
11 aug. 20262 min läsningLäs artikel - 9 aug. 2026

AI-säkerhetstester blir ny säkerhetsrisk när agenter flyr testmiljöer
9 aug. 20262 min läsningLäs artikel - 9 aug. 2026

Varningar för AI-säkerhet ökar när nya modeller testar gränserna
9 aug. 20262 min läsningLäs artikel - 9 aug. 2026

OpenAI bromsar utvecklingen av Astra på grund av säkerhetsrisker
9 aug. 20262 min läsningLäs artikel - 8 aug. 2026

OpenAI utvärderar avancerade cyberförmågor i kommande modellen Astra
8 aug. 20262 min läsningLäs artikel - 8 aug. 2026

OpenAI bromsar ny AI-modell efter fynd om cybersäkerhet
8 aug. 20262 min läsningLäs artikel
