Säkerhet
Säkerhet och risker

Googles AI som stöd vid psykisk ohälsa
2 min läsning
+Läs artikel
Utvalda
Att läsa just nu
Utvalda
Att läsa just nu
Analys
Studie belyser säkerhetsbrister i AI-styrda robotassistentmodeller
Läs artikel
Säkerhet
GitHub lanserar spel för att öka AI-säkerhetskompetens
GitHub har lanserat "GitHub Secure Code Game" för att utbilda utvecklare i att identifiera och åtgärda sårbarheter i agentbaserade AI-system. Spelet är öppet och gratis att använda.
2 min läsning+Läs artikel
Arkiv
Tidigare publicerat
Arkiv
Tidigare publicerat
- 8 juli 2026

Nytt ramverk utvärderar säkerhet för AI-kompanjoner
8 juli 20262 min läsningLäs artikel - 8 juli 2026

Studie avslöjar orsak till jailbreaks i stora språkmodeller
8 juli 20262 min läsningLäs artikel - 8 juli 2026

Nytt benchmark för militäranpassad AI-säkerhet: ARMOR 2025
8 juli 20262 min läsningLäs artikel - 8 juli 2026

Ny AI-forskning: Angripare har systematisk fördel mot LLM-säkerhet
8 juli 20262 min läsningLäs artikel - 7 juli 2026

Pennsylvania stämmer Character.AI efter läkarutgivning
7 juli 20262 min läsningLäs artikel - 7 juli 2026

OpenAI publicerar säkerhetskort för GPT-5.5 Instant
7 juli 20262 min läsningLäs artikel - 7 juli 2026

Ny forskning adresserar "emergent misalignment" i LLM:er
7 juli 20262 min läsningLäs artikel - 7 juli 2026

Ny arkitektur för autonoma cyberförsvar med robust LLM-kontroll
7 juli 20262 min läsningLäs artikel - 7 juli 2026

ChatGPT lanserar betrodd kontakt för självmordsprevention
7 juli 20262 min läsningLäs artikel - 7 juli 2026

OpenAI lanserar säkerhetsfunktion för självmordsrisk
7 juli 20262 min läsningLäs artikel - 7 juli 2026

Ny metod att försvara LLM mot skadlig flerstegsdialog
7 juli 20263 min läsningLäs artikel - 7 juli 2026

"Chainwash" avslöjar svagheter i vattenmärkning av diffusionsmodeller
7 juli 20262 min läsningLäs artikel - 7 juli 2026

OpenAI detaljerar säkerhetsåtgärder för AI-modellen Codex
7 juli 20262 min läsningLäs artikel - 7 juli 2026

OpenAI skapar säker sandlåda för Codex på Windows
7 juli 20262 min läsningLäs artikel - 7 juli 2026

Nytt ramverk identifierar svagheter i bild-språkmodeller (VLM)
7 juli 20262 min läsningLäs artikel