Moonshot AI släpper Kimi K3: Körs i över 20 tps på GB10-kluster
Moonshot AI har släppt vikterna för sin öppna språkmodell Kimi K3. Samtidigt rapporterar utvecklare att modellen körs i över 20 tokens per sekund på GB10-kluster.

Vad har hänt?
Kinesiska Moonshot AI har publicerat modellvikterna för sin språkmodell Kimi K3, vilket gör den till en av världens största öppet tillgängliga AI-modeller. Enligt rapporter från utvecklarcommunityt har den fullständiga modellen framgångsrikt körts på ett kluster av 16 Nvidia GB10-enheter med en hastighet överstigande 20 tokens per sekund. Kort efter lanseringen tvingades Moonshot AI tillfälligt pausa nya registreringar till sin egen tjänst på grund av extremt hög efterfrågan.
Snabbfakta
| Modell | Moonshot AI Kimi K3 |
|---|---|
| Status vikter | Öppet tillgängliga (open-weight) |
| Hårdvarukluster | 16x GB10 |
| Prestanda | 20+ tokens per sekund |
Varför spelar det roll?
Publiceringen av Kimi K3 markerar ett viktigt steg för öppna AI-modeller, då den erbjuder prestanda som utmanar ledande stängda kommersiella modeller. Lanseringen har dock skapat enorm användartillströmning, vilket resulterat i kapacitetsproblem för Moonshot AI och visat på de höga infratrukturkraven för att driva modellen i stor skala.
Vem påverkas?
Släppet berör främst AI-forskare, systemarkitekter och utvecklare som bygger applikationer baserade på storskaliga språkmodeller. Företag som vill köra egna AI-modeller utan att skicka data till tredjepartsmoln påverkas också, eftersom Kimi K3 ger tillgång till avancerad prestanda på egen infrastruktur.
Hur påverkas EU?
Eftersom Moonshot AI har publicerat Kimi K3 som öppen vikt (open-weight) kan utvecklare och företag i EU själva hosta modellen i lokala datacenters. Detta gör det möjligt att följa kraven i GDPR och den kommande EU AI Act gällande datalokalisering och integritet.
Vad mer bör du veta?
Rapporter i communityt visar att körning av den fulla modellen kräver betydande hårdvaruinfrastruktur på grund av dess storlek. Att använda ett kluster med 16 stycken GB10-enheter för att uppnå över 20 tokens per sekund understryker de extrema beräkningskrav som krävs för att köra nästa generations öppna språkmodeller lokalt.
Snabba svar om den här nyheten
Vad har hänt?
När hände det?
Varför spelar det roll?
Påverkar det EU?
Länken öppnar i nytt fönster och leder till utgivarens egen sida.
Källan har spårats automatiskt från utgivaren via Aheadlines signalkedja.
AI-verktyg i artikeln
Ämnen
Få liknande nyheter direkt i mejlen
Läsarrummet
Skicka in en fråga eller ett tillägg. Redaktionen läser allt innan det publiceras och svarar när det är relevant. Ingen AI-fri text – bara människor.
Logga in för att skicka in en kommentar eller fråga.
Läs artikeln genom din roll
- Bedöm teknisk risk: modellval, leverantörsberoende, dataflöde och driftskostnad.
- Uppdatera arkitekturdokumentet om nya API:er eller regelkrav berör produktionen.
- Säkerställ observability + rollback-plan innan ni rullar ut i skarpt.
Genererad vinkling — inte redaktionell analys av "Moonshot AI släpper Kimi K3: Körs i över 20 tps på GB10-klus"