Llama 4 Maverick lanseras på Google Cloud med MoE-arkitektur
Google Cloud har lanserat Llama 4 Maverick 17B-128E, den största modellen i Llama 4-serien. Modellen utnyttjar Mixture-of-Experts-arkitekturen och erbjuder kapacitet för kodning, resonemang och bildanalys.

Vad har hänt?
Google Cloud har tillkännagivit lanseringen av Llama 4 Maverick 17B-128E, en ny stor språkmodell (LLM). Denna modell, som är den mest kapabla i Llama 4-serien, använder en Mixture-of-Experts (MoE)-arkitektur och så kallad "early fusion". Llama 4 Maverick är tillgänglig via Google Clouds Gemini Enterprise Agent Platform som en partnermodell.
Snabbfakta
”Llama 4 Maverick 17B-128E is Llama 4's largest and most capable model. It uses the Mixture-of-Experts (MoE) architecture and early fusion to provide coding, reasoning, and image capabilities.”
”Launch stage: GA Release date: April 29, 2025”
Varför spelar det roll?
Lanseringen av Llama 4 Maverick utökar utbudet av avancerade AI-modeller för utvecklare och företag på Google Cloud-plattformen. MoE-arkitekturen möjliggör effektivare hantering av komplexa uppgifter inom kodning, logiska resonemang och bildförståelse, vilket kan leda till mer avancerade AI-applikationer. Modellens kapacitet att hantera olika datatyper (text, kod, bilder) minskar behovet av flera specialiserade modeller.
Vem påverkas?
Utvecklare, företag som bygger AI-applikationer och slutanvändare av AI-verktyg påverkas. Specifikt får utvecklare tillgång till en kraftfullare modell för att integrera i sina projekt, medan företag kan dra nytta av förbättrad prestanda och effektivitet i sina AI-drivna lösningar som kräver text-, kod- och bildbearbetning. Modellen är designad för "pay-as-you-go" och "provisioned throughput" användning.
Hur påverkas EU?
Llama 4 Maverick 17B-128E är initialt endast tillgänglig i den amerikanska regionen (us-east5) och för ML-bearbetning (Multi-region) i USA. Detta innebär att EU-baserade användare för närvarande inte kan driftsätta modellen med låg latens inom EU, vilket kan påverka datasuveränitet och regelefterlevnad för vissa europeiska företag.
Vad mer bör du veta?
Modellen har en kontextlängd på 524 288 tokens och en maximal output på 8 192 tokens. Den stödjer funktioner som batch-prediktioner, funktionsanrop och strukturerad output, men saknar stöd för Llama Guard.
Snabba svar om den här nyheten
Vad har hänt?
När hände det?
Varför spelar det roll?
Påverkar det EU?
Länken öppnar i nytt fönster och leder till utgivarens egen sida.
Källan är en aggregator eller syndikering — vi rekommenderar att verifiera hos primärutgivaren.
Få liknande nyheter direkt i mejlen
Läsarrummet
Skicka in en fråga eller ett tillägg. Redaktionen läser allt innan det publiceras och svarar när det är relevant. Ingen AI-fri text – bara människor.
Logga in för att skicka in en kommentar eller fråga.
Läs artikeln genom din roll
- Avgör om detta påverkar strategin på 6–12 månaders sikt eller är brus.
- Diskutera i ledningsgruppen: äger vi rätt fråga eller behöver ansvaret flyttas?
- Fråga: vilken risk tar vi genom att INTE agera på det här den här kvartalet?
Genererad vinkling — inte redaktionell analys av "Llama 4 Maverick lanseras på Google Cloud med MoE-arkitektur"