Together AI utvärderar Kimi K3 och Sol på kodningsmåttet DeepSWE
En benchmark-testning på kodnings-riktmärket DeepSWE visar att Kimi K3 ger 2,8 gånger fler lösningar per dollar än Sol, medan en kombinerad routing når en lösningsgrad på 85,6 procent.

Vad har hänt?
Together AI har genomfört en jämförande utvärdering av AI-modellerna Kimi K3 och Sol på kodnings-riktmärket DeepSWE genom totalt 904 körmoment. Resultaten visar att Sol har högre direkt träffsäkerhet vid ett enda försök (pass@1). Kimi K3 presterar däremot bättre över fyra försök (pass@4) och levererar 2,8 gånger fler lösta uppgifter per spenderad dollar. Dessutom visar testerna att en intelligent routing-strategi mellan modellerna uppnår en totallösning på cirka 85,6 procent.
Snabbfakta
| Testade rollouts | 904 stycken |
|---|---|
| Kostnadseffektivitet Kimi K3 | 2,8x fler lösningar per dollar (pass@4) |
| Routing-precision | ~85,6% lösningsgrad |
Varför spelar det roll?
Mätningen ger en konkret bild av avvägningen mellan direkt modellprecision och kostnadseffektivitet vid automatiserad problemlösning. Genom att kombinera en dyrare modell med hög engångsprecision och en mer kostnadseffektiv modell via smart routing kan utvecklare sänka sina täckningskostnader avsevärt utan att tappa i totalkvalitet.
Vem påverkas?
Mätningen berör mjukvaruutvecklare, systemarkitekter och teknikföretag som bygger AI-baserade kodingenjörer eller automatiserade utvecklarverktyg. Den ger värdefull data för organisationer som vill optimera sina API-kostnader vid storskalig kodgenerering.
Hur påverkas EU?
Båda modellerna och utvärderingsverktygen finns tillgängliga globalt via sina respektive API-tjänster och plattformar, vilket gör resultaten relevanta för utvecklare och företag i EU.
Vad mer bör du veta?
Benchmark-mätningar på kodningsuppgifter kan variera beroende på specifika prompts, infrastruktur och konfigurationer. Resultaten belyser dock den växande trenden att kombinera olika specialiserade AI-modeller för att balansera kostnad och prestanda.
Snabba svar om den här nyheten
Vad har hänt?
När hände det?
Varför spelar det roll?
Vilka berörs av resultaten?
Länken öppnar i nytt fönster och leder till utgivarens egen sida.
Källan har spårats automatiskt från utgivaren via Aheadlines signalkedja.
AI-verktyg i artikeln
Ämnen
Få liknande nyheter direkt i mejlen
Läsarrummet
Skicka in en fråga eller ett tillägg. Redaktionen läser allt innan det publiceras och svarar när det är relevant. Ingen AI-fri text – bara människor.
Logga in för att skicka in en kommentar eller fråga.
Läs artikeln genom din roll
- Bedöm teknisk risk: modellval, leverantörsberoende, dataflöde och driftskostnad.
- Uppdatera arkitekturdokumentet om nya API:er eller regelkrav berör produktionen.
- Säkerställ observability + rollback-plan innan ni rullar ut i skarpt.
Genererad vinkling — inte redaktionell analys av "Together AI utvärderar Kimi K3 och Sol på kodningsmåttet Dee"