Hoppa till innehåll
Kodning & Utveckling· NyhetTillgängligt

Together AI utvärderar Kimi K3 och Sol på kodningsmåttet DeepSWE

En benchmark-testning på kodnings-riktmärket DeepSWE visar att Kimi K3 ger 2,8 gånger fler lösningar per dollar än Sol, medan en kombinerad routing når en lösningsgrad på 85,6 procent.

Av Aheadline-redaktionen·30 juli 2026·2 min läsning·Källa: Together AI BlogVerifierad signalAI-genererad
Together AI utvärderar Kimi K3 och Sol på kodningsmåttet DeepSWE
Together AI utvärderar Kimi K3 och Sol på kodningsmåttet DeepSWE
Together AI utvärderar Kimi K3 och Sol på kodningsmåttet DeepSWE
Av · Policy- & EU-reporter

Vad har hänt?

Together AI har genomfört en jämförande utvärdering av AI-modellerna Kimi K3 och Sol på kodnings-riktmärket DeepSWE genom totalt 904 körmoment. Resultaten visar att Sol har högre direkt träffsäkerhet vid ett enda försök (pass@1). Kimi K3 presterar däremot bättre över fyra försök (pass@4) och levererar 2,8 gånger fler lösta uppgifter per spenderad dollar. Dessutom visar testerna att en intelligent routing-strategi mellan modellerna uppnår en totallösning på cirka 85,6 procent.

Snabbfakta

Testade rollouts904 stycken
Kostnadseffektivitet Kimi K32,8x fler lösningar per dollar (pass@4)
Routing-precision~85,6% lösningsgrad

Varför spelar det roll?

Mätningen ger en konkret bild av avvägningen mellan direkt modellprecision och kostnadseffektivitet vid automatiserad problemlösning. Genom att kombinera en dyrare modell med hög engångsprecision och en mer kostnadseffektiv modell via smart routing kan utvecklare sänka sina täckningskostnader avsevärt utan att tappa i totalkvalitet.

Vem påverkas?

Mätningen berör mjukvaruutvecklare, systemarkitekter och teknikföretag som bygger AI-baserade kodingenjörer eller automatiserade utvecklarverktyg. Den ger värdefull data för organisationer som vill optimera sina API-kostnader vid storskalig kodgenerering.

Hur påverkas EU?

Båda modellerna och utvärderingsverktygen finns tillgängliga globalt via sina respektive API-tjänster och plattformar, vilket gör resultaten relevanta för utvecklare och företag i EU.

Vad mer bör du veta?

Benchmark-mätningar på kodningsuppgifter kan variera beroende på specifika prompts, infrastruktur och konfigurationer. Resultaten belyser dock den växande trenden att kombinera olika specialiserade AI-modeller för att balansera kostnad och prestanda.

Vanliga frågor

Snabba svar om den här nyheten

Vad har hänt?
Together AI har genomfört 904 utvärderingskörmoment på riktmärket DeepSWE för att jämföra prestanda och kostnadseffektivitet mellan AI-modellerna Kimi K3 och Sol.
När hände det?
Testresultaten publicerades av Together AI i maj 2024.
Varför spelar det roll?
Testerna visar att kostnadseffektiva modeller som Kimi K3 kan ge fler lösta uppgifter per dollar, och att dynamisk routing mellan modeller kan optimera både prestanda och budget vid automatiserad kodgenerering.
Vilka berörs av resultaten?
Resultaten är direkt relevanta för alla utvecklare och företag globalt som använder API-baserade AI-modeller för programvaruutveckling och kodgenerering.
Originalkälla
Together AI Blog·together.ai

Länken öppnar i nytt fönster och leder till utgivarens egen sida.

Verifierad signal

Källan har spårats automatiskt från utgivaren via Aheadlines signalkedja.

AI-verktyg i artikeln

Ämnen

#GPT-5.6 Sol#AI-benchmarking#Kimi K3#Kodgenerering
[ FÖLJ UTVECKLINGEN ]

Få liknande nyheter direkt i mejlen

Inga affiliate-länkarAvsluta när som helstGDPR-vänlig
[ Frekvens ]
[ Vad vill du läsa om? ]

Du får utskick om 2 ämnen.

Läsarrummet

Skicka in en fråga eller ett tillägg. Redaktionen läser allt innan det publiceras och svarar när det är relevant. Ingen AI-fri text – bara människor.

Logga in för att skicka in en kommentar eller fråga.

Laddar kommentarer…
Så här påverkar det dig

Läs artikeln genom din roll

  • Bedöm teknisk risk: modellval, leverantörsberoende, dataflöde och driftskostnad.
  • Uppdatera arkitekturdokumentet om nya API:er eller regelkrav berör produktionen.
  • Säkerställ observability + rollback-plan innan ni rullar ut i skarpt.

Genererad vinkling — inte redaktionell analys av "Together AI utvärderar Kimi K3 och Sol på kodningsmåttet Dee"