Detta 2,8T-modell förändrar AI för alltid
Baserad på forskning av Kimi Team, Tongtong Bai, Yifan Bai, Yiping Bao, M. C.
Den öppna AI-kapplöpningen fick nyligen ett rejält adrenalinlyft. Forskare har presenterat Kimi K3, en enorm modell med 2,8 biljoner parametrar som utmanar de slutna systemens dominans genom att leverera prestanda i framkant utan att binda användaren till proprietära lösningar. Det handlar inte bara om en större modell, utan om en fundamentalt smartare arkitektur som är designad för att hantera komplexa och långvariga uppgifter med en oöverträffad effektivitet.
I grunden använder Kimi K3 en Mixture-of-Experts-arkitektur där endast 104 miljarder parametrar är aktiva för varje given uppgift. Detta möjliggör att hantera ett slående kontextfönster på en miljon token. Teamet lyckades nå denna skala genom att introducera Kimi Delta Attention och Attention Residuals, vilket förbättrar hur information flödar genom modellens djup och längd avsevärt. I kombination med tekniken Stable LatentMoE aktiverar systemet endast 16 av 896 experter per token, vilket resulterar i en 2,5-förbättring i skalningseffektivitet jämfört med föregångaren. Denna arkitektoniska genombrott innebär att modellen kan resonera, skriva kod och förstå visuella indata samtidigt som den använder resurser betydligt mer effektivt än tidigare generationer.
Den verkliga överraskningen ligger i hur modellen hanterar komplexitet. Genom att tillämpa förstärkningsinlärning inom allmänna, agenta och programmeringsdomäner visar Kimi K3 robust långsiktig utförande. Den svarar inte bara på frågor; den kan planera och genomföra arbetsflöden med flera steg med kompositionell generalisering, vilket innebär att den kan tillämpa inlärda färdigheter på nya, osedda situationer. Även om den fortfarande ligger efter de absolut främsta proprietära modellerna som Claude Fable 5 och GPT-5.6 Sol, slår den konsekvent alla andra öppna och proprietära modeller i utvärderingssviten. Detta placerar den som det mest kapabla öppna alternativet som finns tillgängligt idag och överbryggar gapet mellan akademisk forskning och industriell användbarhet.
Meddelandet är tydligt: tröskeln för att bygga kraftfulla AI-system sänks. Genom att släppa hela modellens vikter ger Kimi Teamet nycklarna till kungariket till det bredare forskarsamhället. Detta steg accelererar adoptionen av framkantsintelligens och bevisar att öppna modeller nu kan tävla med de bästa slutna systemen inom kodning, resonemang och visuell analys. För utvecklare och forskare är detta ett tecken på att högpresterande AI inte längre är ett exklusivt domän för några få techjättar.