DeepSeek V3 (DeepSeek)
Det kinesiska företaget DeepSeek publicerar DeepSeek V3, en stor öppet tillgänglig modell med Mixture-of-Experts-arkitektur (671 miljarder parametrar, 37 miljarder aktiverade per token), med prestanda jämförbar med de bästa proprietära modellerna till en kraftigt reducerad träningskostnad.
Nyckelpunkter
- DeepSeek släpper DeepSeek V3 den 26 december 2024, en stor modell med öppen tillgång.
- Mixture-of-Experts-arkitektur med 671 miljarder parametrar, varav 37 miljarder aktiveras per token.
- Prestanda jämförbar med de bästa proprietära modellerna till en mycket lägre träningskostnad.
- Bekräftar uppgången av öppna, billiga modeller som möjliga källor för AI-assistenter.
Analys
DeepSeek V3 illustrerar genombrottet för öppna och ekonomiska modeller som kan mäta sig med de proprietära ledarna. Deras öppna tillgänglighet gör dem lätta att integrera i en mängd tredjepartsverktyg, vilket ytterligare mångdubblar de motorer som kan svara användare och citera varumärken.
För synligheten innebär denna spridning att AI-svar kan komma från mycket varierande källor och verktyg, mindre synliga än de stora konsumentassistenterna. Samstämmigheten i varumärkesinformationen över hela webben förblir den bästa hävstången för att framställas korrekt oavsett vilken modell som ligger bakom.
Vad du bör göra
- Begränsa dig inte till de dominerande assistenterna: ta med de tredjepartsverktyg som bygger på öppna modeller i din bevakning.
- Håll varumärkesinformationen samstämmig och aktuell över hela webben, den gemensamma källan för alla modeller.
- Prioritera närvaro på pålitliga och brett återgivna referenser, som matar såväl öppna som proprietära modeller.
Bekräftar framväxten av öppna lågkostnadsmodeller som möjliga källor för AI-assistenter. Värt att bevaka, eftersom dessa modeller allt oftare driver svarsverktyg från tredje part.