DeepSeek V3 (DeepSeek)
A empresa chinesa DeepSeek publica o DeepSeek V3, um grande modelo em acesso livre com arquitetura Mixture-of-Experts (671 mil milhões de parâmetros, 37 mil milhões ativados por token), com desempenho comparável aos melhores modelos proprietários por um custo de treino muito reduzido.
Pontos-chave
- A DeepSeek publica o DeepSeek V3 a 26 de dezembro de 2024, um grande modelo de acesso livre.
- Arquitetura Mixture-of-Experts de 671 mil milhões de parâmetros, dos quais 37 mil milhões ativados por token.
- Desempenhos comparáveis aos melhores modelos proprietários por um custo de treino muito reduzido.
- Confirma a ascensão dos modelos abertos de baixo custo como fontes possíveis dos assistentes de IA.
Análise
O DeepSeek V3 ilustra a irrupção de modelos abertos e económicos capazes de rivalizar com os líderes proprietários. A sua disponibilidade em acesso livre torna-os fáceis de integrar numa multiplicidade de ferramentas de terceiros, o que multiplica ainda mais os motores suscetíveis de responder aos internautas e de citar marcas.
Para a visibilidade, esta difusão significa que as respostas de IA podem provir de fontes e ferramentas muito variadas, menos visíveis do que os grandes assistentes de grande público. A coerência das informações da marca em toda a web continua a ser a melhor alavanca para permanecer corretamente representado, seja qual for o modelo subjacente.
O que fazer
- Não se limitar aos assistentes dominantes: integrar na monitorização as ferramentas de terceiros que se apoiam em modelos abertos.
- Manter informações de marca coerentes e atualizadas em toda a web, fonte comum de todos os modelos.
- Priorizar a presença em referências fiáveis e amplamente retomadas, que alimentam tanto os modelos abertos como os proprietários.
Confirma a ascensão dos modelos abertos de baixo custo como fontes possíveis dos assistentes de IA. A monitorizar, pois estes modelos alimentam cada vez mais ferramentas de resposta de terceiros.