DeepSeek V3 (DeepSeek)
La empresa china DeepSeek publica DeepSeek V3, un gran modelo de acceso abierto con arquitectura Mixture-of-Experts (671.000 millones de parámetros, 37.000 millones activados por token), con un rendimiento comparable al de los mejores modelos propietarios por un coste de entrenamiento muy reducido.
Puntos clave
- DeepSeek publica DeepSeek V3 el 26 de diciembre de 2024, un gran modelo de acceso abierto.
- Arquitectura Mixture-of-Experts de 671 mil millones de parámetros, de los cuales 37 mil millones se activan por token.
- Rendimiento comparable al de los mejores modelos propietarios con un coste de entrenamiento muy reducido.
- Confirma el ascenso de los modelos abiertos de bajo coste como posibles fuentes de los asistentes de IA.
Análisis
DeepSeek V3 ilustra la irrupción de modelos abiertos y económicos capaces de rivalizar con los líderes propietarios. Su disponibilidad en acceso abierto los hace fáciles de integrar en multitud de herramientas de terceros, lo que multiplica aún más los motores susceptibles de responder a los internautas y de citar marcas.
Para la visibilidad, esta difusión significa que las respuestas de IA pueden provenir de fuentes y herramientas muy variadas, menos visibles que los grandes asistentes de gran público. La coherencia de la información de marca a través de la web sigue siendo la mejor palanca para permanecer correctamente representado sea cual sea el modelo subyacente.
Qué hacer
- No limitarse a los asistentes dominantes: integrar en la vigilancia las herramientas de terceros que se apoyan en modelos abiertos.
- Mantener una información de marca coherente y actualizada en el conjunto de la web, fuente común de todos los modelos.
- Priorizar la presencia en referencias fiables y ampliamente retomadas, que alimentan tanto los modelos abiertos como los propietarios.
Confirma el auge de los modelos abiertos de bajo coste como posibles fuentes de los asistentes de IA. A vigilar, ya que estos modelos alimentan cada vez más herramientas de respuesta de terceros.