Detalles del documento DeepSeek V3: Cómo eludir el monopolio de CUDA
Detalles del documento DeepSeek V3: Cómo saltarse el monopolio de CUDA Los dos modelos de DeepSeek publicados recientemente, DeepSeek-V3 y DeepSeek-R1, consiguen un rendimiento comparable al de modelos similares de OpenAI a un coste mucho menor. Según informan medios extranjeros, en sólo dos meses entrenaron un modelo de lenguaje MoE con 671.000 millones de parámetros en un clúster de 2.048...





