Detail kertas DeepSeek V3: Cara menerobos monopoli CUDA!
Detail kertas DeepSeek V3: Cara mem-bypass monopoli CUDA! Dua model DeepSeek yang baru saja dirilis, DeepSeek-V3 dan DeepSeek-R1, mencapai kinerja yang sebanding dengan model serupa dari OpenAI dengan biaya yang jauh lebih rendah. Menurut laporan media asing, hanya dalam waktu dua bulan, mereka melatih model bahasa MoE dengan 671 miliar parameter pada klaster yang terdiri dari 2.048...





