A DeepSeek lança hoje o modelo Flash V4.1, reduzindo as necessidades de cache KV para um quarto das registadas na versão anterior.
Segundo o Guru Club, a DeepSeek lançou oficialmente hoje (10 de setembro) o seu novo modelo V4.1 Flash. O modelo mais pequeno da nova série de arquiteturas da empresa inclui capacidades nativas de compreensão visual multimodal. O modelo reduz significativamente o tamanho do buffer da KV Cache, diminuindo os requisitos de HBM (memória de elevada largura de banda) para 1/4 e os requisitos de SSD para 1/8 face à geração anterior, reduzindo substancialmente os custos de inferência em tarefas baseada
DEEPSEEK-2,29%
GateNews·09-10 06:09
