DeepSeek、V4.1 Flashモデルを本日リリース、KVキャッシュの必要量を従来版の4分の1に削減
Guru Clubによると、DeepSeekは本日(9月10日)、新しいV4.1 Flashモデルを正式にローンチした。これは同社の新アーキテクチャシリーズにおける最小モデルで、ネイティブのマルチモーダル画像理解機能を備えている。V4.1 FlashはKVキャッシュのバッファサイズを大幅に削減し、前世代と比べてHBM(広帯域メモリ)の必要量を4分の1、SSDの必要量を8分の1に抑えている。これにより、キャッシュヒットが主要なコスト要因となるエージェントベースのタスクにおいて、推論コストを大幅に削減できる。
DEEPSEEK-2.29%
GateNews·09-10 06:09
