DeepSeek V4.1 Flash模型正式發佈
金色財經報道,9月10日,DeepSeek正式發佈DeepSeek V4.1 Flash模型。這是公司全新模型結構系列中的最小尺寸的模型,具備原生多模態視覺理解能力。據介紹,新一代模型大幅減少了KV Cache緩存的大小,與上一代模型相比,對HBM的需求減少到1/4,對SSD的需求減少到1/8。在Agent使用場景中,緩存命中的費用往往佔比較高,對KV Cache的壓縮大幅降低了Agent類任務的使用成本。(金十)
免責聲明:本網站提供的資訊僅供教育和參考之用,不應視為財務或投資建議。
讚







