跳到正文
原文
HuggingFace Daily Papers(社区热门论文)·· 21 天前精选AI 评分85

DeepSeek-V4.1-Flash 发布:552B MoE 多模态模型主打 KV cache 压缩

DeepSeek-V4.1-Flash: Pushing the Limits of KV Cache Compression

AI 导读

DeepSeek 发布 DeepSeek-V4.1-Flash,一个 552B 参数的多模态 MoE 模型,支持最长 100 万 token 上下文,模型权重已在 Hugging Face 开放。

推荐理由

论文给出了每 token KV cache 字节数等具体压缩指标,并与上一代模型直接对比,可评估长上下文 Agent 部署成本变化。

整理与数据来源:AIHOT

来源:HuggingFace Daily Papers(社区热门论文) · arxiv.org