DeepSeek V4.1 Flash
1M 上下文、384K 输出的 DeepSeek V4.1 Flash,正在接管原 V4 Pro 的线上请求。
1M 上下文、384K 输出的 DeepSeek V4.1 Flash,正在接管原 V4 Pro 的线上请求。
DeepSeek正式发布 DeepSeek-V4.1-Flash 。官方将其定义为新架构系列中最小的模型,原生支持多模态视觉理解,并把更高能力上限、更快推理、更高吞吐和向更大模型扩展列为核心目标。Flash不再只是“便宜版”,而正在成为下一代架构的首个落点。 新架构先在小模型落地 官方基准中,V4....
2026年8月31日,DeepSeek 在官方 Hugging Face 组织 deepseek-ai 上线 DeepSeek-V4-Flash-Vision-Exp 开放权重。模型仓库创建于当日 06:16(UTC),采用 MIT 许可证,提供模型文件、Tokenizer、提示编码参考与最小化 P...
在过去24小时内(2026年8月21日至8月22日),AI行业继续围绕多模态模型、智能体、网络安全和算力基础设施展开竞争。中国市场加快模型与产业应用落地,海外厂商则进一步强化AI安全与Agent工程能力。 1、DeepSeek上线V4-Flash-Vision-Exp DeepSeek推出实验性多模...
2026年6月28日,DeepSeek官方DeepSpec仓库更新并加入DSpark检查点,面向DeepSeek-V4-Flash与V4-Pro提供投机解码支持。官方特别说明,DSpark不是一款新模型,而是在原有模型旁增加一个负责“提前猜测”的草稿模块,目标是在不改变主模型输出分布的前提下缩短生成...
2026年4月24日,DeepSeek V4 已正式浮出水面。和几个小时前还只能依据媒体传闻判断不同,现在 DeepSeek 官方 Hugging Face 组织已经上线 DeepSeek-V4-Pro、DeepSeek-V4-Flash 及对应 Base 模型,官方 API 价格页也同步出现 de...