DeepSeek V4 AI模型开源发布,性能创新
DeepSeek发布V4-Pro和V4-Flash开源AI模型,参数高达1.6万亿,支持百万token上下文,具高效能和低成本,挑战行业领先者。
DeepSeek发布了V4系列开源AI模型,包含V4-Pro和V4-Flash两个版本。V4-Pro拥有约1.6万亿参数,V4-Flash则为2840亿参数。两款模型均支持100万token的上下文窗口,达到Google Gemini等领先模型的水平。 据官方介绍,V4-Pro在推理、编程和STEM任务上表现媲美顶级闭源系统,而V4-Flash则以更高效、低成本为特色。DeepSeek强调其模型在计算和内存需求上大幅优于竞争对手。模型采用MIT协议开源,权重可在Hugging Face和ModelScope获取。 此次发布正值中国大型科技公司考虑投资DeepSeek,或将公司估值提升至200亿美元以上。目前V4模型仅支持文本,未来有望扩展功能,并可能在华为芯片上部署,推动中国AI生态发展。实际性能和可扩展性仍是大规模应用的关键。