DeepSeek V4: Neue Maßstäbe für Open-Source-AI
DeepSeek stellt V4-Pro und V4-Flash vor: Open-Source-AI-Modelle mit bis zu 1,6 Billionen Parametern, 1M Token-Kontext und hoher Effizienz. Sie fordern Branchenführer heraus.
DeepSeek hat seine V4-Serie von Open-Source-AI-Modellen vorgestellt und zwei Varianten eingeführt: V4-Pro mit etwa 1,6 Billionen Parametern und V4-Flash mit 284 Milliarden Parametern. Beide Modelle unterstützen ein Kontextfenster von 1 Million Token und erreichen damit das Niveau führender Modelle wie Google Gemini. Das V4-Pro-Modell liefert laut Berichten eine Leistung, die mit den besten Closed-Source-Systemen vergleichbar ist, insbesondere bei Aufgaben in den Bereichen Reasoning, Coding und MINT. V4-Flash bietet eine effizientere und kostengünstigere Alternative und zeichnet sich durch geringeren Rechen- und Speicherbedarf aus. Die Modelle stehen unter der MIT-Lizenz, die Gewichte sind auf Hugging Face und ModelScope verfügbar. Die Veröffentlichung fällt mit Berichten zusammen, dass große chinesische Tech-Unternehmen Investitionen in DeepSeek erwägen, was das Unternehmen auf über 20 Milliarden US-Dollar bewerten könnte. Der Einsatz auf Huawei-Chips könnte das chinesische KI-Ökosystem stärken, wobei reale Leistung und Skalierbarkeit entscheidend bleiben.