Was ist DeepSeek, der Konkurrent von ChatGPT? Wie nutzt man DeepSeek?
Im Bereich der künstlichen Intelligenz gibt es täglich neue und aufregende Entwicklungen. In letzter Zeit hat das chinesische Unternehmen DeepSeek in diesem Bereich für Aufsehen gesorgt. Doch was genau ist DeepSeek und wie wird es verwendet?
12punto
Künstliche Intelligenz beeinflusst die Technologie der Zukunft und die Gegenwart tiefgreifend. Der Name, der in der Welt der künstlichen Intelligenz in letzter Zeit am häufigsten genannt wird, ist das chinesische DeepSeek. Was ist also DeepSeek? Wie nutzt man DeepSeek?
WAS IST DEEPSEEK?
DeepSeek ist ein in China ansässiges Forschungslabor für künstliche Intelligenz, das sich auf die Entwicklung von Open-Source-Sprachmodellen (LLM) konzentriert. Das Unternehmen wurde 2023 von Liang Wenfeng, dem Gründer und Manager des Hedgefonds High-Flyer, ins Leben gerufen, um die Arbeit im Bereich der künstlichen Intelligenz voranzutreiben. Zuvor war High-Flyer für die Entwicklung KI-basierter Handelsalgorithmen bekannt.
DeepSeek Coder (November 2023): Dieses Modell, das speziell auf Programmieraufgaben ausgerichtet ist, wurde sowohl Forschern als auch kommerziellen Nutzern kostenlos zur Verfügung gestellt. Das Modell wurde unter der MIT-Lizenz als Open Source veröffentlicht.
DIE ENTWICKELTEN MODELLE
DeepSeek LLM (November 2023): Dieses Modell mit 67 Milliarden Parametern wurde entwickelt, um mit großen Sprachmodellen wie GPT-4 zu konkurrieren. Es stieß jedoch auf einige Herausforderungen in Bezug auf Recheneffizienz und Skalierbarkeit. Die Chatbot-Version des Modells, DeepSeek Chat, wurde im gleichen Zeitraum veröffentlicht.
DeepSeek-V2 (Mai 2024): Dieses Modell, das im Vergleich zu seinen Konkurrenten zu geringeren Kosten (2 RMB pro Million Output-Token) auf den Markt gebracht wurde, belegte im Ranking des Tiger Lab der University of Waterloo den siebten Platz.
DeepSeek-V3 (Dezember 2024): Dieses Modell mit 671 Milliarden Parametern wurde über einen Zeitraum von etwa 55 Tagen auf einem riesigen Datensatz von 14,8 Billionen Token trainiert. Die Gesamtkosten des Trainingsprozesses beliefen sich auf 5,58 Millionen US-Dollar. Mit seiner Leistung übertraf das Modell Llama 3.1 sowie Qwen 2.5 und erreichte ein Niveau, das mit GPT-4o und Claude 3.5 Sonnet vergleichbar ist.
DeepSeek R1-Lite-Preview (November 2024): Dieses Modell ist auf logische Schlussfolgerungen, mathematisches Denken und Problemlösung in Echtzeit spezialisiert. Es zeigte eine ähnliche Leistung wie das o1-Modell von OpenAI.