Künstliche Intelligenz (KI) ist längst in unserem Alltag angekommen. Und obwohl ChatGPT, Gemini & Co. schon jetzt außerordentliche Leistungen vollbringen, geht die Entwicklung rasend schnell voran. Der neueste Stern am KI-Himmel ist das chinesische Modell „DeepSeek R1“. Aber was macht die KI von DeepSeek so besonders? Was unterscheidet dieses Modell von der Konkurrenz? Und warum gibt es auch kritische Stimmen?

Reasoning als Basis

Derzeit macht ein neues Großes Sprachmodell (LLM) des chinesischen Unternehmens DeepSeek weltweit von sich reden. Anfang Januar 2025 veröffentlicht, hat sich DeepSeek R1 schnell an die Spitze der App-Charts gesetzt und ist damit zu einer echten Konkurrenz für die großen Player wie OpenAI geworden. Was die Leistungen angeht, kann DeepSeek R1 gut mit den besten westlichen KI-Modellen mithalten.

Ähnlich wie GPZ-o1 von Open AI ist auch R1 ein sogenanntes Reasoning-Modell. Dieses kann menschliche Sprache sowohl verstehen als auch selbst generieren, beantwortet Anfragen aber wesentlich besser. Das liegt daran, dass Reasoning-Modelle die Aufgaben, die ihnen gestellt werden, zunächst in mehrere Schritte zerlegen. Anschließend probieren sie intern verschiedene Lösungsansätze aus und geben erst danach ihre endgültige Antwort.

Lassen wir solchen Modellen die notwendige Zeit, sind sie dazu in der Lage, unterschiedliche Lösungsansätze zu formulieren und nach einer Überprüfung auch wieder zu verwerfen, um auf diese Weise die optimale Lösung zu finden. Ihre große Stärke liegt deshalb vor allem darin, komplexe Probleme in der Programmierung, der Mathematik und den Naturwissenschaften zu lösen. Menschen müssten hier in aller Regel deutlich länger nachdenken. Doch allein der Umstand, dass es sich bei R1 von DeepSeek um ein Reasoning-Modell handelt, erklärt noch nicht den großen Hype um diese KI.

Frei verfügbar bei geringen Trainingskosten

In der LLM-Branche ist DeepSeek noch relativ neu. Verglichen mit anderen chinesischen KI-Riesen wie zum Beispiel Alibaba, die stärker mit der Regierung vernetzt sind, war das Unternehmen auch lange eher unscheinbar. Allerdings hat es schon 2024 mit innovativen Forschungsergebnissen auf sich aufmerksam gemacht. Im Gegensatz zu US-amerikanischen Firmen hat DeepSeek diese Forschungsergebnisse öffentlich zur Verfügung gestellt.

Mit dem KI-Modell R1 hat DeepSeek plötzlich die Spitzenposition der weltweiten Benchmarks übernommen. Gleichzeitig hat das Unternehmen sein Modell frei zum Download verfügbar gemacht. Dadurch kann jeder R1 nutzen und auf seine Zwecke anpassen.

Auch technisch hat DeepSeek R1 mehrere Innovationen zu bieten. So lässt sich das Modell nach Angaben der Entwickler zum Beispiel besonders effizient und ressourcenschonend trainieren. DeepSeek beziffert die Trainingskosten auf gerade einmal 5,6 Millionen US-Dollar. Zum Vergleich: Bei ähnlich leistungsfähigen KI-Modellen von OpenAI oder Google verschlingt das Training zwischen 100 Millionen und einer Milliarde US-Dollar. Ob die Angaben von DeepSeek tatsächlich stimmen, muss zwar noch überprüft werden. Doch Experten halten sie für durchaus realistisch.

Ressourceneinsparungen dank MoE-Architektur

Doch R1 punktet nicht nur mit einem kostengünstigen Training, sondern soll auch während der Anwendung bei der notwendigen Rechenleistung und im Energieverbrauch sparsamer sein als andere Modelle. Möglich wird das durch eine sogenannte MoE-Architektur.

MoE steht für „Mixture of Experts“ und lässt sich mit einem großen Kaufhaus vergleichen, das verschiedene Abteilungen hat. In so einem Kaufhaus muss nicht ein einziger Verkäufer alles wissen, weil jede Abteilung ihre Experten hat. Ein Verkäufer aus der Elektronikabteilung hilft bei Fragen zum neuen Smartphone, ein Verkäufer aus der Modeabteilung berät bei der Zusammenstellung des Outfits und ein Verkäufer aus der Buchabteilung empfiehlt spannende Lektüren für den Urlaub.

Beim KI-Modell funktioniert die MoE-Architektur nach dem gleichen Prinzip. Nicht das ganze Modell beantwortet alle Anfragen, sondern entscheidet je nach Aufgabe, welche Spezialisten – also Teilnetze – es aktiviert. Auf diese Weise kann sowohl beim Lernen als auch beim Antworten Rechenleistung gespart werden.

Kritik an R1 und Chance für Europa

Obwohl R1 von DeepSeek an vielen Stellen Lob verdient, gibt es auch Kritikpunkte. Dazu gehört, dass zwar der Großteil des Sprachmodells frei im Internet verfügbar ist, mit den Trainingsdaten und dem Trainingscode aber entscheidende Teile fehlen. Doch gerade sie sind notwendig, um nachvollziehen zu können, wie R1 im Detail funktioniert.

Ein anderer Kritikpunkt ist, dass das Sprachmodell der chinesischen Zensur unterliegt. Wer die KI zu kritischen Themen in der chinesischen Politik befragt, muss damit rechnen, dass die Antwort lautet: „Tut mir leid, das würde meinen Rahmen sprengen. Lassen Sie uns über etwas anderes reden.“

Unabhängig davon bietet R1 aber das Potenzial, um den Fortschritt der KI zu beschleunigen und neue Innovationen auf den Weg zu bringen. Das gilt auch und vor allem für Europa. Die Veröffentlichung des Modells hat gezeigt, dass die Dominanz der US-amerikanischen Modelle kleiner ist als bislang vermutet. In Europa sind die Rechenkapazitäten vorhanden, um mit dem veröffentlichten Konzept und den ohnehin verfügbaren Daten ein eigenes Sprachmodell zu trainieren. Damit ist die Chance gegeben, die weitere Entwicklung von LLMs selbst in die Hand zu nehmen und sich unabhängiger zu machen.

Gerade in jüngerer Vergangenheit sind durch bundesweite KI-Programme viele talentierte KI-Wissenschaftler nach Deutschland gekommen. Wir sind also dazu in der Lage, auf Basis von R1 ein eigenes Sprachmodell auf den Weg zu bringen.

Mehr Ratgeber, Tipps und Anleitungen:

< Prev		Next >

[ zurück ]

PDF-Download

PDF Anleitungen

Grafiken

Grafiken, Tabellen und Diagramme

Populäre Artikel

IT & Internet

Infos und Fakten zu VoIP
Alle wichtigen Infos und Fakten zu VoIP Das Kürzel VoIP steht für Voice over IP und meint das Telefonieren mithilfe des Internet P...

4 Tipps zum sicheren Surfen in öffentlichen WLan-Netzen
4 Tipps zum sicheren Surfen in öffentlichen WLan-Netzen Ob am Flughafen oder im Hotel, im Zug, im Café oder bei einem Bummel...

Strukturen von WLan-Netzwerken
Die Strukturen von WLan-NetzwerkenEin WLan-Netzwerk ist ein räumlich begrenztes drahtloses Netzwerk, das über eine Luftschnittstel...

Der optimale Standort für den WLan-Router - 5 Tipps
Der optimale Standort für den WLan-Router - 5 Tipps Eigentlich ist der WLan-Empfang in der Wohnung ganz passabel. Nur ausgerechnet am L...

Infos und Tipps zu kostenlosen Anti-Viren-Programmen
Infos und Tipps zu kostenlosen Anti-Viren-Programmen Vermutlich jeder Internetnutzer hat in seinem virtuellen Briefkasten schon einmal eine...

WLan Themen

Link-Empfehlung

Initiative Netzqualität

Lokale Funknetze

Heise.de

Verband Internetwirtschaft

mehr Artikel

Änderungen Medien und Telekommunikation in 2013 Die wichtigsten Änderungen im Bereich Medien und Telekommunikation in 2013 Wie jedes Jahr bringt auch 2013 einige Änderungen und Neuerungen mit sich. Einige dieser Neuerungen entlasten den Geldbeutel, andere wiederum führen zu höheren Kosten. Im Bereich Medien und Telekommunikation gibt es im Wesentlichen zwei große Änderungen.   Ganzen Artikel...

Fakten und Infos zur Handystrahlung Die interessantesten Fakten und Infos zur Handystrahlung Während eine nahezu uneingeschränkte Erreichbarkeit vor wenigen Jahren noch wie weit entfernte Zukunftsmusik klang, sind Handys heute selbstverständlich und vor allem die jüngeren Generationen können sich oft kaum vorstellen, wie Zeiten ohne Mobilfunk und Internet funktioniert haben sollen. Mit der Verbreitung des Mobilfunks sind aber auch die Bedenken vor möglichen Schädigungen infolge des Handygebrauchs laut geworden.    Ganzen Artikel...

Selbstgebaute WLan-Antennen Vor- und Nachteile von selbstgebauten WLan-Antennen Grundsätzlich kommen im Zusammenhang mit WLan drei Antennentypen zum Einsatz. Richtantennen werden verwendet, um Punkt-zu-Punkt-Verbindungen herzustellen. Der Winkel, der dabei abgedeckt wird, ist zwar verhältnismäßig klein, allerdings können deutliche Verbesserungen in eine Richtung erreicht werden. Wichtig ist, die Antenne sehr sorgfältig auszurichten, denn die Qualität der Verbindung wird schon bei minimalen Abweichungen beeinträchtigt. Dennoch ermöglichen Richtantennen recht hohe Übertragungsraten und eine deutliche Reduzierung von Störfaktoren.   Ganzen Artikel...

5 Fragen zur „Buy now, pay later“-Zahlweise bei Online-Käufen 5 Fragen zur „Buy now, pay later“-Zahlweise bei Online-Käufen Jetzt etwas bestellen und die Ware erst später bezahlen: Solche Käufe werden durch die „Buy now, pay later“-Zahlweise möglich. Dabei ist dieses Modell gar nicht so neu. Vor allem der Kauf auf Rechnung, teilweise mit einer verlängerten Zahlungsfrist, ist bei Online-Bestellungen seit jeher sehr beliebt. Doch während bislang meist der Händler die Zahlung abgewickelt hat, übernehmen nun immer öfter Bezahldienste diese Aufgabe. Ganzen Artikel...

Infos und Fakten zum WLan Zertifikat Alle Infos und Fakten zum WLan Zertifikat Zertifikate werden verwendet, um eine rechnergestützte Kommunikation abzusichern. Dabei handelt es sich bei einem WLan Zertifikat um strukturierte Daten, die Personen, Objekte und deren Eigenschaften bestätigen sowie deren Vertraulichkeit, Integrität und Authentizität mithilfe von kryptografischen Verfahren überprüfen. Während WLan-Netzwerke im Privatbereich meist ohne Zertifikate auskommen, sind WLan-Netzwerke bei beispielsweise Unternehmen oder an Universitäten häufig so eingerichtet, dass die Autorisierung über Zertifikate, einen Benutzernamen und ein Passwort erfolgt.    Ganzen Artikel...

Anzeige

Was macht die KI von DeepSeek so besonders?