Deepseek, którego pełna nazwa to „Hangzhou Deepseek Artificial Intelligence Podstawowa technologia Research Co., Ltd.” (zwane dalej China Deepseek), został założony w lipcu 2023 r. Przez ilościowego giganta zarządzania aktywami Huanfang Ilości. Jego założyciel Liang Wenfeng ma głębokie doświadczenie i bogate doświadczenie w inwestycjach ilościowych i obliczeniach o wysokiej wydajności.
W grudniu 2024 r. Deepseek-V3 rozpoczęła ogromną falę w globalnym polu AI. Osiągnął wydajność porównywalną z najlepszymi modelami, takimi jak GPT-4O przy bardzo niskich kosztach szkolenia, szokując branżę.
Wraz z uruchomieniem nowego modelu Deepseek Deepseek-R1, 27 stycznia, aplikacja Deepseek znalazła się na szczycie bezpłatnych rankingów aplikacji Apple App Store w Chinach i Stanach Zjednoczonych, przewyższając Chatgpt w amerykańskich rankingach pobierania.
Deepseek to duży model językowy. Ma potężne możliwości przetwarzania języka naturalnego, podobnie jak inteligentny i wyrozumiały asystent, który potrafi zrozumieć i odpowiadać na pytania jak przyjaciel. W oparciu o algorytmy i obsługę danych, może również pomóc w pisaniu kodu, uporządkowaniu danych, a nawet rozwiązaniu złożonych problemów matematycznych.
Jeśli chodzi o podobne duże modele, pierwszym wrażeniem wszystkich jest Chatgpt opracowany przez Openai. Po wydaniu O1-Preview przez Openai we wrześniu 2024 r. Minęło mniej niż cztery miesiące, a modele wnioskowania, które są porównywalne lub nawet przekraczają jego wyniki, kwitły na rynku.
Powodem, dla którego DeepSeek może wyróżniać się na tle wielu modeli, jest to, że nie tylko objął wiodącą rolę w osiągnięciu wyników porównywalnych z modelem Openai-O1, ale także skompresował koszt modelu wnioskowania na wyjątkowo niski poziom.
W dniu otwarcia Światowego Forum Ekonomicznego 2025 w tym miesiącu Chin Deepseek opublikował swój najnowszy model Open Source R1, który po raz kolejny przyciągnął globalną uwagę w dziedzinie sztucznej inteligencji.
Deepseek -R1 osiągnął ważny przełom technologiczny - wykorzystując czyste metody głębokiego uczenia się, aby umożliwić spontaniczne pojawienie się sztucznej inteligencji z możliwościami rozumowania. W zadaniach takich jak matematyka, kod i rozumowanie języka naturalnego jego wydajność jest porównywalna z oficjalną wersją modelu Openai-O1. Model kontynuuje również wysoką opłacalność firmy.
Rozumie się, że koszt szkolenia modelu Deepseek-R1 wynosi zaledwie 5,6 miliona USD, znacznie niższy niż setki milionów, a nawet miliardy dolarów zainwestowanych w technologię sztucznej inteligencji przez amerykańskich gigantów technologii, takich jak US Open Artificial Intelligence Research Center, Google i „Meta”.
Jeśli chodzi o cenę, założyciel Liang Wenfeng powiedział kiedyś w wywiadzie dla mediów, że zarówno API, jak i AI powinny być uniwersalne i niedrogie dla wszystkich.
Ponadto warto zauważyć, że Deepseek przyjmuje całkowicie open source strategię.
Pierwotnym zamiarem Openai było „rozwój cyfrowej inteligencji w sposób, który najprawdopodobniej przyniesie korzyść całej ludzkości, bez ograniczenia potrzebą generowania zwrotów finansowych”. Jednak po wydaniu GPT-3, Openai ograniczył dostęp do modelu, a po wydaniu GPT-4 ukrył nawet dane treningowe i masy modelu, całkowicie zmierzając w kierunku „źródła zamkniętego”.
W pełni strategia Deepseek w pełni open source nie tylko obniża próg dla użytkowników, ale także promuje ekologię współpracy społeczności programistów AI. Dzięki open source Deepseek zwrócił uwagę dużej liczby programistów i badaczy, którzy mogą swobodnie uzyskać i modyfikować kody modelowe na platformie, aby wspólnie promować rozwój technologii AI.
Jimfan, starszy naukowiec z Nvidia, powiedział na swojej osobistej platformie społecznościowej: „Jesteśmy w tak historycznym momencie: firma spoza USA kontynuuje oryginalną misję Openai-wzmacnia całą ludzkość poprzez naprawdę otwarte najnowsze badania”.

