DeepSeek (тыл моделя)

DeepSeek — Кытай оҥоһук өй лабораториятын оҥорбут аһаҕас ис хоһоонноох тыл моделларын дьиэ кэргэнэ.

Чат-боттаах улахан тыл моделын кэлиҥҥи барыллара — DeepSeek-V3 уонна логическай сорудахтары быһаарарга аналлаах «толкуйдуур» DeepSeek-R1 — айылҕа тылын оҥорууга, математическай сорудахтарга уонна программалааһыҥҥа конкуреннар оҥоһууларыгар холоотоххо тэҥ эбэтэр ордук үчүгэй көрдөрүүлэри көрдөрөллөр (GPT-4o эбэтэр Open AI-o1, ону тэҥэ арҕаа хампаанньалар атын моделлара)[1][2][3][4].

Ону кытта, DeepSeek этэринэн, кинилэр моделлара үөрэтиигэ уонна көрүүгэ-истиигэ аҕыйах ресурсаны эрэйэллэр, уонна Арассыыйа уонна аан дойду атын дойдуларын туһанааччыларыгар киириини хааччахтаабаттар[2][5]. Ону таһынан, моделлары туһаныы сыаната арҕаа дойду конкуреннарыттан ортотунан 96 % кыра[6][7].

2025 сыл тохсунньу 20 күнүгэр DeepSeek-R1 моделы таһаарыы АХШ технологическай хампаанньаларын ырыынак сыанатын улаханнык түһэрбитэ (оҥоһук өй эйгэтигэр үлэлиир уонна ааҕар-суоттуур тэриллэри оҥорооччулар), ону тэҥэ арҕаа ИИ-гэ элбэх миллиард дуоллардаах инвестициялар сөптөөхтөрүн туһунан кэпсэтиини таһаарбыта[8][9].

Сайдыы устуоруйата

2015 сыллаахха DeepSeek Кытай миллиардера уонна ИИ энтузиаһа Лян Вэньфан тэрийбит High-Flyer хедж-фондатын ИИ салаатыттан тутулуга суох стартап буолбута. 2024 сыл от ыйыгар кини аныгы генеративнай моделлар кыамталарын туһунан кэпсээбитэ, уонна саҥа хампаанньа сыалын-соругун искусственнай уопсай интеллекты (AGI) ситиһии диэн ыйбыта[10]. 2024 сыл сэтинньитигэр хампаанньа генеральнай дириэктэрэ аһаҕас ис хоһоонноох бородууксуйаны оҥорор идеяҕа бэриниилээх буоларын уонна DeepSeek төлөбүрдээх өҥөлөрүн салгыы кэҥэтии былаана суоҕун хатылыыр[11].

DeepSeek бородууксуйатын тарҕатыы усулуобуйата

Арҕаа дойду сүрүн ИИ хампаанньаларыттан (OpenAI, Meta эбэтэр Anthropic) уратыта диэн, DeepSeek тыл моделлара саҕаланыытыттан босхо MIT лицензиятынан тарҕаммыттара. 2025 сыл тохсунньутугар DeepSeek V3 уонна DeepSeek R-1 ситиһиилэрин туһунан кэпсээн туран, Meta сүрүн ИИ учуонайа Янн ЛеКун эппитинэн, «ИИ эйгэтигэр аһаҕас ис хоһоонноох моделлар туспа быһаарыылартан ордуктарын дакаастаатылар»[12].

Релизтар

2023 сыл сэтинньититтэн DeepSeek 3 көлүөнэ улахан тыл моделларын көрдөрбүтэ.

DeepSeek Coder и DeepSeek LLM

DeepSeek Coder бастакы нейроннай ситимэ 2023 сыл сэтинньи 2 күнүгэр көрдөрөллүбүтэ; Ол ый 29 күнүгэр 67 млрд параметрдаах бастакы универсальнай улахан тыл модела DeepSeek LLM тахсыбыта, ол кэмҥэ LLama 2 кыаҕын аһарбыта уонна GPT-4 чугаһаабыта[13], ол гынан баран сорох даннайдарынан масштаб уонна ааҕыы көдьүһүгэр кыһалҕалаах этэ[13]. Ону кытта тэҥҥэ, DeepSeek LLM-ҥа олоҕурбут өйдөөх чат-бот аан бастаан тахсыбыта.

DeepSeek-V2

2024 сыл ыам ыйыгар DeepSeek тыл моделыгар иккис барылын түөрт көрүҥүнэн таһаарбыта: стандартнай (V2), кыччаабыт (V2-Lite), ону тэҥэ стандартнай чат-бот (V2-Chat) уонна кини кыччаабыт барыла (V2-Chat-Lite).

Урукку моделларга параметрдар ахсааннара 236 млрд диэри улаатта; эрдэттэн үөрэтии 8,1 триллион токеҥҥа ыытыллыбыта, уонна улахан контекст уһуна 128 тыһыынча токеҥҥа диэри улааппыта.

Модель бастакы барылын кытта тэҥнээтэххэ улахан архитектурнай уларыйыылары ааспыта: Multi-head Learning Attention (MLA) ньыматыгар олоҕурбут инновационнай массыынанан үөрэтии ньыматын туһанар[14], бу модель үөрэтии ороскуотун уонна бириэмэтин элбэх төгүл кыччатыыга кыах биэрбитэ[14][15]. Ону таһынан, хампаанньа моделга уларыйбыт Mixture of Experts (MoE, ааҥыл тылыттан «экспертар булкаастаара») принцибин оҥорбута уонна олоххо киллэрбитэ: бу ньыманан модель элбэх ахсааннаах хос ситимнэртэн турар, хас биирдиилэрэ туспа анал билии эйгэтигэр эппиэттиир уонна наада буоллаҕына эрэ эппиэти көрдөөһүҥҥэ ситимнээх[16][17].

MLA уонна MoE холбоһуктара мөлүйүөн токены оҥоруу сыанатын 2 юаньга туруорбуттара, оттон ChatGPT итиччэ информация кээмэйигэр 2,5 дуоллар сыаналаах этэ[18]. Ону кытта DeepSeek-V2 күрэстэһиилээх көрдөрүүлэрин көрдөрбүтэ: Ватерлоо университетын ИИ-лабораторията кинини бастыҥ улахан тыллаах моделлар рейтиннэригэр 7-с миэстэҕэ туруорбута[19].

DeepSeek-V3

2024 сыл ахсынньытыгар модель үһүс көлүөнэтэ икки көрүҥүнэн уопсастыбаннай бас билиигэ тахсыбыта: стандартнай (V3-Base) уонна чат-бот (V3). DeepSeek-V2 бэрэбиэркэлэммит архитектураҕа олоҕурбут нейроннай ситим тиэкистэри ырытар уонна кэпсиир, сүрүн пууннары бэлиэтиир, тылбаастары оҥорор[2], ону тэҥэ OpenAI, Meta эбэтэр Anthropic саамай сайдыылаах моделларын кытта биир таһымҥа математическай сорудахтары быһаарар уонна бырагыраамалары суруйар кыахтаах: ол курдук DeepSeek-V3 Llama 3.1 Qwen 2.5 тестарга куоһарар[1] уонна GPT-4o уонна Claude 3.5 Sonnet таһымнарыгар сөп түбэһэр[2][3].

undefined

DeepSeek-R1

2025 сыл тохсунньу 20 күнүгэр DeepSeek Open AI-o1 флагман таһымыгар AIME уонна MATH математика тестарыгар көрдөрүүлээх логическай уонна математическай сорудахтары быһаарарга DeepSeek R1 толкуйдуур моделын таһаарбыта[4]. Бу модель уратыта диэн киһи толкуйдуур ньыматын хатылыыр эппиэттэри оҥоруу буолар[20][21][22]. Ону оҥорорго, хампаанньа үөрэтиигэ наҕараадалары моделлыырга саҥа, ордук табыгастаах ньыманы туһаммыта[23].

2025 сыл тохсунньутугар ырыынак түһүүтэ

Үөрэтиигэ уонна туһаныыга элбэх төгүл аҕыйах күүһү көрдүүр модель үөскээһинэ 2025 сыл тохсунньутугар 28 күнүгэр технологическай хампаанньалар котировкаларын сыаналарын түһүүтүгэр тириэрдибитэ. Ол курдук, аан дойдуга нейроннай ситимнэри үөрэтэр тэриллэри оҥорор сүрүн хааччыйааччы Nvidia 600 млрд дуоллартан тахса, ол эбэтэр капитализациятын 18%-нын сүтэрбитэ, бу пуонда ырыынак устуоруйатыгар саамай улахан сууллуу буолбута[24].

Технологияны уорууга буруйдааһын

Тохсунньу 29 күнүгэр Microsoft уонна кини OpenAI-а DeepSeek утары силиэстийэни саҕалаабыттара биллибитэ. Хампаанньалар Кытай стартапа бэйэтин моделларын OpenAI нейроннай ситимнэринэн оҥоһуллубут даннайдарга көҥүлэ суох үөрэппит диэн этэллэр[25]. Америка корпорациятын этэринэн, DeepSeek туспа оҥоһук буолбатах, ол оннугар OpenAI оҥорбут уонна патеннаабыт моделларын ыраастыыр ньыманан оҥоһуллубут[26].

Кириитикэ

Claude AI тыл моделларын улахан сериятын оҥорор Anthropic хампаанньа тэрийээччитэ Дарио Амодей Кытай разработчиктара чаҕылхай түмүктэри ситиспэккэ, улахан этиини оҥорбуттар дии саныыр. Амодей этэринэн, DeepSeek 7-10 ый анараа өттүгэр баар Америка моделларыгар чугас моделы оҥорбут, онно аҕыйах харчыны ороскуоттаабыт, ол гынан баран ороскуоту кыччатыы тренд буолбут чэрчитигэр. Амодей бэлиэтээбитинэн, DeepSeek үчүгэй түмүктэри көрдөрдө, ол гынан баран, ороскуоту кыччатыы үгэс буолбут треҥҥа сөп түбэһэр, оттон DeepSeek уопсай ороскуота Америка ИИ-лабораторияларыгар тэҥнэһэр. Ону таһынан, DeepSeek-V3 улаханнык тарҕаммыт DeepSeek-R1-тан ордук инновационнай[27].

Быһаарыылар

  1. 1 2 Sharma, Shubham. DeepSeek-V3, ultra-large open-source AI, outperforms Llama and Qwen on launch, VentureBeat (26 Ахсынньы 2024). Сигэнии күнэ: 29 Тохсунньу 2025.
  2. 1 2 3 4 Нейросеть DeepSeek: что это, возможности, как пользоваться | РБК Тренды, РБК Тренды. Сигэнии күнэ: 28 Тохсунньу 2025.
  3. 1 2 DeepSeek-V3: Китайская языковая модель превзошла Claude 3.5 Sonnet в работе с кодом, Хабр. Сигэнии күнэ: 28 Тохсунньу 2025.
  4. 1 2 DataSecrets. Разбираемся, как устроена R1 – новая бесплатная ризонинг модель ИИ из Китая, работающая на уровне o1 от OpenAI. Habr.ru (21 Тохсунньу 2025).
  5. Разбираемся, как устроена R1 – новая бесплатная ризонинг модель ИИ из Китая, работающая на уровне o1 от OpenAI, Хабр. Сигэнии күнэ: 28 Тохсунньу 2025.
  6. DeepSeek R1: модель с производительностью o1 от OpenAI. Сравнение с o1, сколько стоит и как использовать API, Хабр. Сигэнии күнэ: 28 Тохсунньу 2025.
  7. Запад шокирован китайским интеллектом, Коммерсантъ (27 Тохсунньу 2025). Сигэнии күнэ: 28 Тохсунньу 2025.
  8. «DeepSeek – это победа над сегрегацией человечества»: как китайцы хакнули ИИ-рынок(биллибэт). БИЗНЕС Online. Сигэнии күнэ: 28 Тохсунньу 2025.
  9. Китайская угроза, Коммерсантъ (27 Тохсунньу 2025). Сигэнии күнэ: 28 Тохсунньу 2025.
  10. 暗涌. 揭秘DeepSeek:一个更极致的中国技术理想主义故事, 微信公众平台. Сигэнии күнэ: 30 Тохсунньу 2025.
  11. Schneider, Jordan. Deepseek: The Quiet Giant Leading China’s AI Race. Сигэнии күнэ: 29 Тохсунньу 2025.
  12. Meta's chief AI scientist says DeepSeek's success shows that 'open source models are surpassing proprietary ones', Yahoo Tech. Сигэнии күнэ: 28 Тохсунньу 2025.
  13. 1 2 Ksenia Se, Alyona Vert. Topic 10: Inside DeepSeek Models. Turing Post (28 Атырдьах ыйын 2024).
  14. 1 2 DeepSeek — очередной квантовый скачок в развитии AI, Хабр. Сигэнии күнэ: 28 Тохсунньу 2025.
  15. Dai, Damai, Deng, Chengqi, Zhao, Chenggang, Xu, R. X., Gao, Huazuo, Chen, Deli, Li, Jiashi, Zeng, Wangding, Yu, Xingkai, Wu, Y., Xie, Zhenda, Li, Y. K., Huang, Panpan, Luo, Fuli, Ruan, Chong, Sui, Zhifang, Liang, Wenfeng. DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models(ааҥл.) // arXiv.org. — 2024-01-11.
  16. Dai, Damai, Deng, Chengqi, Zhao, Chenggang, Xu, R. X., Gao, Huazuo, Chen, Deli, Li, Jiashi, Zeng, Wangding, Yu, Xingkai, Wu, Y., Xie, Zhenda, Li, Y. K., Huang, Panpan, Luo, Fuli, Ruan, Chong, Sui, Zhifang, Liang, Wenfeng. DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models(ааҥл.) // arXiv.org. — 2024-01-11.
  17. Большие языковые модели в 2024 году: полное сравнение (рус.). www.gptunnel.com. Сигэнии күнэ: 29 Тохсунньу 2025.
  18. DeepSeek вызвал истерику у Американских ИИ корпораций, Хабр. Сигэнии күнэ: 28 Тохсунньу 2025.
  19. The Chinese quant fund-turned-AI pioneer, Financial Times (9 June 2024). Архыыптаммыт 2024, От ыйын 17 күнүгэр. Сигэнии күнэ: 28 Ахсынньы 2024.
  20. Elizabeth Gibney. China’s cheap, open AI model DeepSeek thrills scientists(ааҥл.) // Nature. — 2025-01-23. — ISSN 1476-4687. — DOI:10.1038/d41586-025-00229-6.
  21. Chowdhury, Hasan KI aus China: Überholt dieses Startup jetzt OpenAI? (нем.). Business Insider (25 Тохсунньу 2025).
  22. Sharma, Shubham Open-source DeepSeek-R1 uses pure reinforcement learning to match OpenAI o1 — at 95% less cost (амер. англ.). VentureBeat (20 Тохсунньу 2025).
  23. Moris. DeepSeek, по сути взломал один из святых Граалей ИИ. Smart-Lab (27 Тохсунньу 2025).
  24. ИИ-пузырь лопнул: стоимость Nvidia рухнула на $600 млрд за сутки из-за китайского стартапа DeepSeek, 3DNews - Daily Digital Digest. Сигэнии күнэ: 29 Тохсунньу 2025.
  25. Microsoft и OpenAI расследуют, обучался ли DeepSeek на украденных данных американских компаний в сфере ИИ, Хабр. Сигэнии күнэ: 29 Тохсунньу 2025.
  26. BFM.ru. DeepSeek заподозрили в краже технологий OpenAI, BFM.ru - деловой портал. Сигэнии күнэ: 29 Тохсунньу 2025.
  27. Dario Amodei. Dario Amodei — On DeepSeek and Export Controls (англ.). darioamodei.com. Сигэнии күнэ: 30 Тохсунньу 2025.

Категориялар