DeepSeek (тыл моделя)
DeepSeek — Кытай оҥоһук өй лабораториятын оҥорбут аһаҕас ис хоһоонноох тыл моделларын дьиэ кэргэнэ.
Чат-боттаах улахан тыл моделын кэлиҥҥи барыллара — DeepSeek-V3 уонна логическай сорудахтары быһаарарга аналлаах «толкуйдуур» DeepSeek-R1 — айылҕа тылын оҥорууга, математическай сорудахтарга уонна программалааһыҥҥа конкуреннар оҥоһууларыгар холоотоххо тэҥ эбэтэр ордук үчүгэй көрдөрүүлэри көрдөрөллөр (GPT-4o эбэтэр Open AI-o1, ону тэҥэ арҕаа хампаанньалар атын моделлара)[1][2][3][4].
Ону кытта, DeepSeek этэринэн, кинилэр моделлара үөрэтиигэ уонна көрүүгэ-истиигэ аҕыйах ресурсаны эрэйэллэр, уонна Арассыыйа уонна аан дойду атын дойдуларын туһанааччыларыгар киириини хааччахтаабаттар[2][5]. Ону таһынан, моделлары туһаныы сыаната арҕаа дойду конкуреннарыттан ортотунан 96 % кыра[6][7].
2025 сыл тохсунньу 20 күнүгэр DeepSeek-R1 моделы таһаарыы АХШ технологическай хампаанньаларын ырыынак сыанатын улаханнык түһэрбитэ (оҥоһук өй эйгэтигэр үлэлиир уонна ааҕар-суоттуур тэриллэри оҥорооччулар), ону тэҥэ арҕаа ИИ-гэ элбэх миллиард дуоллардаах инвестициялар сөптөөхтөрүн туһунан кэпсэтиини таһаарбыта[8][9].
Сайдыы устуоруйата
2015 сыллаахха DeepSeek Кытай миллиардера уонна ИИ энтузиаһа Лян Вэньфан тэрийбит High-Flyer хедж-фондатын ИИ салаатыттан тутулуга суох стартап буолбута. 2024 сыл от ыйыгар кини аныгы генеративнай моделлар кыамталарын туһунан кэпсээбитэ, уонна саҥа хампаанньа сыалын-соругун искусственнай уопсай интеллекты (AGI) ситиһии диэн ыйбыта[10]. 2024 сыл сэтинньитигэр хампаанньа генеральнай дириэктэрэ аһаҕас ис хоһоонноох бородууксуйаны оҥорор идеяҕа бэриниилээх буоларын уонна DeepSeek төлөбүрдээх өҥөлөрүн салгыы кэҥэтии былаана суоҕун хатылыыр[11].
DeepSeek бородууксуйатын тарҕатыы усулуобуйата
Арҕаа дойду сүрүн ИИ хампаанньаларыттан (OpenAI, Meta эбэтэр Anthropic) уратыта диэн, DeepSeek тыл моделлара саҕаланыытыттан босхо MIT лицензиятынан тарҕаммыттара. 2025 сыл тохсунньутугар DeepSeek V3 уонна DeepSeek R-1 ситиһиилэрин туһунан кэпсээн туран, Meta сүрүн ИИ учуонайа Янн ЛеКун эппитинэн, «ИИ эйгэтигэр аһаҕас ис хоһоонноох моделлар туспа быһаарыылартан ордуктарын дакаастаатылар»[12].
Релизтар
2023 сыл сэтинньититтэн DeepSeek 3 көлүөнэ улахан тыл моделларын көрдөрбүтэ.
DeepSeek Coder и DeepSeek LLM
DeepSeek Coder бастакы нейроннай ситимэ 2023 сыл сэтинньи 2 күнүгэр көрдөрөллүбүтэ; Ол ый 29 күнүгэр 67 млрд параметрдаах бастакы универсальнай улахан тыл модела DeepSeek LLM тахсыбыта, ол кэмҥэ LLama 2 кыаҕын аһарбыта уонна GPT-4 чугаһаабыта[13], ол гынан баран сорох даннайдарынан масштаб уонна ааҕыы көдьүһүгэр кыһалҕалаах этэ[13]. Ону кытта тэҥҥэ, DeepSeek LLM-ҥа олоҕурбут өйдөөх чат-бот аан бастаан тахсыбыта.
DeepSeek-V2
2024 сыл ыам ыйыгар DeepSeek тыл моделыгар иккис барылын түөрт көрүҥүнэн таһаарбыта: стандартнай (V2), кыччаабыт (V2-Lite), ону тэҥэ стандартнай чат-бот (V2-Chat) уонна кини кыччаабыт барыла (V2-Chat-Lite).
Урукку моделларга параметрдар ахсааннара 236 млрд диэри улаатта; эрдэттэн үөрэтии 8,1 триллион токеҥҥа ыытыллыбыта, уонна улахан контекст уһуна 128 тыһыынча токеҥҥа диэри улааппыта.
Модель бастакы барылын кытта тэҥнээтэххэ улахан архитектурнай уларыйыылары ааспыта: Multi-head Learning Attention (MLA) ньыматыгар олоҕурбут инновационнай массыынанан үөрэтии ньыматын туһанар[14], бу модель үөрэтии ороскуотун уонна бириэмэтин элбэх төгүл кыччатыыга кыах биэрбитэ[14][15]. Ону таһынан, хампаанньа моделга уларыйбыт Mixture of Experts (MoE, ааҥыл тылыттан «экспертар булкаастаара») принцибин оҥорбута уонна олоххо киллэрбитэ: бу ньыманан модель элбэх ахсааннаах хос ситимнэртэн турар, хас биирдиилэрэ туспа анал билии эйгэтигэр эппиэттиир уонна наада буоллаҕына эрэ эппиэти көрдөөһүҥҥэ ситимнээх[16][17].
MLA уонна MoE холбоһуктара мөлүйүөн токены оҥоруу сыанатын 2 юаньга туруорбуттара, оттон ChatGPT итиччэ информация кээмэйигэр 2,5 дуоллар сыаналаах этэ[18]. Ону кытта DeepSeek-V2 күрэстэһиилээх көрдөрүүлэрин көрдөрбүтэ: Ватерлоо университетын ИИ-лабораторията кинини бастыҥ улахан тыллаах моделлар рейтиннэригэр 7-с миэстэҕэ туруорбута[19].
DeepSeek-V3
2024 сыл ахсынньытыгар модель үһүс көлүөнэтэ икки көрүҥүнэн уопсастыбаннай бас билиигэ тахсыбыта: стандартнай (V3-Base) уонна чат-бот (V3). DeepSeek-V2 бэрэбиэркэлэммит архитектураҕа олоҕурбут нейроннай ситим тиэкистэри ырытар уонна кэпсиир, сүрүн пууннары бэлиэтиир, тылбаастары оҥорор[2], ону тэҥэ OpenAI, Meta эбэтэр Anthropic саамай сайдыылаах моделларын кытта биир таһымҥа математическай сорудахтары быһаарар уонна бырагыраамалары суруйар кыахтаах: ол курдук DeepSeek-V3 Llama 3.1 Qwen 2.5 тестарга куоһарар[1] уонна GPT-4o уонна Claude 3.5 Sonnet таһымнарыгар сөп түбэһэр[2][3].
DeepSeek-R1
2025 сыл тохсунньу 20 күнүгэр DeepSeek Open AI-o1 флагман таһымыгар AIME уонна MATH математика тестарыгар көрдөрүүлээх логическай уонна математическай сорудахтары быһаарарга DeepSeek R1 толкуйдуур моделын таһаарбыта[4]. Бу модель уратыта диэн киһи толкуйдуур ньыматын хатылыыр эппиэттэри оҥоруу буолар[20][21][22]. Ону оҥорорго, хампаанньа үөрэтиигэ наҕараадалары моделлыырга саҥа, ордук табыгастаах ньыманы туһаммыта[23].
2025 сыл тохсунньутугар ырыынак түһүүтэ
Үөрэтиигэ уонна туһаныыга элбэх төгүл аҕыйах күүһү көрдүүр модель үөскээһинэ 2025 сыл тохсунньутугар 28 күнүгэр технологическай хампаанньалар котировкаларын сыаналарын түһүүтүгэр тириэрдибитэ. Ол курдук, аан дойдуга нейроннай ситимнэри үөрэтэр тэриллэри оҥорор сүрүн хааччыйааччы Nvidia 600 млрд дуоллартан тахса, ол эбэтэр капитализациятын 18%-нын сүтэрбитэ, бу пуонда ырыынак устуоруйатыгар саамай улахан сууллуу буолбута[24].
Технологияны уорууга буруйдааһын
Тохсунньу 29 күнүгэр Microsoft уонна кини OpenAI-а DeepSeek утары силиэстийэни саҕалаабыттара биллибитэ. Хампаанньалар Кытай стартапа бэйэтин моделларын OpenAI нейроннай ситимнэринэн оҥоһуллубут даннайдарга көҥүлэ суох үөрэппит диэн этэллэр[25]. Америка корпорациятын этэринэн, DeepSeek туспа оҥоһук буолбатах, ол оннугар OpenAI оҥорбут уонна патеннаабыт моделларын ыраастыыр ньыманан оҥоһуллубут[26].
Кириитикэ
Claude AI тыл моделларын улахан сериятын оҥорор Anthropic хампаанньа тэрийээччитэ Дарио Амодей Кытай разработчиктара чаҕылхай түмүктэри ситиспэккэ, улахан этиини оҥорбуттар дии саныыр. Амодей этэринэн, DeepSeek 7-10 ый анараа өттүгэр баар Америка моделларыгар чугас моделы оҥорбут, онно аҕыйах харчыны ороскуоттаабыт, ол гынан баран ороскуоту кыччатыы тренд буолбут чэрчитигэр. Амодей бэлиэтээбитинэн, DeepSeek үчүгэй түмүктэри көрдөрдө, ол гынан баран, ороскуоту кыччатыы үгэс буолбут треҥҥа сөп түбэһэр, оттон DeepSeek уопсай ороскуота Америка ИИ-лабораторияларыгар тэҥнэһэр. Ону таһынан, DeepSeek-V3 улаханнык тарҕаммыт DeepSeek-R1-тан ордук инновационнай[27].