DeepSeek (кыл модель)

Википедиысь материал
DeepSeek
Программалэн тодметпусэз DeepSeek
Скриншот программы DeepSeek
Типез бадӟым кыл модель
Кылдытӥсез DeepSeek
Интерфейслэн кылъёсыз трос кылъем, соос пӧлын ӟуч но
Нырысьсэ потӥз

2 шуркынмон, 2023 (DeepSeek Coder)

29 шуркынмон, 2023 (DeepSeek LLM)
Берпуметӥ версиез (толшор, 2025)
Ужамез ужа
Лицензиез усьтэм
Вотэсбам deepseek.com

DeepSeek — кыл модельёслэн усьтэм кодэн семьязы, кудзэ кылдытӥз Китайысь искусственной интеллектъя DeepSeek нимо лаборатория. Кыл модельлэн чат-ботэн ӵыж-выль версиосыз — DeepSeek-V3 но логической ужпумъёсты сэрттон-пертчон бордын «малпаськись» DeepSeek-R1 — GPT- 4o, Open AI-o1 яке шундыпуксён компаниослэн мукет программаосынызы ӵошатыса, кылъёс бордын ужамзыя, математикая но программирования ужпумъёсты сэрттэмзыя огкадь яке умойгес ужазинсконъёс возьмато[1][2][3][4].

Со дыре ик, DeepSeek ивортэмъя, соослэн модельёссылы дышетскон но азинскон понна ӧжытгес ресурсъёс кулэ, озьы ик соос Россиысь но дуннеысь мукет кунъёсысь юзчиослы усьтэмын[2][5]. Со сяна, модельёсты кутонлэн дуныз шорлыдын 96 процентлы ичигес, шундыпуксён конкурентъёсынызы ӵошатыса[6][7].

2025-тӥ арын 20-тӥ толшоре DeepSeek-R1 модель потэм бере США-ысь технологиосъя компаниослэн (искусственной интеллект удысын ужасьёслэн но, вычислительной тӥрлык поттӥсьёслэн но) рынокын дунъёссы чутрак усизы, соку ик вераськонъёс потӥзы искуственной интеллектъя шундыпуксён инфраструктурае трос миллиард долларъем инвестициослэн кулэлыксы сярысь, оборудованилы вылӥ куронъёс но соослэн ӝутэм дунъёссы пумысен[8][9].

Историез

DeepSeek китай High-Flyer хедж-фондлэн искусственной интеллектъя (ИИ) ӧрысьтыз нимысьтыз стартаплы пӧрмытэмын вал. 2024-тӥ арын пӧсьтолэзе хедж-фондэз кылдытӥсь миллиардер Лян Вэньфан компанилэсь ужпумзэ пусйиз — огъя искусственной интеллектэз (AGI) кылдытон[10]. 2024-тӥ арын шуркынмонэ компанилэн кивалтӥсез эшшо огпол вераз усьтэм исходной кодэн продуктъёс кылдытон сярысь но DeepSeek-лэн услугаоссэ дунын паськытатонъя планъёсыз ӧвӧл шуыса[11].

DeepSeek продуктъёсыз вӧлмытон условиос

ИИ шундыпуксён компаниосын (OpenAI, Meta яке Anthropic) ӵошатыса, вань DeepSeek кыл модельёс кутсконысеныз ик дунтэк MIT лицензия улсын вӧлмизы. 2025-тӥ арын толшоре Meta-лэн искусственной интеллектъя валтӥсь ужасез Ян Лекун, DeepSeek V3-лэн но DeepSeek R-1-лэн вормонъёсыз сярысь вераськыку, ивортӥз, «ИИ удысын усьтэм исходной кодъёсын модельёс, эрико луиськтэм решениоын ӵошатыса, асьсэ вылӥлыксэс возьматӥзы»[12].

Релизъёс

2023-тӥ арын шуркынмонысен кутскыса, DeepSeek 3 бадӟым кыл модельёсын тодматӥз.

DeepSeek Coder но DeepSeek LLM

DeepSeek Coder-лэн нырысетӥ нейросетез 2023-тӥ арын 2-тӥ шуркынмонэ возьматэмын вал; со толэзе ик 29-тӥ числое DeepSeek LLM бадӟым универсальной кыл модель 67 миллиард параметръёсын поттэмын вал, со вакытэ со LLama 2-лэсь быгатонлыкъёссэ ортчиз но GPT-4-лы матэктӥз, но, куд-ог ивортонъёсъя, масштабируемостез но лыдъян быгатонлыкъёсыз лябесьгес вал[13]. Соку ик нырысьсэ поттэмын вал DeepSeek LLM вылэ пыкиськыса лэсьтэм визьмо чат-бот.

Оглом нырысетӥ модельлэн 8 вариантэз кылдытэмын вал: ньылез стандартной, азьвыл дышетэм (Base) но ньылез инструкциослэн наборенызы тупатэм (Instruct). Ваньзы соос «саклык» механизмен трансформатор архитектура вылэ пыкиськизы, со механизм Llama модельёслэн выллем ик.

  • Азьвыл дышетон ортчытэмын вал 1,8 триллион токенъёс вылын (даннойёс сярысь тодосын 1 миллион токенэ ог 750 сюрс кылъёсты пырто)[14].
  • Long-context pretraining (англи кылысь LCP — кузь контекстэн ужан амалъёсын азьвыл дышетон) 200 миллиард токенъёс вылын ортчытэмын вал, со луонлык сётиз сетьын обрабатывать карем контекстлэсь тужгес бадӟым кузьдалазэ 4-ысен 16 сюрс токенозь будэтыны.
  • Instruct модельёсты тупатъян ортчытэмын вал 2 миллиард токенъем инструкциосъя наборъёс вылэ пыкиськыса[15].

DeepSeek-V2

2024-тӥ арын куартолэзе DeepSeek кыл модельлэсь кыкетӥ версизэ ньыль вариантъёсын поттӥз: стандартной (V2), пичиятэм (V2-Lite), озьы ик стандартной чат-бот (V2-Chat) но солэн пичиятэм версиез (V2-Chat-Lite) .

Вуж модельёсысь параметръёслэн лыдзы 236 миллиардозь будӥз; азьвыл дышетон 8,1 триллион токенъёс вылын ортчытэмын вал, нош контекстлэн тужгес бадӟым кузьдалаез 128 сюрс токенозь будӥз.

Нырысетӥ версиен ӵошатыса, модель бадӟым архитектурной воштӥськонъёс пыр ортчиз: со кутэ Multi-head Learning Attention (англи кылысь MLA — трос пумо саклыкен дышетон)[16] машинаен дышетон выль амалэз, кудӥз модельлэсь дунзэ но дышетон дырзэ трос поллы кулэстӥзы[16][17]. Со сяна, компания кылдытӥз но пыӵатӥз моделе выльдэм Mixture of Experts (англи кылысь MoE — экспертъёслэн суретсы) принципез: та амалъя модель трос подсетьёслэсь кылдэ, котькудӥз соос пӧлысь аслаз тодон-валан удысэз понна кылкутэ но кулэ дыръя гинэ валэктон утча[18][19].

MLA-ез но MoE-ез ӵошен кутон миллион токенъёсты обработкаез 2 юань тыр дунъяны луонлык сётиз, нош ChatGPT-лэн сомында ик информация понна дуныз 2,5 доллар вал[20]. Со дыре ик DeepSeek-V2 возьматӥз вожвылъяськоны быгатэмзэ: Ватерлоо университетысь ИИ-лаборатория тужгес усто бадӟым кыл модельёсъя рейтингын сое 7-тӥ интые пуктӥз[21].

DeepSeek-V3

2024-тӥ арын толсуре модельлэн куинетӥ вариантэз кык версиен поттэмын вал: стандартной (V3-Base) но чат-бот (V3), отчы 671 миллиард параметръёс пыртэмын но 14,8 триллион токенъёс вылын дышетскон ортчытэмын вал. DeepSeek-V2 эскерем архитектура вылын кылдытэм нейросеть быгатэ текстъёслэсь анализзэс лэсьтыны но инъетсэ мукет кылъёсын вераны, валтӥсь малпанъёссэ пусйыса, озьы ик берыктонъёс лэсьтыны, математикая ужпумъёсты сэрттыны-пертчыны но OpenAI, Meta яке Anthropic-лэн, азьмынӥсь модельёссы сямен ик, программаос гожъяны[22]. Соин DeepSeek-V3 тестъёсын Llama 3.1 Qwen 2.5-ез[23] ортче но GPT-4o но Claude 3.5 Sonnet-эн одӥг радын сылэ[22][24].

DeepSeek-V3-ез мукет бадӟым кыл модельёсын ӵошатон

DeepSeek-лэн дунтэк приложениез — «DeepSeek — AI Assistant» чат-бот —2025-тӥ арын толшор пумын дуннеысь тужгес трос скачать карем приложение луиз, озьы ик тужгес вылӥ дунъет басьтэм дунтэк приложениос пӧлын США-ысь ChatGPT-ез ортчиз[25]. Со сяна, DeepSeek санкциосъя политикалы уг дурбасьты но аслаз моделяз пыронэз нокинлы уг ворса, дуннеысь вань кунъёсысь, соос пӧлын Россия но, юзчиослы огкадь луонлыкъёс сётыса[26].

DeepSeek-V3 чат-ботлэн веб-интерфейсэз. Сервис Россиын но ужа, сое ӟуч кылын кутыны луэ.

Со дыре ик, моделез кылдытӥсьёслэн верамзыя, солэн дышетскон дырыз 55 нунал гинэ вал 2000 пала Nvidia видеокартаос вылын; озьыен, дышетонлэн дуныз 5,5 миллион доллар гинэ усиз, Llama-лэсь яке GPT-4o-лэсь трослы ӧжытгес[27][28].

Модельлэн аспӧртэмлыкъёсыз

Та ужазинлыкъёс DeepSeek архитектуралэн функциосызлы луыса басьтэмын вал:

  • Multi-token Prediction (MTP) амал предложенилэсь огдыре пӧртэм люкетъёссэ эскерыны но трос кылъёсты чакланы луонлык сётэ, со модельлэсь ӝоглыксэ но валэктонъёсызлэсь шонерлыксэс будэтэ.
  • Mixture of Experts (MoE) технология подсетьёсты кутэ, кудъёсыз нимысьтыз удысъёсъя юанъёслы шонер валэктон шедьтыны юртто. DeepSeek-V3-ын 256 сыӵе нейрон вотэсъёс кутӥсько, тямысэз соос пӧлысь ялан ужало, нош кылемъёсыз кыӵе ке ужпумез сэрттонэ-пертчонэ кулэ луэмзыя пырисько.
  • Саклыклэн настройкаосыз борды Multi-head Latent Attention (MLA) амалэз ватсам бере «значение-ключ» (KV-cache) параослэн сӧзнэтсылэн ужан быдӟалаез но ӝоглыкез пичияз[29].

DeepSeek-R1

2025-тӥ арын 20-тӥ толшоре DeepSeek тодматӥз DeepSeek R1 малпаськись моделеныз, со лэсьтэмын логической но математикая ужпумъёсты сэрттыны-пертчыны, AIME но MATH математика тестъёсын ужа[30]. Та модельлэн аспӧртэмлыкез — адями сямен малпаськыса, валэктонъёсыз тупен-тупен гожтон[31][32][33]. Сое кылдытыку, компания выль, кужмогес амалэз ужаз кутӥз[34].

2025-тӥ арын толшоре рынокъёслэн куашкамзы

DeepSeek-R1-эз мукет бадӟым кыл модельёслэн кужыменызы ӵошатон

Трос поллы дунтэмгес модельлэн кылдэмез 2025-тӥ арын 28-тӥ толшоре технологиосъя компаниослэсь акциоссылэсь дунъёссэс зол уськытӥз. Озьы нейрон сетьёсты дышетонъя тӥрлык поттӥсь Nvidia валтӥсь компания 600 миллиардлэсь трос доллар яке капитализациезлэсь ог 18 процентсэ ыштӥз, фондовой рыноклэн историяз со тужгес бадӟым куашкан луиз[35].

Бадӟым ыштонъёс адӟизы искусственной интеллектэн герӟаськем ваньмыз сямен компаниос: Аркадий Воложлэн Nebius-эз (-4 %), Broadcom (-17,3 %), AMD (-8 %), Palantir (-7 %), Microsoft (- 3 %) , озьы ик Constellation Energy (-21 %) но Vistra (-29 %) даннойёсъя центръёслы электрокужым сётӥсьёс. NASDAQ индекс 3,5 %-лы кулэсмиз, нош S&P — 1,8 %-лы. Оглом американ биржаос 1 триллионлэсь трос доллар ыштӥзы[35], нош криптовалютаослэн дунзы 7 %-лы кулэсмиз[36].

Технологиосты лушкамен сэрен янгыше уськытон

29-тӥ толшоре тодмо луиз, Microsoft но солэн OpenAI компаниез DeepSeek-лы пумит эскерон кутскизы шуыса. Компаниос верало, китай стартап аслэсьтыз модельёссэ OpenAI-лэн нейросетьёсызлэн даннойёссыя дышетӥз шуыса[37]. Америкаысь корпорацилэн ивортэмезъя, DeepSeek — со нимаз разработка ӧвӧл, со кылдӥз OpenAI-эн кылдытэм но патентовать карем модельёсты тупатъян пыр[38].

США-лэн санкциосыз — выльдӥськонлэн катализаторез

Тодмо, модельёсты дышетон понна DeepSeek 2021-тӥ арын басьтэм Nvidia A100 видеокартаосты уже кутӥз шуыса, соос басьтэмын вал США-лэн Китайлы пумит санкциос ялэмезлэсь азьло. Пӧртэм чакланъёсъя, DeepSeek стартаплэн 10 сюрс пала таӵе видеокартаосыз вань[39] (куд-ог шундыпуксён экспертъёс лыдъяло, компания 40 сюрс пала Nvidia H800 видеокартаос люказ шуыса[40][41]), со кӧня ке поллы ӧжытгес, OpenAI-эн яке Llama-ен ӵошатыса (та компаниослэн 300 сюрс пала видеокартаоссы)[42][43]. Озьыен, оло, ӵапак вычислительной кужым тырмымтэн DeepSeek выль архитектурной решениосты утчано луиз[44].

Дунъет

Дарио Амодей, Anthropic-лэн кылдытӥсез, кудӥз кыл модельёсызлэсь Claude AI бадӟым сериязэс кылдытэ, лыдъя, Китайысь разработчикъёс тросгес асьсэ сярысь шара веразы бадӟым результатъёс басьтэм сярысь. Амодей верамъя, DeepSeek 7-10 толэзь талэсь азьло американ модельёслы матын луись модель кылдытӥз, солы ӧжытгес уксё быдтыса. Со сяна, китай стартаплэн паськытэсь луонлыкъёсыз вал. Амодей пусйиз, DeepSeek умой результатъёс возьматӥз шуыса, но сое революция ниманы уг луы, малы ке шуоно дунъёсты кулэстон огшоры трендлы тупа, нош DeepSeek-лэн огъя ыштонъёсыз американ ИИ-лабораториослэн ыштонъёсынызы огвыллем луэ. Со сяна, DeepSeek-V3 DeepSeek-R1-лэсь туалагес[45].

Валэктонъёс

  1. Sharma, Shubham. DeepSeek-V3, ultra-large open-source AI, outperforms Llama and Qwen on launch, VentureBeat (26 толсуре 2024). Эскеремын: 29 толшоре 2025 арын.
  2. 1 2 Нейросеть DeepSeek: что это, возможности, как пользоваться | РБК Тренды, РБК Тренды. Эскеремын: 28 толшоре 2025 арын.
  3. DeepSeek-V3: Китайская языковая модель превзошла Claude 3.5 Sonnet в работе с кодом, Хабр. Эскеремын: 28 толшоре 2025 арын.
  4. DataSecrets Разбираемся, как устроена R1 – новая бесплатная ризонинг модель ИИ из Китая, работающая на уровне o1 от OpenAI
  5. Разбираемся, как устроена R1 – новая бесплатная ризонинг модель ИИ из Китая, работающая на уровне o1 от OpenAI, Хабр. Эскеремын: 28 толшоре 2025 арын.
  6. DeepSeek R1: модель с производительностью o1 от OpenAI. Сравнение с o1, сколько стоит и как использовать API, Хабр. Эскеремын: 28 толшоре 2025 арын.
  7. Запад шокирован китайским интеллектом, Коммерсантъ (27 толшоре 2025). Эскеремын: 28 толшоре 2025 арын.
  8. «DeepSeek – это победа над сегрегацией человечества»: как китайцы хакнули ИИ-рынок [рус.]
  9. Китайская угроза, Коммерсантъ (27 толшоре 2025). Эскеремын: 28 толшоре 2025 арын.
  10. 暗涌. 揭秘DeepSeek:一个更极致的中国技术理想主义故事, 微信公众平台. Эскеремын: 30 толшоре 2025 арын.
  11. Schneider, Jordan. Deepseek: The Quiet Giant Leading China’s AI Race. Эскеремын: 29 толшоре 2025 арын.
  12. Meta's chief AI scientist says DeepSeek's success shows that 'open source models are surpassing proprietary ones', Yahoo Tech. Эскеремын: 28 толшоре 2025 арын.
  13. Ksenia Se, Alyona Vert Topic 10: Inside DeepSeek Models
  14. Wiggers, Kyle. DeepSeek's new AI model appears to be one of the best 'open' challengers yet | TechCrunch, TechCrunch (26 толсуре 2024). Эскеремын: 29 толшоре 2025 арын.
  15. Guo, Daya, Zhu, Qihao, Yang, Dejian, Xie, Zhenda, Dong, Kai, Zhang, Wentao, Chen, Guanting, Bi, Xiao, Wu, Y., Li, Y. K., Luo, Fuli, Xiong, Yingfei, Liang, Wenfeng. DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence [англи] // arXiv.org. — 2024-01-25.
  16. 1 2 DeepSeek — очередной квантовый скачок в развитии AI, Хабр. Эскеремын: 28 толшоре 2025 арын.
  17. Dai, Damai, Deng, Chengqi, Zhao, Chenggang, Xu, R. X., Gao, Huazuo, Chen, Deli, Li, Jiashi, Zeng, Wangding, Yu, Xingkai, Wu, Y., Xie, Zhenda, Li, Y. K., Huang, Panpan, Luo, Fuli, Ruan, Chong, Sui, Zhifang, Liang, Wenfeng. DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models [англи] // arXiv.org. — 2024-01-11.
  18. Dai, Damai, Deng, Chengqi, Zhao, Chenggang, Xu, R. X., Gao, Huazuo, Chen, Deli, Li, Jiashi, Zeng, Wangding, Yu, Xingkai, Wu, Y., Xie, Zhenda, Li, Y. K., Huang, Panpan, Luo, Fuli, Ruan, Chong, Sui, Zhifang, Liang, Wenfeng. DeepSeekMoE: Towards Ultimate Expert Specialization in Mixture-of-Experts Language Models [англи] // arXiv.org. — 2024-01-11.
  19. Большие языковые модели в 2024 году: полное сравнение [ӟуч]
  20. DeepSeek вызвал истерику у Американских ИИ корпораций, Хабр. Эскеремын: 28 толшоре 2025 арын.
  21. The Chinese quant fund-turned-AI pioneer, Financial Times (9 June 2024). Эскеремын: 28 толсуре 2024 арын.
  22. 1 2 Нейросеть DeepSeek: что это, возможности, как пользоваться | РБК Тренды, РБК Тренды. Эскеремын: 28 толшоре 2025 арын.
  23. Sharma, Shubham. DeepSeek-V3, ultra-large open-source AI, outperforms Llama and Qwen on launch, VentureBeat (26 толсуре 2024). Эскеремын: 29 толшоре 2025 арын.
  24. DeepSeek-V3: Китайская языковая модель превзошла Claude 3.5 Sonnet в работе с кодом, Хабр. Эскеремын: 28 толшоре 2025 арын.
  25. BFM.ru. Китайская модель ИИ DeepSeek стала лидером по скачиванию в США, BFM.ru - деловой портал. Эскеремын: 28 толшоре 2025 арын.
  26. Нейросеть DeepSeek: что это, возможности, как пользоваться | РБК Тренды, РБК Тренды. Эскеремын: 28 толшоре 2025 арын.
  27. Запад шокирован китайским интеллектом, Коммерсантъ (27 толшоре 2025). Эскеремын: 28 толшоре 2025 арын.
  28. DeepSeek-AI, Liu, Aixin, Feng, Bei, Xue, Bing, Wang, Bingxuan, Wu, Bochao, Lu, Chengda, Zhao, Chenggang, Deng, Chengqi, Zhang, Chenyu, Ruan и др. DeepSeek-V3 Technical Report [англи] // arXiv.org. — 2024-12-27.
  29. Erdil, Ege. How has DeepSeek improved the Transformer architecture?, Epoch AI (17 толшоре 2025). Эскеремын: 29 толшоре 2025 арын.
  30. DataSecrets Разбираемся, как устроена R1 – новая бесплатная ризонинг модель ИИ из Китая, работающая на уровне o1 от OpenAI
  31. Elizabeth Gibney. China’s cheap, open AI model DeepSeek thrills scientists [англи] // Nature. — 2025-01-23. — ISSN 1476-4687. — doi:10.1038/d41586-025-00229-6.
  32. Chowdhury, Hasan KI aus China: Überholt dieses Startup jetzt OpenAI? [нем.]
  33. Sharma, Shubham Open-source DeepSeek-R1 uses pure reinforcement learning to match OpenAI o1 — at 95% less cost [англи]
  34. Moris DeepSeek, по сути взломал один из святых Граалей ИИ
  35. 1 2 ИИ-пузырь лопнул: стоимость Nvidia рухнула на $600 млрд за сутки из-за китайского стартапа DeepSeek, 3DNews - Daily Digital Digest. Эскеремын: 29 толшоре 2025 арын.
  36. Рынок криптовалют упал на 7%. Причем тут ИИ-стартап из Китая DeepSeek на NFT.RU (27 толшоре 2025). Эскеремын: 29 толшоре 2025 арын.
  37. Microsoft и OpenAI расследуют, обучался ли DeepSeek на украденных данных американских компаний в сфере ИИ, Хабр. Эскеремын: 29 толшоре 2025 арын.
  38. BFM.ru. DeepSeek заподозрили в краже технологий OpenAI, BFM.ru - деловой портал. Эскеремын: 29 толшоре 2025 арын.
  39. Запад шокирован китайским интеллектом, Коммерсантъ (27 толшоре 2025). Эскеремын: 28 толшоре 2025 арын.
  40. Overclockers.ru: Одна только китайская компания DeepSeek имеет 50 000 санкционных чипов H100, Overclockers.ru. Эскеремын: 28 толшоре 2025 арын.
  41. Zafar, Ramish. Chinese AI Lab DeepSeek Has 50,000 NVIDIA H100 AI GPUs, Says AI CEO, Wccftech (25 толшоре 2025). Эскеремын: 30 толшоре 2025 арын.
  42. Times, GB. How many gpus does OpenAI have? - GB Times, GB Times (30 куарусёнэ 2024). Эскеремын: 28 толшоре 2025 арын.
  43. DeepSeek вызвал истерику у Американских ИИ корпораций, Хабр. Эскеремын: 28 толшоре 2025 арын.
  44. Kelsey Vlamis,Katherine Tangalakis-Lippert How the US may have unintentionally helped create an AI monster in China
  45. Dario Amodei Dario Amodei — On DeepSeek and Export Controls [англи]