DeepSeek, полное название которого - «Hangzhou Deepseek Artificial Intelligence Basic Technology Research Co., Ltd.» (Далее называется China Deepseek), была основана в июле 2023 года гигантом количественного управления активами Huanfang. Его основатель Лян Венфенг имеет глубокий опыт и богатый опыт в количественных инвестициях и высокопроизводительных вычислениях.
В декабре 2024 года DeepSeek-V3 вызвал огромную волну в глобальном поле ИИ. Он достиг производительности, сравнимой с лучшими моделями, такими как GPT-4O, при чрезвычайно низких затратах на обучение, шокируя отрасль.
С запуском новой модели Deepseek Deepseek-R1, 27 января, приложение DeepSeek возглавило бесплатные рейтинги загрузки приложений в Apple App Store в Китае и Соединенных Штатах, превзойдя CHATGPT в рейтинге загрузки США.
DeepSeek - большая языковая модель. Он обладает мощными возможностями обработки естественного языка, как и умный и понимающий помощник, который может понять и отвечать на вопросы, как друг. Основываясь на алгоритмах и поддержке данных, за ним также может помочь написать код, организовать данные и даже решить некоторые сложные математические задачи.
Когда дело доходит до похожих крупных моделей, первое впечатление каждого - это Chatgpt, разработанный Openai. Из выпуска O1-Preview от Openai в сентябре 2024 года до сейчас прошло менее четырех месяцев, и модели выводов, которые сравнимы или даже превышают его производительность, расцветали на рынке.
Причина, по которой DeepSeek может выделиться во многих моделях, заключается в том, что он не только взял на себя лидерство в достижении результатов, сравнимых с моделью OpenAI-O1, но также сжала стоимость модели вывода до чрезвычайно низкого уровня.
В день открытия Всемирного экономического форума 2025 года в этом месяце в Китае Deepseek выпустила свою последнюю модель с открытым исходным кодом R1, которая вновь привлекла глобальное внимание в области искусственного интеллекта.
DeepSeek -R1 добился важного прорыва в области технологий - используя чистые методы глубокого обучения, чтобы позволить ИИ самопроизвольно появляться с возможностями рассуждений. В таких задачах, как математика, код и рассуждения о естественном языке, ее производительность сопоставима с официальной версией модели Openai-O1. Модель также продолжает высокую экономическую эффективность компании.
Понятно, что стоимость обучения модели DeepSeek-R1 составляет всего 5,6 млн. Долл. США, что намного ниже, чем сотни миллионов или даже миллиарды долларов, инвестированных в технологии искусственного интеллекта американскими технологическими гигантами, такими как исследовательский центр США по искусственному интеллекту, Google и «Мета».
Что касается цены, основатель Лян Венфенг однажды сказал в интервью со средствами массовой информации, что как API, так и ИИ должны быть универсальными и доступными для всех.
Кроме того, стоит отметить, что DeepSeek принимает полностью стратегию с открытым исходным кодом.
Первоначальное намерение Openai состояло в том, чтобы «продвигать цифровой интеллект таким образом, чтобы это, скорее всего, принесет пользу всему человечеству, не ограничиваясь необходимостью получения финансовой прибыли». Однако после выпуска GPT-3 OpenAI ограничил доступ к модели и после выпуска GPT-4, он даже спрятал свои учебные данные и веса модели, полностью движущиеся в сторону «замкнутого источника».
Полностью стратегия DeepSeek с открытым исходным кодом не только снижает порог для пользователей, но и способствует совместной экологии сообщества разработчиков искусственного интеллекта. Через открытый исходный код DeepSeek привлек внимание большого количества разработчиков и исследователей, которые могут свободно получать и изменять коды моделей на платформе, чтобы совместно способствовать разработке технологии ИИ.
Старший научный сотрудник NVIDIA Джимфан сказал на своей личной социальной платформе: «Мы находимся в таком историческом моменте: неамериканская компания продолжает оригинальную миссию Openai-расширяет возможности всего человечества благодаря действительно открытым передовым исследованиям».

