Deepseek, dont le nom complet est "Hangzhou Deepseek Artificial Intelligence Basic Technology Research Co., Ltd." (ci-après dénommé China Deepseek), a été fondée en juillet 2023 par le géant quantitatif de la gestion des actifs Huanfang. Son fondateur Liang Wenfeng a une expérience profonde et une riche expérience dans l'investissement quantitatif et l'informatique haute performance.
En décembre 2024, Deepseek-V3 a déclenché une énorme vague dans le domaine mondial de l'IA. Il a atteint des performances comparables aux modèles de haut niveau tels que GPT-4O à des coûts de formation extrêmement bas, choquant l'industrie.
Avec le lancement du nouveau modèle de Deepseek Deepseek-R1, le 27 janvier, l'application Deepseek a dépassé le classement gratuit de téléchargement de l'application de l'App Store d'Apple en Chine et aux États-Unis, dépassant le chatpt dans le classement de téléchargement américain.
Deepseek est un modèle grand langage. Il a de puissantes capacités de traitement du langage naturel, tout comme un assistant intelligent et compréhensif qui peut comprendre et répondre à des questions comme un ami. Sur la base des algorithmes et de la prise en charge des données, il peut également vous aider à écrire du code, à organiser des données et même à résoudre des problèmes mathématiques complexes.
En ce qui concerne les grands modèles similaires, la première impression de tout le monde est le chatpt développé par Openai. De la sortie de O1-Preview par OpenAI en septembre 2024 à maintenant, moins de quatre mois se sont écoulés et des modèles d'inférence qui sont comparables ou même dépassent ses performances se sont épanouies sur le marché.
La raison pour laquelle Deepseek peut se démarquer de nombreux modèles est qu'il a non seulement pris les devants pour obtenir des résultats comparables au modèle OpenAI-O1, mais a également comprimé le coût du modèle d'inférence à un niveau extrêmement bas.
Le jour de l'ouverture de la réunion annuelle de la Forum économique mondial de 2025 ce mois-ci, Deepseek de Chine a publié son dernier modèle open source R1, qui a une fois de plus attiré l'attention mondiale dans le domaine de l'intelligence artificielle.
Deepseek-R1 a réalisé une percée importante dans la technologie - en utilisant des méthodes d'apprentissage en profondeur pures pour permettre à l'IA d'émerger spontanément avec des capacités de raisonnement. Dans les tâches telles que les mathématiques, le code et le raisonnement en langage naturel, ses performances sont comparables à la version officielle du modèle OpenAI-O1. Le modèle poursuit également la rentabilité élevée de l'entreprise.
Il est entendu que le coût de formation du modèle Deepseek-R1 ne représente que 5,6 millions de dollars, bien inférieur aux centaines de millions, voire des milliards de dollars, investis dans la technologie de l'intelligence artificielle par des géants de la technologie américaine tels que le Centre américain de recherche sur l'intelligence artificielle ouverte, Google et "Meta".
En ce qui concerne le prix, le fondateur Liang Wenfeng a déclaré un jour dans une interview avec les médias que les API et l'IA devraient être universels et abordables pour tout le monde.
De plus, il convient de noter que Deepseek adopte une stratégie complètement open source.
L'intention initiale d'OpenAI était de «faire progresser l'intelligence numérique d'une manière qui est la plus susceptible de bénéficier à toute l'humanité, sans être limitée par la nécessité de générer des rendements financiers». Cependant, après la publication de GPT-3, OpenAI a restreint un accès au modèle, et après la libération de GPT-4, il a même caché ses données de formation et ses poids de modèle, évoluant complètement vers la «source fermée».
La stratégie entièrement open source de Deepseek réduit non seulement le seuil pour les utilisateurs, mais favorise également l'écologie collaborative de la communauté des développeurs d'IA. Grâce à l'open source, Deepseek a attiré l'attention d'un grand nombre de développeurs et de chercheurs, qui peuvent obtenir et modifier librement les codes de modèle sur la plate-forme pour promouvoir conjointement le développement de la technologie d'IA.
Le chercheur principal de Nvidia, Jimfan, a déclaré sur sa plate-forme sociale personnelle: "Nous sommes à un moment si historique: une entreprise non américaine continue la mission originale d'Openai - responsabiliser toute l'humanité grâce à des recherches de pointe vraiment ouvertes."

