Le «moment aha» de Deepseek crée une nouvelle façon de construire une IA puissante avec moins d'argent

Financial Times - 29/01
L'utilisation par le groupe de renforcement de l'intelligence artificielle chinoise de «l'apprentissage par renforcement» et des «modèles de petits langues» conduit à des percées

Le laboratoire de l'IA chinois Deepseek a adopté des techniques innovantes pour développer un modèle d'IA qui a été formé avec une intervention humaine limitée, produisant un «moment AHA» qui pourrait transformer le coût pour les développeurs pour créer des applications tueuses en fonction de la technologie. Le document de recherche publié sur le fonctionnement de Le modèle de «raisonnement» R1 de Deepseek révèle comment le groupe, dirigé par le milliardaire de fonds spéculatifs Liang Wenfeng, a obtenu des résultats puissants en supprimant les goulots d'étranglement dans le développement de l'IA.

Le document montre comment Deepseek a adopté une série de techniques plus efficaces pour développer R1, qui, comme le modèle O1 rival d'Openai, génère des réponses précises en «pensant» étape par étape sur ses réponses pour les modèles de la plupart des langues. de «l'apprentissage du renforcement» pour réduire l'implication humaine impliquée dans la production de réponses aux invites.

La société a également construit des modèles plus petits avec moins de paramètres - le nombre de variables utilisées pour former un système d'IA et faç...
[Courte citation de 8% de l'article original]

Loading...