📌 OpenAI riposte à DeepSeek AI en lançant une première version de l’o3-Mini – voici à quoi il ressemble en comparaison
-Vendredi, OpenAI a cherché à protéger sa position sur le marché en lançant l’o3-mini. Il s’agit d’un concurrent direct du modèle R1 de la startup chinoise DeepSeek, qui a bouleversé l’industrie de l’IA en offrant des performances de haut niveau à un coût de calcul inférieur.
Nous lançons l’OpenAI o3-mini. Le modèle le plus récent et le plus rentable de la série d’inférence, disponible aujourd’hui à la fois en ChatGPT et en API, selon le blog officiel d’OpenAI. Annoncé en décembre 2024, ce modèle puissant et rapide qui remplace l’OpenAI o1-. mini repousse les limites de ce que les modèles plus petits peuvent réaliser, tout en conservant le faible coût et la latence réduite du mini.
OpenAI met également ses capacités d’inférence à la disposition des utilisateurs gratuitement pour la première fois. Contrairement aux modèles des familles GPT-4o et GPT, les modèles d’IA de la famille ‘o’ se concentrent sur les tâches d’inférence. Bien qu’ils soient moins créatifs, ils sont capables de résoudre des problèmes complexes, de revenir sur des analyses erronées et de générer un meilleur code structurel grâce à des chaînes d’inférence intégrées.
Les chercheurs chinois en IA ont réalisé ce que beaucoup pensaient être des années dans le futur : OpenAI, un modèle d’IA libre et gratuit qui peut égaler ou même surpasser les performances des systèmes d’inférence les plus avancés au monde. Ce résultat est obtenu en permettant à l’IA d’apprendre par essais et erreurs, de la même manière que les humains apprennent. DeepSeek-R1-Zero est un modèle formé à l’aide de l’apprentissage par renforcement à grande échelle (RL) sans réglage fin supervisé préalable (SFT) et démontre des capacités de sur-apprentissage remarquables.
Les modèles d’IA de plus haut niveau d’OpenAI comprennent les modèles pré-génératifs génératifs.
GPT est une famille d’artistes, de types cérébraux droits adaptés aux jeux de rôle, à la conversation, à la créativité, à la généralisation, à l’explication, au brainstorming, au bavardage, etc.
O est une famille d’intellos.
Ils ne savent pas raconter d’histoires, mais ils sont doués pour coder, résoudre des formules mathématiques, analyser des problèmes complexes, planifier un processus de raisonnement étape par étape et comparer des articles scientifiques.
Les nouvelles figurines o3 se déclinent en trois variantes : faible, moyenne et élevée. Ces sous-catégories permettent aux utilisateurs d’obtenir de meilleures réponses en échange d’un “raisonnement” plus poussé (plus coûteux pour les développeurs qui doivent payer le jeton).
L’OpenAI o3-mini, orientée vers l’efficacité, est meilleure dans les chaînes de raisonnement de connaissances générales et multilingues que l’OpenAI o1-mini, mais elle est meilleure dans d’autres tâches telles que le codage et la facticité.
Tous les autres modèles (o3-mini medium et o3-mini high) surpassent OpenAI o1-mini dans tous les benchmarks, n’utilisant qu’une fraction de la puissance de calcul et surpassant le modèle phare d’OpenAI. La percée de DeepSeek a déclenché une vente massive de technologies qui a anéanti près de 1 000 milliards de dollars sur le marché américain. À elle seule, la société NVIDIA a perdu 600 milliards de dollars en valeur boursière, les investisseurs s’interrogeant sur la demande future de puces d’IA coûteuses.
La différence de performance était due à la nouvelle approche de DeepSeek en matière d’architecture de modèle.
Alors que les entreprises américaines se concentraient sur l’augmentation de la puissance de calcul pour développer l’IA, l’équipe de Deep Seek a trouvé des moyens de rendre les modèles plus simples et plus efficaces dans le traitement de l’information. La concurrence s’est intensifiée lorsque le géant chinois de la technologie Alibaba a lancé son modèle Qwen2.5 Max, encore plus puissant que le modèle utilisé par Deep Seek, ouvrant ainsi la voie à une nouvelle vague d’innovation en matière d’IA en Chine.