WhatsApp :8613480819877
Leave Your Message
Actualités en vedette

Alibaba Cloud publie le code source de son premier modèle de raisonnement IA, QwQ : son niveau de raisonnement est comparable à celui d’OpenAI o1, et ses performances en mathématiques et en programmation sont particulièrement remarquables.

2025-03-06

Aujourd'hui, l'équipe Alibaba Cloud Tongyi a annoncé le lancement et la publication simultanée en open source d'un nouveau modèle d'inférence IA, QwQ-32B-Preview. Les évaluations montrent que QwQ (Qwen with Questions) Preview démontre des capacités de raisonnement scientifique de niveau universitaire, notamment en mathématiques et en programmation. Ses capacités de raisonnement globales sont comparables à celles d'OpenAI o1.
Il est rapporté que QwQ est le dernier modèle de recherche expérimental lancé par Tongyi Qianwen Qwen big model et le premier modèle de raisonnement d'intelligence artificielle open-source d'Alibaba Cloud.
L'équipe de Tongyi Qianwen d'Alibaba Cloud a constaté que lorsqu'un modèle dispose de suffisamment de temps pour réfléchir, s'interroger et analyser, sa compréhension des mathématiques et de la programmation s'approfondit. Grâce à ce constat, QwQ a réalisé des progrès considérables dans la résolution de problèmes complexes.
Au test GPQA mesurant la capacité à résoudre des problèmes scientifiques, QwQ a obtenu une précision de 65,2 %, indiquant sa capacité de raisonnement scientifique au niveau supérieur ; au test AIME, QwQ a démontré sa capacité à résoudre des problèmes mathématiques avec un taux de réussite de 50 %.
Au test MATH-500, QwQ a surpassé o1-preview et o1-mini, atteignant un score élevé de 90,6 %. Au test LiveCodeBench, qui évalue la génération de code complexe, QwQ a répondu correctement à la moitié des questions et a également obtenu de bons résultats lors du concours de programmation.
De plus, face à des problèmes complexes, QwQ est capable de s'engager dans une auto-analyse approfondie, de remettre en question ses propres hypothèses et d'examiner attentivement chaque étape de son processus de raisonnement grâce à un dialogue intérieur réfléchi.
Par exemple, lors de la résolution du problème classique de QI « Devinez la carte », QwQ a compris la conversation et a tiré des conclusions comme un bon penseur, et a finalement trouvé la bonne réponse.
La version préliminaire de QwQ-32B est actuellement disponible en open source sur des plateformes telles que MoDa Community et Hugging Face. Quelques heures seulement après sa sortie, elle a suscité un enthousiasme considérable auprès des développeurs du monde entier.
Certains développeurs estiment que ce modèle représente « un bond en avant totalement inattendu et incroyable », « la percée la plus significative dans le domaine de l'open source cette année » et « donne à la Chine un avantage en matière de grands modèles open source et de raisonnement par IA ».
L'équipe de Tongyi a toutefois précisé que, malgré ses solides capacités d'analyse, QwQ demeure un modèle de recherche expérimental. Il présente des limites, notamment l'utilisation mixte de différentes langues, des biais occasionnels et une compréhension insuffisante des enjeux professionnels. À mesure que la recherche s'approfondit et que les modèles seront améliorés, ces problèmes seront progressivement résolus.