Upstage, LG et SK Telecom atteignent la phase finale avec leurs modèles IA développés en propre
Au moment de la publication des résultats au complexe gouvernemental de Séoul, dans l’arrondissement de Jongno, le nombre de candidats au titre d’IA nationale est passé de quatre à trois. Upstage, LG AI Research et SK Telecom ont franchi la deuxième évaluation du projet de modèles de fondation IA développés en propre, tandis que Motif Technologies n’a pas accédé à l’étape suivante.
Cette évaluation ne s’est pas jouée sur un seul résultat. Elle a combiné des benchmarks nationaux et internationaux, l’avis d’experts externes ainsi qu’une évaluation menée auprès d’utilisateurs, avec la participation de dirigeants de start-up spécialisées dans l’IA et du grand public. Le ministère des Sciences et des TIC a expliqué que les écarts entre les quatre équipes étaient suffisamment faibles pour que le classement varie selon les évaluations, sans publier le classement détaillé de chaque indicateur.
Chaque équipe visait des usages différents. Le « Solar Open2 » de Upstage a été développé comme un modèle 250B, en combinant la reprise d’une partie des poids du modèle précédent et une initialisation aléatoire. Il est destiné aux agents utilisés pour la productivité bureautique, le traitement de documents et le codage, ainsi qu’au raisonnement avec de longs contextes. Le « K-EXAONE 2.0 » de LG AI Research a vu sa taille augmenter de plus de 3 fois grâce à une méthode d’upcycling qui étend le modèle existant, tout en améliorant la recherche dans les documents longs et la sécurité. Le « A.X K2 » de SK Telecom possède 688B paramètres, mais applique une architecture à mélange d’experts qui réduit à 33B environ le nombre de paramètres activés lors de l’inférence.
Motif Technologies, éliminée, avait achevé le développement de « Motif3 », un modèle de 314 milliards de paramètres développé depuis le début ainsi que de modules couvrant trois modalités. Dans l’Intelligence Index d’Artificial Analysis, un organisme mondial d’évaluation de l’IA, il a obtenu 47 points, le score le plus élevé des quatre équipes, mais a reçu une note relativement faible lors de l’évaluation de son utilisation réelle et de son exploitabilité, ce qui a conduit à son élimination. Le résultat montre qu’une performance élevée du modèle ne suffit pas à garantir l’accès à la phase finale.
Concrètement, qu’est-ce qui va changer ? Les trois équipes recevront chacune 1 000 GPU B200, des processeurs graphiques haute performance, afin de poursuivre le développement et le perfectionnement de leurs modèles jusqu’à la fin de l’année. Deux d’entre elles seront sélectionnées au début de l’année prochaine pour représenter l’IA nationale. Les critères et la pondération de la troisième évaluation doivent toutefois encore être arrêtés après la procédure de contestation et la concertation entre les trois équipes ; il est donc difficile de préjuger aujourd’hui du classement final.
Le gouvernement a défini ce projet non pas comme un simple concours destiné à départager deux équipes, mais comme une initiative visant à renforcer la compétitivité de l’écosystème coréen de l’IA. Dans un contexte marqué par la transformation des modèles d’IA en actifs stratégiques par les principaux pays à la pointe, notamment les États-Unis, il prévoit également d’annoncer, après les discussions budgétaires, le plan d’activité 2027 consacré aux modèles d’IA développés en propre de très haut niveau.
Sources — lire les originaux(heure de Paris)
À lire ensuite
- Modèles de fondation IA souverains : pour les quatre derniers, l’efficacité du raisonnement prime sur la taille
- Xiaohongshu ouvre un aperçu de 280 milliards de paramètres
- Kimi K3 rapproche l’IA open source des modèles fermés
- Kanana2 de Kakao devance les modèles d’IA légers de Google et Alibaba dans l’évaluation de la sécurité
Commentaires
Chargement du fil…
Connectez-vous pour écrire un commentaire. Se connecter