Kakao publie des modèles d’IA open source avec un gain de 30 % en traitement coréen

Kakao-3,64%
Key Takeaways
  • Kakao a publié quatre modèles compacts pour Kana en open source sur Hugging Face le 28.
  • Kakao a amélioré l’efficacité du traitement du coréen de plus de 30% grâce à l’optimisation du tokenizer dans de nouveaux modèles.
  • Kakao poursuit une stratégie d’IA duale pour des modèles dans le cloud et sur appareil en prévision de l’ère de l’IA agentique.

Kakao a publié quatre petits modèles de langage (SLM) issus de son modèle d’IA interne « Kana » en open source le 28. La société a annoncé avoir déposé ces modèles sur Hugging Face, une plateforme open source, dont « Kana-2-1.3B-base », conçu pour fonctionner sur des appareils tels que des smartphones. Cette publication vise à soutenir des capacités d’IA sur l’appareil, alors que la société se prépare à l’ère de l’IA agentique. Malgré leur taille compacte, les modèles atteignent des performances de niveau mondial pour le traitement du coréen comme pour celui de l’anglais.

Kakao publie quatre modèles SLM Kana sur Hugging Face

Kakao a publié quatre variantes de SLM sur la plateforme open source Hugging Face le 28. Les modèles incluent « Kana-2-1.3B-base » et trois autres versions conçues pour fonctionner sur des appareils tels que des smartphones. La société a développé ces modèles dans le cadre de son modèle d’IA interne « Kana ».

Les modèles affichent des performances de niveau mondial en coréen et en anglais

Le « Kana-2-1.3B-instruct » open source et le plus petit « Kana-2-0.9B-instruct » démontrent des performances comparables à celles de modèles mondiaux de taille similaire dans les capacités de dialogue, de connaissances, de code, de mathématiques, de suivi d’instructions et d’appel d’outils. Les modèles atteignent des performances de niveau mondial en coréen et en anglais malgré leur taille compacte.

L’efficacité du traitement du coréen progresse de plus de 30 % grâce à l’optimisation du tokenizer

L’efficacité du traitement du coréen a progressé de plus de 30 % par rapport aux versions précédentes. Kakao a optimisé le tokenizer — la technologie centrale qui détermine comment les modèles d’IA segmentent le texte — spécifiquement pour le traitement de la langue coréenne. Cette optimisation a entraîné un calcul plus rapide et une réduction des coûts opérationnels.

Un dirigeant de Kakao souligne une stratégie d’IA double pour le cloud et les modèles sur appareil

Noh Byung-seok, responsable des performances du modèle de fondation unifié chez Kakao, a déclaré que la société « perçoit l’importance de l’IA cloud à grande échelle et de l’IA légère sur appareil tout en se préparant à l’ère de l’IA agentique ». Il a ajouté que « Kakao renforce sa compétitivité technologique dans les deux domaines » et a exprimé l’espoir que « ces modèles en open source mèneront au développement de nouveaux services d’IA par davantage de développeurs et d’entreprises, contribuant à l’activation de l’écosystème national d’IA ».

FAQ

Qu’a libéré Kakao le 28 ?

Kakao a publié quatre petits modèles de langage (SLM) issus de son modèle d’IA « Kana » en open source sur Hugging Face, dont « Kana-2-1.3B-base » et trois autres variantes conçues pour fonctionner sur des appareils tels que des smartphones.

De combien Kakao a-t-il amélioré l’efficacité du traitement du coréen dans les nouveaux modèles ?

Kakao a amélioré l’efficacité du traitement du coréen de plus de 30 % par rapport aux versions précédentes en optimisant le tokenizer spécifiquement pour le traitement de la langue coréenne, ce qui a permis d’accélérer la vitesse de calcul et de réduire les coûts.

Avertissement : Les informations figurant sur cette page peuvent provenir de sources tierces et sont fournies à titre indicatif uniquement. Elles ne reflètent pas les points de vue ou opinions de Gate et ne constituent pas un conseil financier, d’investissement ou juridique. Le trading des actifs virtuels comporte des risques élevés. Veuillez ne pas vous fonder uniquement sur les informations de cette page pour prendre vos décisions. Pour en savoir plus, consultez l’avertissement.
Commentaire
0/400
Aucun commentaire