한국어 | English| Tiếng Việt
![]() |
| Kanana-2端侧模型性能对比/Kakao |
Kakao将自主研发的4款轻量级人工智能(AI)语言模型(SLM)以开源形式对外公开。其战略是,将可在智能手机等端侧环境中运行的AI模型向所有人开放商业化应用,进而推动国内AI生态系统的扩大。
28日,Kakao宣布,已通过Hugging Face平台,将AI模型"Kanana"的轻量级语言模型系列——"Kanana-2-1.3B-base"、"Kanana-2-1.3B-instruct"、"Kanana-2-3B-base"、"Kanana-2-3B-instruct"共4款以开源形式对外公开。
Kakao表示,上述模型在韩语、英语、知识、数学、代码等主要基准测试中,与同级别开源模型相比已具备竞争力;1.3B与0.9B级模型在对话、代码生成、指令执行、工具调用等实际服务应用性能方面,也达到了与全球模型相近的水准。
模型还搭载了针对韩语特化的分词器(Tokenizer)。借此,韩语处理效率较此前提升30%以上,同样的句子可用更少的Token完成处理,从而改善了运算速度与成本竞争力。此外,通过应用滑动窗口注意力机制(Sliding Window Attention),在最长3万2000 Token的对话中,内存使用量最多可削减72.7%。
同时,模型还采用了允许开发者、初创企业、研究机构自由使用的"Kanana Open License",允许商业化应用。公司期待以此为契机,进一步拓宽国内韩语AI模型的应用基础,并促进新型AI服务的开发。
Kakao统一基础模型成果负责人卢炳硕表示:"基于云端的大规模AI与端侧轻量级AI的重要性均在持续提升","希望此次开源公开能够带动更多开发者与企业投入AI服务开发,从而为国内AI生态系统的活性化作出贡献。"
李瑞妍 记者