G42发布130亿参数印地语模型 开启印度AI新纪元

阿通社阿布扎比2024年9月11日电 - 在阿布扎比王储谢赫哈立德·本·穆罕默德·本·扎耶德·阿勒纳哈扬殿下访印期间,阿联酋领先科技集团G42宣布推出印地语大型语言模型NANDA。这一模型拥有130亿参数,训练数据集包含约2.13万亿个语言单位,将为超过5亿印地语使用者提供利用生成式人工智能的机会。

据G42声明,NANDA由其旗下公司Inception、穆罕默德·本·扎耶德人工智能大学及Cerebras Systems合作开发,在全球最强大的人工智能超级计算机之一Condor Galaxy上进行训练。

G42印度首席执行官马努·贾恩表示,在印度总理莫迪领导下,"数字印度"等举措使印度在科技领域保持领先。G42很荣幸能为印度人工智能发展做出贡献。

Inception首席执行官安德鲁·杰克逊博士指出,NANDA的推出开启了人工智能新纪元,将确保印地语文化遗产在数字和人工智能领域得到体现。

去年8月,G42曾推出首个阿拉伯语开源大型语言模型Jais。此次NANDA的推出旨在加速印地语人工智能生态系统发展,支持印度科学、学术和开发者社区,推动该地区人工智能技术普及。