
清华大学AI研究院正式发布自主研发的开源大模型,这一成果标志着中国在AI大模型领域取得了重要突破。该模型在多项基准测试中的表现媲美OpenAI的GPT-4。
据悉,这款大模型名为清言,参数规模达到千亿级别。研发团队在训练数据、模型架构和训练方法上都进行了创新。特别是在中文理解和生成方面,清言展现出明显优势,更了解中文语境和文化背景。
开源是清言最大的特点。研究团队将模型权重、训练代码和数据集全部公开,任何研究者都可以下载使用。这一举措降低了大模型的研究门槛,推动了学术界和产业界的共同进步。
技术细节方面,清言采用了创新的稀疏注意力机制,在保证性能的同时大幅降低了计算成本。普通研究机构使用消费级显卡就能运行该模型,这让更多人有机会参与大模型研究。
测试数据显示,清言在中英文阅读理解、数学推理、代码生成等任务上都取得了优异成绩。在中文特定任务上,它的表现甚至超过了GPT-4。
开源社区反响热烈。发布仅一周,GitHub仓库就收获了超过2万颗星。众多开发者和研究者开始基于清言进行二次开发,衍生应用层出不穷。
研究团队表示,将持续更新优化模型,并欢迎社区贡献。开源生态的建立,将加速中国AI技术的发展。清言的发布,是中国AI自主可控道路上的重要一步。