阿里巴巴开源其大语言模型通义千问

热点资讯 2023年8月5日 pm10:36 7 来源: 奇客资讯网

阿里巴巴在今年四月宣布了它的大语言模型通义千问（Tongyi Qianwen 或简写 Qwen）。现在它宣布开源有 70 亿参数的 Qwen-7B 系列模型，源代码托管在 GitHub 上，采用被称为 Tongyi Qianwen LICENSE AGREEMENT 的许可证，有限制条件，如果商业使用，月活用户数超过 1 亿，则需要从阿里巴巴获得授权。这一条件与 Meta 对其 LLaMA 2 大模型的限制类似。阿里巴巴称，Qwen-7B是基于 Transformer 的大语言模型, 在 2.2 万亿 token 的预训练数据上进行训练得到。预训练数据类型多样，覆盖广泛，包括大量网络文本、专业书籍、代码等。相比同规模的开源模型，Qwen-7B 在多个评测数据集上具有显著优势，甚至超出 12-13B 等更大规模的模型。评测评估的能力范围包括自然语言理解与生成、数学运算解题、代码生成等。

文章版权归作者所有，未经允许请勿转载。

前一篇：IBM 和 NASA 开源最大地理空间 AI 基础模型

后一篇：AI 研究员称通过 Zoom 声音能以 93% 正确率识别按键

发表回复取消回复

要发表评论，您必须先登录。

阿里巴巴开源其大语言模型通义千问

相关文章

发表回复 取消回复

发表回复取消回复