清华ChatGLM-6B和ChatGLM2-6B模型允许免费商用
感谢IT之家网友 有鲫雪狐 的线索投递!
,智谱 AI 及清华 KEG 实验室决定,ChatGLM-6B 和 ChatGLM2-6B 权重对学术研究完全开放,并且在完成企业登记获得授权后,允许免费商业使用,登记地址点此进入。
IT之家此前报道,清华 NLP 团队于 3 月 14 日发布了中英双语对话模型 ChatGLM-6B,初具问答和对话功能。该模型基于 General Language Model架构,具有 62 亿参数。结合模型量化技术,用户可以在消费级的显卡上进行本地部署(INT4 量化级别下最低只需 6GB 显存)。
ChatGLM2-6B 模型于 6 月 25 日发布,在保留了初代模型对话流畅、部署门槛较低等特性的基础之上,又增加许多新特性:
-
更强大的性能:ChatGLM2-6B 使用了 GLM 的混合目标函数,经过了 1.4T 中英标识符的预训练与人类偏好对齐训练,评测结果显示,相比于初代模型,ChatGLM2-6B 在 MMLU、CEval(+33%)、GSM8K(+571%) 、BBH(+60%)等数据集上的性能取得了大幅度的提升。
-
更长的上下文:上下文长度由 ChatGLM-6B 的 2K 扩展到了 32K。
-
更高效的推理:推理速度相比初代提升了 42%,INT4 量化下,6G 显存支持的对话长度由 1K 提升到了 8K。
-
更开放的协议:ChatGLM2-6B 权重对学术研究完全开放。
ChatGLM2-6B 使用了 Multi-Query Attention,提高了生成速度,同时也降低了生成过程中 KV Cache 的显存占用。同时,ChatGLM2-6B 采用 Causal Mask 进行对话训练,连续对话时可复用前面轮次的 KV Cache,进一步优化了显存占用。
广告声明:文内含有的对外跳转链接,用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。
声明:本网转发此文章,旨在为读者提供更多信息资讯,所涉内容不构成投资、消费建议。文章事实如有疑问,请与有关方核实,文章观点非本网观点,仅供读者参考。
推荐阅读
-
足球游戏《EASPORTSFC24》开启预售:PC端248元起,...
感谢IT之家网友华南吴彦祖、手写的从前的线索投递! ,EA足球游戏《EAS... -
苏宁易购半年度业绩预告:归母净利亏损15-20亿元,同比减亏27...
,苏宁预购发布2023年半年度业绩预告,归属于母公司股东净利润亏损15-20... -
长安汽车:预计2025年新能源销量达到120万辆,深蓝推出6款产...
,长安汽车在投资者活动上表示将快速推进新能源板块发展,预计在2025年新能源... -
《勇者斗恶龙:寻宝探险团》上线Steam,国区售价298元...
感谢IT之家网友华南吴彦祖的线索投递! ,由SquareEnix开发的《勇... -
心脉医疗定增大举扩产,产能10倍狂飙...
21世纪经济报道记者杨坪实习生孙雨玥深圳报道 7月13日晚间,心脉医疗发布... -
报告称8月19-26日出售苹果旧款iPhone最划算...
,二手回收商SellCell近日发布报告,称每年的8月19日至26日是出售旧... -
医疗大健康产业投融资与上市论坛在京举办...
7月13日,以“医疗大健康产业的股权与资本规划”为主题的2023年世界生命科... -
夏游记⑧丨擦亮旅游名片大湾区邮轮乘风破浪...
21世纪经济报道记者唐唯珂实习生黄源轩广州报道 “微风拂面,浪花朵朵,乘着... -
信通院权威认可!观远BI入选增强分析领域代表...
信通院发布2023大数据十大关键词,观远BI入选“增强分析”领域代表 近日... -
不满意退款,盘子女人坊一招挽回女人的心...
随着摄影写真成为人们记录日常生活的一种重要方式,消费者的投诉也日渐增多。据北... -
李斌:蔚来汽车累计换电次数达2500万次...
,蔚来汽车官宣今日达成了第2500万次换电。此外,蔚来今日还上线了8座充换电... -
“情暖六月消保传情”——中航信托开展“普及金融知识守住‘钱袋子’...
中航信托积极响应监管导向,致力于将消保工作融入客户服务、企业文化建设、金融素...