一键部署开源AI(人工智能对话模型)(支持显卡或CPU加内存运行)--ChatGLM-6B

一键部署开源AI(人工智能对话模型)(支持显卡或CPU加内存运行)--ChatGLM-6B

一、基本介绍：

基于ChatGLM-6B 的快速安装服务，支持一键安装，无需任何服务配置和代码编写即可完成。

ChatGLM-6B 是一个开源的、支持中英双语的对话语言模型，基于 General Language Model (GLM) 架构，具有 62 亿参数。结合模型量化技术，用户可以在消费级的显卡上进行本地部署（INT4 量化级别下最低只需 6GB 显存）。 ChatGLM-6B 使用了和 ChatGPT 相似的技术，针对中文问答和对话进行了优化。经过约 1T 标识符的中英双语训练，辅以监督微调、反馈自助、人类反馈强化学习等技术的加持，62 亿参数的 ChatGLM-6B 已经能生成相当符合人类偏好的回答。

二：产品特点

双语：同时支持中文和英文。

高精度（英文）：在公开的英文自然语言榜单 LAMBADA、MMLU 和 Big-bench-lite 上优于 GPT-3 175B（API: davinci，基座模型）、OPT-175B 和 BLOOM-176B。

高精度（中文）：在7个零样本 CLUE 数据集和5个零样本 FewCLUE 数据集上明显优于 ERNIE TITAN 3.0 260B 和 YUAN 1.0-245B。

快速推理：首个实现 INT4 量化的千亿模型，支持用一台 4 卡 3090 或 8 卡 2080Ti 服务器进行快速且基本无损推理。

可复现性：所有结果（超过 30 个任务）均可通过我们的开源代码和模型参数复现。

跨平台：支持在国产的海光 DCU、华为昇腾 910 和申威处理器及美国的英伟达芯片上进行训练与推理。

三、安装使用方法：

1、硬件要求：

量化等级最低 GPU显存（推理）最低 GPU 显存（高效参数微调）
FP16（无量化） 13 GB 14 GB
INT8 8 GB 9 GB
INT4 6 GB 7 GB

2、下载ChatGLM一键部署安装包

百度网盘下载地址：百度云

链接：https://pan.baidu.com/s/1Sx8otS0zB340Rvr89S6F9A
提取码：2207

3、一键运行

下载完成后，点击文件中的run.exe直接一键运行

运行完成后，即完成本地化ChatGLM安装，可以直接进行使用。

我是用CPU+内存运行，大约占30G内存，实测问答速度不快，大约1秒出一个单词
相关阅读:
flutter_学习记录_02底部 Tab 切换保持页面状态的几种方法
 VS Code调试C代码
 【Spring Boot 源码研究】- 自动化装配条件化配置Conditional剖析
 Mybatis-Plus-入门简介（2）
动态内存分配
 数组中 forEach 和 Map 的区别
 springboot网站开发0201-使用MybatisPlus查询数据库信息返回前端渲染
 【web APIs】快速上手Day03
Android：OkHttp同步请求和异步请求
 Linux性能优化--使用性能工具发现问题
原文地址：https://blog.csdn.net/qq_45748758/article/details/133810283

量化等级	最低 GPU显存（推理）	最低 GPU 显存（高效参数微调）
FP16（无量化）	13 GB	14 GB
INT8	8 GB	9 GB
INT4	6 GB	7 GB

一、基本介绍：

二：产品特点

三、安装使用方法：

1、硬件要求：

2、下载ChatGLM一键部署安装包

3、一键运行