• Docker一键快速私有化部署(Ollama+Openwebui) +AI大模型(gemma,llama2,qwen)20240417更新


     几行命令教你私有化部署自己的AI大模型,每个人都可以有自己的GTP

    第一步:安装Docker(如果已经有了可以直接跳第二步)

    1. ####下载安装Docker
    2. wget https://mirrors.aliyun.com/docker-ce/linux/centos/docker-ce.repo -O/etc/yum.repos.d/docker-ce.repo
    3. ##更新yum软件包索引
    4. yum makecache fast
    5. ## 安装docker ce cli
    6. yum -y install docker-ce-23.0.6-1.el7 docker-ce-cli-23.0.6-1.el7
    7. ##"启动Docker并验证"
    8. systemctl enable docker && systemctl start docker
    9. docker version

    第二步:使用Docker部署Ollama
                     (ollama run gemma)安装谷歌gemma大模型

                     (ollama run llama2)安装Meta llama2大模型

                     (ollama run qwen)安装阿里的qwen大模型

    1. ###docker下载ollama部署
    2. docker run -d -v ollama:/root/.ollama -p 11434:11434 --name ollama --restart always ollama/ollama
    3. ###开始下载gemma大模型
    4. docker exec -it ollama ollama run gemma “你好”

    第三步:使用Docker部署webUI页面

                    将${inner_ip}替换成你本机IP(用hostname -I可查看)

    docker run -d -p 3000:8080 -e OLLAMA_BASE_URL=http://${inner_ip}:11434 -v open-webui:/app/backend/data --name open-webui --restart always ghcr.nju.edu.cn/open-webui/open-webui:main

    第四步,正在启动WEBUI界面,大约5分钟后,

    部署完毕,请访问:http://IP:3000

    正常就可以打开访问属于你自己的大模型了。

    可以通过下面的命令查看日志

    docker logs -f open-webui

  • 相关阅读:
    前端文件上传的几种交互造轮子
    深入剖析阻塞式socket的timeout
    Python类型转换
    设计模式初版讲解
    第二章第六节 ST图与迭代优化
    使用R语言进行聚类分析
    大数据 为什么用
    线性回归学习
    伺服驱动器的位置控制模块电路原理是什么?
    Python基于Django的电影推荐系统和论坛项目完整源码
  • 原文地址:https://blog.csdn.net/asdfaa/article/details/137889523