InternLM-Chat-7B部署调用-个人记录

本文主要是介绍InternLM-Chat-7B部署调用-个人记录，希望对大家解决编程问题提供一定的参考价值，需要的开发者们随着小编来一起学习吧！

一、环境准备

pip install modelscope==1.9.5
pip install transformers==4.35.2

二、下载模型

import torch
from modelscope import snapshot_download, AutoModel, AutoTokenizer
import os
model_dir = snapshot_download('Shanghai_AI_Laboratory/internlm-chat-7b', cache_dir='/home/bingxing2/ailab/group/ai4agr/wzf/LLM/models', revision='master')

使用modelscope（魔塔社区）中的snapshot_download函数下载模型，第一个参数为模型名称，参数cache_dir为模型的下载路径。

三、终端运行模型

新建一个 demo.py 文件，将以下代码填入其中，之后直接使用python命令执行脚本：

import torch
from transformers import AutoTokenizer, AutoModelForCausalLM# 指定模型路径
model_name_or_path = "/home/bingxing2/ailab/group/ai4agr/wzf/LLM/models/InternLM-Chat-7B/Shanghai_AI_Laboratory/internlm-chat-7b"# 加载预训练分词器和模型
tokenizer = AutoTokenizer.from_pretrained(model_name_or_path, trust_remote_code=True)
model = AutoModelForCausalLM.from_pretrained(model_name_or_path, trust_remote_code=True, torch_dtype=torch.bfloat16, device_map='auto')
model.eval()print("=============Welcome to InternLM chatbot, type 'exit' to exit.=============")while True:input_text = input("User  >>> ")if input_text == "exit":break# 使用模型生成响应inputs = tokenizer.encode(input_text, return_tensors="pt")outputs = model.generate(inputs, max_length=50, pad_token_id=tokenizer.eos_token_id)response = tokenizer.decode(outputs[0], skip_special_tokens=True)print(f"Robot >>> {response}")

运行样例（反应很慢）：

四、web端运行

1.克隆代码

git clone https://gitee.com/internlm/InternLM.git

克隆好项目后需要进入/InternLM/web_demo.py中，将其中的29和33行的模型替换为本地模型路径。例如/root/model/Shanghai_AI_Laboratory/internlm-chat-7b

2.web demo运行

streamlit run /InternLM/web_demo.py --server.address 127.0.0.1 --server.port 6006

3.将端口映射到本地。

进入InternStudio控制台，需要邀请码，暂时不写了，搞到了再接着写。请参考实操作业：基于浦语大模型InternLM-Chat-7B 对话、智能体工具调用、图文创作等场景部署实操步骤-CSDN博客

参考：

【InternLM】书生-浦语大模型demo搭建&服务接口部署&本地映射_书生浦语部署-CSDN博客

实操作业：基于浦语大模型InternLM-Chat-7B 对话、智能体工具调用、图文创作等场景部署实操步骤-CSDN博客

大模型实战营第二期——2. 浦语大模型趣味Demo_internlm-chat-7b什么量级-CSDN博客

这篇关于InternLM-Chat-7B部署调用-个人记录的文章就介绍到这儿，希望我们推荐的文章对编程师们有所帮助！

InternLM-Chat-7B部署调用-个人记录

一、环境准备

二、下载模型

三、终端运行模型

四、web端运行

相关文章

Java使用SLF4J记录不同级别日志的示例详解

在Spring Boot中浅尝内存泄漏的实战记录

MySQL 中查询 VARCHAR 类型 JSON 数据的问题记录

Spring Boot项目部署命令java -jar的各种参数及作用详解

Java调用C++动态库超详细步骤讲解(附源码)

Python获取中国节假日数据记录入JSON文件

Spring Boot 配置文件之类型、加载顺序与最佳实践记录

tomcat多实例部署的项目实践

MySQL INSERT语句实现当记录不存在时插入的几种方法

SpringBoot配置Ollama实现本地部署DeepSeek