最近想上手书生大模型,有人能分享一下从注册到调模型API的完整教程吗?
相关 AI 产品
书生大模型
书生大模型是什么?如何用免费开源AI实现科研与产业创新? 书生通用大模型(Shusheng Large Models)是由上海人工智能实验室研发的通用人工智能体系,于2023年7月首次发布,并于同年8月成为首批通过国家备案的大模型。该体系以……
查看 ↗Gemini 3.0
如何免费使用Gemini 3.0?Gemini 3.0 vs GPT-5.1 vs Claude 4.5:最新AI模型权威对比,谁更胜一筹? 1 Gemini 3.0是什么? 2025年11月18日,谷歌DeepMind正式推出了第三代旗舰……
查看 ↗百灵大模型
全能选手百灵大模型:功能详解、使用指南与竞品对比 1 百灵大模型是什么? 蚂蚁百灵大模型是蚂蚁集团自主研发的人工智能基础模型体系,采用先进的Transformer架构与混合专家(MoE)架构,基于万亿级Token语料训练而成。这一模型体系形……
查看 ↗阶跃AI
1 阶跃AI是什么? 阶跃AI(www.stepfun.com/chats/new)(原名跃问AI)是由上海阶跃星辰智能科技有限公司开发的一款多功能AI助手应用。该公司成立于2023年4月,虽然相对年轻,但凭借其技术实力已快速跻身"AI六小……
查看 ↗Kimi K2.5
一、Kimi K2.5是什么?—— 重新定义AI生产力协作者 Kimi K2.5是北京月之暗面科技有限公司(Moonshot AI)在2026年1月27日正式发布并开源的新一代大语言模型。它并非一次简单的版本迭代,而是标志着AI从“聊天对话……
查看 ↗商汤NEO模型
商汤NEO模型:用1/10数据量重塑多模态AI,边缘设备也能跑动的顶级模型 1 商汤NEO模型是什么? 商汤NEO是商汤科技与南洋理工大学S-Lab实验室于2025年12月联合发布的全新原生多模态模型架构,其名称“NEO”蕴含着“全新开端”……
查看 ↗微博 VibeThinker
微博VibeThinker-1.5B:15亿参数如何击败千亿级AI模型? 在AI模型参数规模不断膨胀的今天,当各大科技公司都在追逐万亿参数级别时,微博AI团队却反其道而行之,于2025年11月推出了一款仅含15亿参数的开源大模型VibeTh……
查看 ↗VibePaper
一、VibePaper是什么?如何用AI Agent工作空间提升创作效率? 1.1 产品定位与核心理念 VibePaper不是一个传统的AI写作工具,也不是简单的工作流拼接软件,而是一个更接近真实创作场景的AI Agent工作空间。它的核心……
查看 ↗Gemini 2.0 Flash
一、Gemini 2.0 Flash是什么?谷歌多模态AI模型,一键图像生成与编辑 Gemini 2.0 Flash是谷歌在2026年3月26日发布的Gemini 2.0系列人工智能模型的第一个版本。这是谷歌迄今为止最强大的人工智能模型,被……
查看 ↗相关话题
如果你正在找一个上手快、开源友好且中文能力扎实的大模型,书生大模型(InternLM)是目前性价比最高的选择之一。从注册到调通API,整个流程走下来不会超过10分钟,而且官方提供了免费的测试额度,完全够你先跑几个demo体验效果。
书生大模型是什么?
书生大模型是由上海人工智能实验室(OpenMMLab)牵头,联合商汤科技、多家高校共同开发的开源大语言模型家族。核心产品包括书生·浦语(InternLM)和书生·万卷(InternLM2),在知识问答、长文本理解、代码生成等方面表现非常扎实,尤其对中文场景做了深度优化。
核心特点:
- 开源开放:模型权重(7B、20B)完全开源,可商用;API服务也提供免费额度。
- 中文能力强:在C-Eval、MMLU等中文基准上长期领先同等规模模型。
- 长上下文:支持最高200K token的上下文窗口(部分版本)。
- 工具调用:内置Function Calling能力,方便对接外部工具。
收费情况:当前API服务采用注册即送额度模式(具体额度随时间调整,目前新用户赠送100万token),超出部分按量计费,价格约为0.008元/千token(输入+输出),比许多闭源模型便宜一个数量级。具体可查看官网定价页面。
官网入口:https://internlm.intern-ai.org.cn
完整上手教程:从注册到调通API
第一步:注册账号并获取API Key
- 打开 书生·浦语官网,点击右上角“注册”。支持手机号或邮箱注册。
- 登录后,在个人中心找到“API管理”或“Access Key”菜单(通常位于左侧导航栏)。
- 点击“创建API Key”,系统会生成一个以
sk-开头的密钥。请立即复制并保存,关闭页面后不再显示完整密钥。 - (可选)在“额度管理”中查看你的免费额度余额。
注意:API Key请勿泄露,如果怀疑泄露可以随时在后台删除并重新生成。
第二步:环境配置
推荐使用Python 3.8+,安装OpenAI兼容的SDK(因为InternLM的API完全兼容OpenAI格式):
pip install openai
如果你希望直接使用原生的requests调用,也可以用 requests 库,但推荐用官方SDK更方便。
第三步:调用API(代码示例)
以下是一个完整的对话调用示例,把 YOUR_API_KEY 替换为你刚才保存的密钥:
from openai import OpenAI
# 初始化客户端,指定书生API端点
client = OpenAI(
api_key="YOUR_API_KEY",
base_url="https://internlm.intern-ai.org.cn/api/v1"
)
# 对话请求
response = client.chat.completions.create(
model="internlm2.5-latest", # 当前最新模型,也可以换 internlm2.5-7b-chat 等
messages=[
{"role": "user", "content": "请用中文解释一下什么是自注意力机制"}
],
temperature=0.7,
max_tokens=1024
)
# 输出结果
print(response.choices[0].message.content)
关键点说明:
- base_url 必须设为
https://internlm.intern-ai.org.cn/api/v1,这是书生API的统一入口。 - model 参数支持
internlm2.5-latest、internlm2.5-7b-chat、internlm2.5-20b-chat等,具体列表可以查阅官方文档。 - 如果返回401错误,说明API Key无效或已过期;如果返回429,说明额度已用完或请求频率过高。
第四步:进阶使用——流式输出与Function Calling
如果需要流式(逐token输出),只需在请求中加入 stream=True,然后迭代响应:
response = client.chat.completions.create(
model="internlm2.5-latest",
messages=[{"role": "user", "content": "写一首关于夏天的五言绝句"}],
stream=True
)
for chunk in response:
if chunk.choices[0].delta.content:
print(chunk.choices[0].delta.content, end='')
Function Calling(工具调用)的用法与OpenAI完全一致,官方文档中提供了详细的示例。
与其他国产大模型API的简要对比
为了帮你快速决策,我把书生大模型和当前主流的几款国产模型API做了对比(基于2025年4月信息):
| 产品 | 价格(千token) | 免费额度 | 开源程度 | 中文能力 |
|---|---|---|---|---|
| 书生·浦语(InternLM) | ≈0.008元 | 100万token | 完全开源(权重+代码) | ★★★★★ |
| 智谱清言(GLM-4) | ≈0.01元 | 15万token(新用户) | 部分开源 | ★★★★☆ |
| 通义千问(Qwen2.5) | ≈0.007元 | 10万token(每月) | 完全开源 | ★★★★☆ |
| 文心一言(ERNIE 4.0) | ≈0.012元 | 较少 | 闭源 | ★★★★☆ |
对比中你可以看到,书生在开源程度和免费额度上优势明显,尤其适合个人开发者做原型验证或学术研究。如果需要更多功能(如多模态),可以关注书生的多模态版本(InternVL)。
其他AI产品参考链接:
常见问题与避坑提醒
- 问:为什么调用返回“模型不存在”?
答:确认model参数名称是否正确,建议用internlm2.5-latest或去模型列表查看最新名称。 - 问:免费额度用完后会自动扣费吗?
答:默认不会自动扣费,需要你在后台手动充值并开启“自动续费”开关。所以放心测试,不会产生意外账单。 - 问:我想本地部署模型,怎么下载?
答:去Hugging Face搜索internlm或直接访问GitHub仓库,有完整的下载和推理教程。 - 问:API速度怎么样?
答:非并发场景下,7B模型首token延迟约0.5-1秒,20B模型约1-2秒,日常使用完全可接受。
相关问题
- 书生大模型和千问、智谱相比,哪个更适合做RAG?
书生的长上下文能力(200K)使其在RAG场景有天然优势,配合内置的Function Calling可以低成本实现文档问答。 - 书生大模型有本地运行的开源版吗?需要什么配置?
有的,7B模型只需12GB显存即可运行(比如RTX 3060 12GB),20B需要40GB以上显存。强烈推荐使用LM Studio或Ollama简化部署。 - 如何用书生大模型的Function Calling对接数据库查询?
先定义好工具schema(类似OpenAI),然后在messages中加入工具调用,模型会自动返回函数参数,你执行后再将结果作为assistant消息返回。 - 书生大模型支持多轮对话吗?最大上下文是多少?
支持,当前线上版本最大上下文为200K token(约15-20万个汉字),足以处理长文档或长时间对话。 - 如果我想要更高的并发和更低的延迟,有什么推荐方案?
可以考虑购买书生的企业版,支持独立部署和负载均衡;或者使用阿里云ModelScope上的书生模型服务(与官方API互通但计费不同)。
内容由 AI 生成,产品信息请以官网为准。










