拾光记录
218个文档 导航 作者 Gitee
随笔记录4
Hexo博客:基础使用Hexo博客:Next主题Hexo博客:Next进阶使用Hexo博客:Next高级配置
前端知识4
基础知识17
Vue框架19
UniApp14
微信小程序1
Java编程6
Java基础15
SpringBoot31
SpringMVC18
MyBatis9
SpringCloud15
中间件2
数据库4
MySQL13
Redis8
MongoDB10
其他数据库1
Python编程6
Python基础知识Python语法yolo目标检测OpenCV的使用及树莓派平台condauv管理工具
Linux12
Linux常用命令Jar启动脚本VirtualBox安装CentOSVirtualBox安装Ubuntu树莓派安装及使用frp内网穿透ArchLinux:基础系统安装ArchLInux:图形化界面安装ArchLinux:常用软件ArchLinux:深度优化ArchLinux:NiriArchLinux:模块记录
软件工具12
IDEAGitMavenGradleNginx安装Nginx配置JMeter压测OllamaRustFSPicGoVSCodeDocker
创意设计2
Blender:入门知识UI设计基础知识
AI相关9
Claude CodeHermes AgentOpenAI基本使用OpenAI工具调用OpenAI记忆管理OpenAI推理执行OpenAI开发框架Langchainllama.cpp

安装

pip install openai

使用

from openai import OpenAI
from openai.types.chat import ChatCompletionUserMessageParam

OPENAI_BASE_URL = "https://api.deepseek.com"
OPENAI_API_KEY = "sk-xxxx"

client = OpenAI(
    api_key=OPENAI_API_KEY,
    base_url=OPENAI_BASE_URL
)

# 使用明确的类型
messages: list[ChatCompletionUserMessageParam] = [
    {
        "role": "user",
        "content": "你是谁?",
    }
]

completion = client.chat.completions.create(
    model="deepseek-chat",
    messages=messages
)

print(completion.choices[0].message.content)

角色

温度参数

温度可以控制LLM生成文本的创造性和随机性,范围0-2,默认1

completion = client.chat.completions.create(
    model="deepseek-chat",
    messages=messages,
    temperature=0
)

流式

from openai import OpenAI
from openai.types.chat import ChatCompletionUserMessageParam

OPENAI_BASE_URL = "https://api.deepseek.com"
OPENAI_API_KEY = "sk-xxx"

client = OpenAI(
    api_key=OPENAI_API_KEY,
    base_url=OPENAI_BASE_URL
)

# 使用明确的类型
messages: list[ChatCompletionUserMessageParam] = [
    {
        "role": "user",
        "content": "你是谁?",
    }
]

completion = client.chat.completions.create(
    # 模型
    model="deepseek-chat",
    # 消息
    messages=messages,
    # 温度
    temperature=0.5,
    # 流式
    stream=True
)

for chunk in completion:
    # 打印每次增量的内容,不换行
    print(chunk.choices[0].delta.content, end="")

模型测试

# 拉取INT4量化版本(4GB左右显存占用)
ollama pull qwen2.5:7b-instruct-q4_K_M

# 运行
ollama run qwen2.5:7b-instruct-q4_K_M

多模态

ollama run qwen3-vl:2b
安装使用角色温度参数流式模型测试