2024 年最新 Python 调用 OpenAI 实现问答、图像合成、语音合成等功能详细教程
环境安装最先要保证您的计算机之上早已安裝了。您能够从 官方网站去开展下载同时开展安裝到最新版。在开展安裝的这一情况下, 请保证勾选表示 “Add to PATH” 这就是添加环境变量的这一选项, 达到才可以在 cmd 命令行之中直接去使用。安装 库打开命令行或终端窗口安装 库pip install openai教程平台官网http API 调用方式文档文本生成 GPT-4GPT-4 模型概述GPT - 4是个大型多模态模型, 能接受文本或图像输入并输出文本, 因其具备更广泛的一般知识以及先进推理能力, 所以它能解决难题且比以往任何模型都更准确。付费客户可于API中使用GPT - 4。和gpt - 3.5 turbo一样, GPT - 4针对聊天功能优化一番, 而且在使用聊天完井API的传统完井任务里也表现出色。需在我们的文本生成指南中学习怎样去使用GPT - 4。测试案例用以输入的是消息列表, 由聊天模型来进行处理, 输出的则是模型所生成的消息。聊天格式的设计目的在于让多回合对话更为简便, 然而, 对于不存在任何对话的单回合任务而言, 它同样具备实用性。一个聊天完成API调用的例子如下:from openai import OpenAI client OpenAI() response client.chat.completions.create( modelgpt-4, messages[ { role: system, content: You are a helpful assistant.}, { role: user, content: Who won the world series in 2020?}, { role: assistant, content: The Los Angeles Dodgers won the World Series in 2020.}, { role: user, content: Where was it played?} ] ) print(response)数据结构{ choices: [ { finish_reason: stop, index: 0, message: { content: The 2020 World Series was played in Texas at Globe Life Field in Arlington., role: assistant }, logprobs: null } ], created: 1677664795, id: chatcmpl-7QyqpwdfhqwajicIEznoc6Q47XAyW, model: gpt-3.5-turbo-0613, object: chat.completion, usage: { completion_tokens: 17, prompt_tokens: 57, total_tokens: 74 } }图像合成 DALL·EDALL·E 模型概述有着能凭借自然语言描述来创作出逼真之图像与艺术的人工智能系统DALL·E, DALL·e2支持去编辑现有的那种映像, 或者用以创建由用户所提供映像的变体, 而DALL·e3目前具备依据提示来创建拥有特定大小的全新映像这样的功能。测试案例能让您于给定文本提示情形下创建原始图像的是图像生成端点, 在使用DALL·e3时,图像大小存在多种规格, 其大小可以是1024×1024像素, 也可以是1024×1792像素, 还可以是1792×1024像素。默认情形下, 图像借助标准质量予以生成, 然而当运用DALL·e3之际, 可以将质量设定为“hd”用以强化细节。图像呈正方形、具备标准质量, 是生成速度最为快捷的。能够运用DALL·e3一次请求一幅图像, 通过并行请求获取更多, 或者借助带n参数的DALL·e2一次最多请求十幅图像。from openai import OpenAI client OpenAI() response client.images.generate( modeldall-e-3, prompta white siamese cat, size1024x1024, qualitystandard, n1, ) image_url response.data[0].url语音合成 TTSTTS 模型概述能够把文本转变成具有自然发音的口语文本的人工智能模型是TTS, 我们给出了两种不一样的模型变量, 针对实时文本到语音的用例做了优化的是ts - 1, 针对质量做了优化的是ts - 1 - hd, 这些模型能和Audio API里的端点一同予以使用。测试案例语音端点接收三个关键输入, 其中一个是模型, 另一个是应该转换为音频的文本, 还有一个是用于音频生成的语音。简单的请求如下所示:from pathlib import Path from openai import OpenAI client OpenAI() speech_file_path Path(__file__).parent / speech.mp3 response client.audio.speech.create( modeltts-1, voicealloy, inputToday is a wonderful day to build something people love! ) response.stream_to_file(speech_file_path)音色选择去尝试各种各样不同的声音, 像是合金、回声、寓言、缟玛瑙、新星等等, 从中寻找到那一种契合你自身所想要达成的特定语气以及目标听众状况的东西。而当下所呈现出来的这种既定声音, 是专门针对英语这一语言进行优化处理的。语音识别概述它是一个通用的语音识别模型, 是在不同音频的大型数据集上给予训练的那个, 也是一个能够执行多语言语音识别以及语音翻译等等还有语言识别的多任务模型, v2大型模型目前借助我们的API可用于 -1模型名称。当前, 开源的那个版本跟借助我们的API所给出的版本之间不存在差异。可是, 经由我们的API, 我们给出了一个经过优化的推理进程, 这致使借助我们的API去运行之际比对其进行执行要快出许多。测试案例语音识别API把将要去识别的音频文件当作输入, 还把所需的音频转录输出文件格式当作输入。我们当前支持多种输入文件格式, 也支持多种输出文件格式。文件上传目前限定为25mb了支持mp3、mp4、mpeg、mpga、m4a、wav、webm等文件类型的输入。from openai import OpenAI client OpenAI() audio_file open(/path/to/file/audio.mp3, rb) transcription client.audio.transcriptions.create( modelwhisper-1, fileaudio_file ) print(transcription.text)数据结构{ text: Imagine the wildest idea that youve ever had, and youre curious about how it might scale to something thats a 100, a 1,000 times bigger. .... }配置观察 class () 这个类所实现的源码片段, 从中能发现, 对于 以及 而言, 它们会去读取本地环境变量之中的 和 变量。if api_key is None: api_key os.environ.get(OPENAI_API_KEY) if api_key is None: raise OpenAIError( The api_key client option must be set either by passing api_key to the client or by setting the OPENAI_API_KEY environment variable ) self.api_key api_keyif base_url is None: base_url os.environ.get(OPENAI_BASE_URL) if base_url is None: base_url fhttps://api.openai.com/v1加载 .env 环境变量设有一个库, 尽管它也适用于别的编程语言, 这个库的主要作用是, 从.env文件里读取环境变量, 并且把这些变量加载到操作系统的环境变量之中, 从而让应用程序能够轻易地访问这些变量。.env文件是一种纯文本文件, 其里面包含着键值对, 每一个键值对都占据一行, 格式是KEYVALUE。pip install python-dotenv存储敏感信息, 像API密钥、数据库密码等, 于环境变量里, 而非硬编码于代码中, 这是一种良好的安全实践。如此做能减少敏感信息泄露的风险, 因这些值并不存储在代码库内, 也不在部署时暴露出来。于代码里头, 运用 - 库去加载 .env 文件, 进而访问其中存在的环境变量了, 这一般是经由 from 以及 () 函数达成的, 访问环境变量: 在加载.env文件之后, 能够借助 os.(KEY) 的形式去访问环境变量。from dotenv import load_dotenv load_dotenv()图像理解 GPT-4oGPT – 40具备视觉功能, GPT-4 Turbo也具备视觉功能, 这表明这些模型能够接收图像还能回答跟图像相关的问题。在历史方面, 语言模型系统一直受限于那种单一输入形式的文本。模型使用图像主要有两种方式, 一种是传递到图像的链接, 另一种是在请求中直接传递编码的图像, 图像呢可以在用户消息里传递。from openai import OpenAI client OpenAI() response client.chat.completions.create( modelgpt-4o, messages[ { role: user, content: [ { type: text, text: What’s in this image?}, { type: image_url, image_url: { url: https://upload.wikimedia.org/wikipedia/commons/thumb/d/dd/Gfp-wisconsin-madison-the-nature-boardwalk.jpg/2560px-Gfp-wisconsin-madison-the-nature-boardwalk.jpg, }, }, ], } ], max_tokens300, ) print(response.choices[0])若你于本地存有一张或者一组图像, 那么你能够把它们透过编码的形式传送给模型, 下面呈现着一个实际的例子, 即上传编码的这般图像。import base64 import requests api_key YOUR_OPENAI_API_KEY def encode_image(image_path): with open(image_path, rb) as image_file: return base64.b64encode(image_file.read()).decode(utf-8) image_path path_to_your_image.jpg base64_image encode_image(image_path) headers { Content-Type: application/json, Authorization: fBearer { api_key} } payload { model: gpt-4o, messages: [ { role: user, content: [ { type: text, text: What’s in this image? }, { type: image_url, image_url: { url: fdata:image/jpeg;base64,{ base64_image} } } ] } ], max_tokens: 300 } response requests.post(https://api.openai.com/v1/chat/completions, headersheaders, jsonpayload) print(response.json())

相关新闻

Python包管理工具深度测评:uv、pip、conda全面对比与选型指南

Python包管理工具深度测评:uv、pip、conda全面对比与选型指南

一、引言:从"依赖地狱"到高效开发——包管理工具进化史 于开发进程里, 依赖管理可称作“基础设施建设”, 自早期pip独自应对, 至conda带来跨语言管理的巨大冲击, 再到uv凭借Rust对工具链进行高性能重构, 每一回变革皆在重塑开发体验。本文会从技术实现、…

2026/8/18 11:14:23 阅读更多 →
Python学习路径及练手项目合集

Python学习路径及练手项目合集

这个系列的技术路径里, 有入门知识模块, 有基础模块, 有Web框架模块, 有基础项目模块, 有网络编程模块, 有数据与计算模块, 还有综合项目模块这七个部分。路径当中的教程, 会引领你逐步深入进去, 让你学会怎样通过其去实现一个博客, 或者一个桌面词典, 又或者一个微信机器人, 再…

2026/8/18 11:14:23 阅读更多 →
前方高能!如何保障Python应用的高性能

前方高能!如何保障Python应用的高性能

有这样一种语言, 它推崇“简单、优雅、明确”, 属于面向对象类型, 它凭借简捷明了的语法结构, 富有丰富的类库, 具备出色的易用性特点, 在互联网时代被广泛加以应用, 不管是国外的一些网站, 还是国内像知乎、豆瓣之类的平台, 用它所开发的Web应用到处都能见到。 随着云计算时代…

2026/8/18 11:14:23 阅读更多 →

最新新闻

2026精选AI视频总结工具,支持B站/播客链接解析、自动生成思维导图

2026精选AI视频总结工具,支持B站/播客链接解析、自动生成思维导图

以前我刷视频是这样的:看到一个不错的教程,先收藏,然后就没有然后了。收藏夹里躺了几百个视频,真正消化的没几个。 后来我试了一圈AI视频总结工具,发现能不能把视频内容变成可用的笔记才是关键。很多工具打着AI视频总结…

2026/8/18 11:45:50 阅读更多 →
GLM 5.3 集成 VSCode 实战:从 API 调用到自动化代码审查

GLM 5.3 集成 VSCode 实战:从 API 调用到自动化代码审查

GLM 5.3 的发布,标志着国产大模型在技术成熟度、工程可用性和开发者友好性上进入了一个新阶段。对于长期关注 AI 技术发展的开发者和技术决策者而言,GLM 系列模型的表现已经从一个“令人惊喜的追赶者”,转变为“值得信赖的稳定选项”。这种转…

2026/8/18 11:45:50 阅读更多 →
DeepSeek Harness 入门教程

DeepSeek Harness 入门教程

2026年8月13日,DeepSeek 正式推出其首款 Agent 产品 —— DeepSeek Harness v0.1 开发者预览版,并同步以 MIT 协议在 GitHub 开源。官方给出了一个简洁的定义:Model Harness Agent。模型负责理解与推理,Harness 负责将模型能力落…

2026/8/18 11:45:50 阅读更多 →
Switch 大气层系统从零到上手:一篇讲透安装、emuMMC 与日常维护的保姆级指南

Switch 大气层系统从零到上手:一篇讲透安装、emuMMC 与日常维护的保姆级指南

Switch 大气层系统从零到上手:一篇讲透安装、emuMMC 与日常维护的保姆级指南 【免费下载链接】Atmosphere-stable 大气层整合包系统稳定版 项目地址: https://gitcode.com/gh_mirrors/at/Atmosphere-stable 晚上十点,你刷到一条朋友圈&#xff1a…

2026/8/18 11:45:50 阅读更多 →
一份配置搞定抖音批量下载与内容管理:douyin-downloader 使用全指南

一份配置搞定抖音批量下载与内容管理:douyin-downloader 使用全指南

一份配置搞定抖音批量下载与内容管理:douyin-downloader 使用全指南 【免费下载链接】douyin-downloader A practical Douyin downloader for both single-item and profile batch downloads, with progress display, retries, SQLite deduplication, and browser f…

2026/8/18 11:45:50 阅读更多 →
详解AUTOSAR:StbM时间基准、速率校正与多分区同步机制(拓展篇—20)

详解AUTOSAR:StbM时间基准、速率校正与多分区同步机制(拓展篇—20)

StbM_GetCurrentTime() 返回 E_OK,应用却在几十微秒后才使用结果;一次新 Global Time 已经到达,TIMELEAP_PAST 仍保持;GPT 中断按时触发,客户 Runnable 却晚了一个任务周期才运行;多核系统中 Slave Time Base 被映射到一个分区,另一个分区的 SWC 又从本地 StbM Service …

2026/8/18 11:44:49 阅读更多 →

日新闻

告别逐帧截图:用 extract-video-ppt 快速提取视频中的 PPT 并一键导出 PDF

告别逐帧截图:用 extract-video-ppt 快速提取视频中的 PPT 并一键导出 PDF

告别逐帧截图:用 extract-video-ppt 快速提取视频中的 PPT 并一键导出 PDF 【免费下载链接】extract-video-ppt extract the ppt in the video 项目地址: https://gitcode.com/gh_mirrors/ex/extract-video-ppt 如果你还停留在"看网课 不停暂停 截图 …

2026/8/18 0:00:57 阅读更多 →
思源宋体TTF一站式上手:7个字重免费商用,从下载到上线的完整走查

思源宋体TTF一站式上手:7个字重免费商用,从下载到上线的完整走查

思源宋体TTF一站式上手:7个字重免费商用,从下载到上线的完整走查 【免费下载链接】source-han-serif-ttf Source Han Serif TTF 项目地址: https://gitcode.com/gh_mirrors/so/source-han-serif-ttf 你是不是也经历过这种时刻:设计稿里…

2026/8/18 0:00:58 阅读更多 →
华硕笔记本控制权回收指南:GHelper 如何用一个 10MB 文件替代 Armoury Crate

华硕笔记本控制权回收指南:GHelper 如何用一个 10MB 文件替代 Armoury Crate

华硕笔记本控制权回收指南:GHelper 如何用一个 10MB 文件替代 Armoury Crate 【免费下载链接】g-helper Lightweight Armoury Crate alternative for Asus laptops with nearly the same functionality. Works with ROG Zephyrus, Flow, TUF, Strix, Scar, ProArt, …

2026/8/18 0:00:59 阅读更多 →

周新闻

基于阿里云与通义千问(Qwen)构建AI应用:从模型调用到生产部署的完整实践指南

基于阿里云与通义千问(Qwen)构建AI应用:从模型调用到生产部署的完整实践指南

如果你是一名开发者,最近可能已经感受到了AI大模型正在从“玩具”变成“生产力工具”的强烈信号。从代码补全到智能Agent,从本地部署到云端API,我们正处在一个技术栈快速重构的节点。然而,面对层出不穷的模型、框架和工具&#xf…

2026/8/18 9:15:35 阅读更多 →
工业通信系统底层逻辑:04 反射——高频能量撞墙之后会发生什么?

工业通信系统底层逻辑:04 反射——高频能量撞墙之后会发生什么?

第四篇:反射——高频能量撞墙之后会发生什么? —— 你以为信号已经过去了,其实它正在回来打你 老Q的现场笔记 第五季,我们正式进入工业神经系统层。这里不再是单个设备的战斗,而是整个工厂“经脉”层面的秩序之战。从这一篇开始,你将第一次看清:看似简单的信号传播,背…

2026/8/18 9:06:28 阅读更多 →
【文章复现】非线性值迭代自适应动态规划(ADP):离散时间非线性系统的策略迭代自适应动态规划算法研究附Matlab代码

【文章复现】非线性值迭代自适应动态规划(ADP):离散时间非线性系统的策略迭代自适应动态规划算法研究附Matlab代码

✅作者简介:热爱科研的Matlab仿真开发者,擅长毕业设计辅导、数学建模、数据处理、建模仿真、程序设计、完整代码获取、论文复现及科研仿真。🍎 往期回顾关注个人主页:Matlab科研工作室👇 关注我领取海量matlab电子书和…

2026/8/18 9:04:56 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/17 18:54:37 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/17 18:55:16 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/17 18:55:55 阅读更多 →