【抢先体验】开通使用 ChatGPT 语音版功能保姆级教程

2023-10-05 19:04

本文主要是介绍【抢先体验】开通使用 ChatGPT 语音版功能保姆级教程,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

image.png
大家好,我是苍何,一个土木转码的非典型程序员,也是一名技术管理者,同时也是 AI 应用的探索者。今天在视频号上看到和 ChatGPT 语音对话的视频,其声音的真实感太让人震撼了,于是也想去抢先体验一下 ChatGPT 语音版功能

网上搜索了许久,没找到相关实用教程,且很难找到语音版的入口。据 OpenAI 官方消息,在接下来的两周内,将向 Plus 和企业用户推出语音功能。那我们如何抢先体验该功能呢?

OpenAI官方对语音版的说明

本文将分享如何抢先体验 ChatGPT 语音版,并详细讲解使用指南。

一、什么是 ChatGPT 语音版

2023年9月25日 OpenAI 推出多模态功能,即 ChatGPT 将支持语音和图像。新的语音功能由新的文本到语音模型提供支持,该模型能够仅通过文本和几秒钟的示例语音生成类似人类的音频。OpenAI 与专业配音演员合作创作了每个声音。还使用开源语音识别系统 Whisper 将口语转录为文本。

**ChatGPT 语音版说白了就是能直接通过语音和 ChatGPT 进行对话,**让人震惊的是其声音的真实感和回答的逻辑性一度逼近贾维斯的感觉。

OpenAI 关于语音版公告

二、如何开通使用 ChatGPT 语音版

由于此功能现在还属于内侧阶段,仅部分用户能体验到,我这里说的是我亲测有效的方法(前提需要安卓手机)。大体流程是:安卓手机安装 Google Play,申请加入 Beta 测试,下载 ChatGPT Beta 版本,开通 plus 账号,打开语音入口。
以下是流程图。

2.1、申请加入 Beta 测试

这是最关键的一步,就是目前从应用商店下载的都是稳定版,很多未受邀请用户暂时无法体验,那我们需要申请加入 Beta 测试才可抢先体验该功能。这里以安卓的 Google Play 为例,演示如何加入 Beta 测试。

申请加入 Beta 测试

账号申请 Beta 测试需要几分钟,加入成功后我们就可以看到如上图提示,这个时候我们直接下载测试版本。一般而言,测试版本非稳定版本,但确是最新版本,也是我们抢先体验功能的基础。

2.2、开通 plus 账号

目前仅有 plus 账号才可抢先体验,所以需要开通。如何开通 plus 相信大家都已经会了,这里不赘述,但值得注意的是,由于 OpenAI 的封控策略,一定要注意尽量不要在 web 端开通以及尽量保证网络的「清洁」。

2.3、开通语音入口

打开设置
设置页面
点击 Beta Features

点击 Beta Features

开启 Voice conversations

开启 Voice conversations

注意:这里的 Browse with Bing 是 ChatGPT 的联网功能,我们以前需要通过插件联网,现在直接打开这个开关即可联网了。

点击主页图标

点击主页图标

开启语音对话

开启语音对话

查看对话历史

查看对话历史
我们每进行的一轮语音对话,均会以文本的形式进行对话展示,方便随时进行查看。

三、ChatGPT 语音版使用指南

3.1、哪些用户可以进行语音对话?

Plus 和 ChatGPT 企业计划的所有用户。其中 ChatGPT 企业计划管理员可以在管理工作区设置中为其用户切换可用性。预计一周之后会慢慢开放。

3.2、哪些应用程序可以进行语音对话?

语音对话可在适用于 iOS 和 Android 的 ChatGPT 移动应用程序上进行。

3.3、有多少个语音选项?

ChatGPT 从五种逼真的输出声音中进行选择,每种声音都有自己独特的音调和字符。可以通过 Setttings-Speech-Voice 进行声音选择。个人试验看 Breeze 对中文支持性更好。

语音设置

五种声音类型

3.4、我可以在语音对话中使用哪些模型?

GPT 3.5 和GPT 4 可用于语音对话。
请记住,对于Plus用户,GPT-4 每 3 小时有50条消息的上限。对于企业计划上的用户,没有消息上限。

3.5、我可以为语音对话设置音量限制吗?

在 ChatGPT 中,语音对话没有音量限制。音量将在设备本身上设置。

3.6、我可以在同一对话中使用ChatGPT视觉功能和语音对话吗?

可以使用视觉功能在聊天中启动语音对话,就像可以使用 GPT 3.5 或 GPT 4 在对话中启动语音对话一样。

3.7、为什么需要打开聊天记录和培训才能使用语音对话?

聊天记录和来自数据控件的培训必须切换,以便能够进行语音对话,以便可以查看对话的笔录。

主要是使用数据来提高模型性能,以何使用内容 (包括语音聊天的转录) 来改善服务和选择。

3.8、语音对话会不会保存音频

在测试版期间,来自语音对话的音频片段不会保存。ChatGPT 将音频片段发送到 Whisper API 以转录它们,但处理后不会保留它们。

要找到历史对话,可以在 ChatGPT 对话历史中找到语音对话中的文本转录。

3.9、语音对话是免提的吗?

一旦你进入语音对话,它是免提的,直到你退出语音对话。(相信以后会慢慢开放更多功能)
有手动控件,可暂停,继续和退出语音对话。

3.10、语音对话使用

开始对话:
要开始语音对话,需要点击耳机图标。建立连接后,ChatGPT 将听你讲话。
开启对话

暂停语音对话:
暂停语音对话
中断语音对话:
当ChatGPT正在说话时,您可以点击以中断:
中断

或者你可以点击停止图标:
停止图标
恢复语音对话:
点击恢复图标,然后重新开始
恢复语音对话
取消语音对话的静音:
点击取消静音。
点击取消静音
退出语音对话:
要退出语音模式,请点击 X 图标以结束语音对话,并返回到使用 ChatGPT 的基于文本的对话。
退出语音对话

3.11、可以让语音对话暂停多久?

没有限制,理论上可以无限时间暂停。

3.12、 收到 “对不起,我不能帮忙” 的回复是什么原因?

这是由于 ChatGPT 的安全措施造成的。如果提示符合,可以通过聊天中的“竖起大拇指/竖起大拇指” 选项向 ChatGPT 发送反馈。

四、总结

想象一下,当语音对话支持 API,我们可以把他集成到手机(虽然现在的 sari 也能如此,但还不够智能),放到人型机器人上,那不就是现实版的贾维斯吗?相信这一天不远了。拥抱 AI 才是普通人的破局之道。

全文完,你的点赞是对苍何创作最大鼓励\(^ ^)/


苍何个人介绍.png

创作不易,如果本文对你有帮助,欢迎点赞、收藏加关注,你的支持和鼓励,是我创作的最大动力。
文章最下方关注图片.gif

这篇关于【抢先体验】开通使用 ChatGPT 语音版功能保姆级教程的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!



http://www.chinasem.cn/article/151863

相关文章

setsid 命令工作原理和使用案例介绍

《setsid命令工作原理和使用案例介绍》setsid命令在Linux中创建独立会话,使进程脱离终端运行,适用于守护进程和后台任务,通过重定向输出和确保权限,可有效管理长时间运行的进程,本文给大家介... 目录setsid 命令介绍和使用案例基本介绍基本语法主要特点命令参数使用案例1. 在后台运行命令2.

使用Redis快速实现共享Session登录的详细步骤

《使用Redis快速实现共享Session登录的详细步骤》在Web开发中,Session通常用于存储用户的会话信息,允许用户在多个页面之间保持登录状态,Redis是一个开源的高性能键值数据库,广泛用于... 目录前言实现原理:步骤:使用Redis实现共享Session登录1. 引入Redis依赖2. 配置R

使用Python的requests库调用API接口的详细步骤

《使用Python的requests库调用API接口的详细步骤》使用Python的requests库调用API接口是开发中最常用的方式之一,它简化了HTTP请求的处理流程,以下是详细步骤和实战示例,涵... 目录一、准备工作:安装 requests 库二、基本调用流程(以 RESTful API 为例)1.

使用Python开发一个Ditto剪贴板数据导出工具

《使用Python开发一个Ditto剪贴板数据导出工具》在日常工作中,我们经常需要处理大量的剪贴板数据,下面将介绍如何使用Python的wxPython库开发一个图形化工具,实现从Ditto数据库中读... 目录前言运行结果项目需求分析技术选型核心功能实现1. Ditto数据库结构分析2. 数据库自动定位3

Python yield与yield from的简单使用方式

《Pythonyield与yieldfrom的简单使用方式》生成器通过yield定义,可在处理I/O时暂停执行并返回部分结果,待其他任务完成后继续,yieldfrom用于将一个生成器的值传递给另一... 目录python yield与yield from的使用代码结构总结Python yield与yield

Go语言使用select监听多个channel的示例详解

《Go语言使用select监听多个channel的示例详解》本文将聚焦Go并发中的一个强力工具,select,这篇文章将通过实际案例学习如何优雅地监听多个Channel,实现多任务处理、超时控制和非阻... 目录一、前言:为什么要使用select二、实战目标三、案例代码:监听两个任务结果和超时四、运行示例五

python使用Akshare与Streamlit实现股票估值分析教程(图文代码)

《python使用Akshare与Streamlit实现股票估值分析教程(图文代码)》入职测试中的一道题,要求:从Akshare下载某一个股票近十年的财务报表包括,资产负债表,利润表,现金流量表,保存... 目录一、前言二、核心知识点梳理1、Akshare数据获取2、Pandas数据处理3、Matplotl

Java使用Thumbnailator库实现图片处理与压缩功能

《Java使用Thumbnailator库实现图片处理与压缩功能》Thumbnailator是高性能Java图像处理库,支持缩放、旋转、水印添加、裁剪及格式转换,提供易用API和性能优化,适合Web应... 目录1. 图片处理库Thumbnailator介绍2. 基本和指定大小图片缩放功能2.1 图片缩放的

Python pandas库自学超详细教程

《Pythonpandas库自学超详细教程》文章介绍了Pandas库的基本功能、安装方法及核心操作,涵盖数据导入(CSV/Excel等)、数据结构(Series、DataFrame)、数据清洗、转换... 目录一、什么是Pandas库(1)、Pandas 应用(2)、Pandas 功能(3)、数据结构二、安

Python使用Tenacity一行代码实现自动重试详解

《Python使用Tenacity一行代码实现自动重试详解》tenacity是一个专为Python设计的通用重试库,它的核心理念就是用简单、清晰的方式,为任何可能失败的操作添加重试能力,下面我们就来看... 目录一切始于一个简单的 API 调用Tenacity 入门:一行代码实现优雅重试精细控制:让重试按我