【抢先体验】开通使用 ChatGPT 语音版功能保姆级教程-CSDN博客

阿里云国内75折 回扣 微信号:monov8
阿里云国际,腾讯云国际,低至75折。AWS 93折 免费开户实名账号 代冲值 优惠多多 微信号:monov8 飞机:@monov6

image.png
大家好我是苍何一个土木转码的非典型程序员也是一名技术管理者同时也是 AI 应用的探索者。今天在视频号上看到和 ChatGPT 语音对话的视频其声音的真实感太让人震撼了于是也想去抢先体验一下 ChatGPT 语音版功能

网上搜索了许久没找到相关实用教程且很难找到语音版的入口。据 OpenAI 官方消息在接下来的两周内将向 Plus 和企业用户推出语音功能。那我们如何抢先体验该功能呢

OpenAI官方对语音版的说明

本文将分享如何抢先体验 ChatGPT 语音版并详细讲解使用指南。

一、什么是 ChatGPT 语音版

2023年9月25日 OpenAI 推出多模态功能即 ChatGPT 将支持语音和图像。新的语音功能由新的文本到语音模型提供支持该模型能够仅通过文本和几秒钟的示例语音生成类似人类的音频。OpenAI 与专业配音演员合作创作了每个声音。还使用开源语音识别系统 Whisper 将口语转录为文本。

**ChatGPT 语音版说白了就是能直接通过语音和 ChatGPT 进行对话**让人震惊的是其声音的真实感和回答的逻辑性一度逼近贾维斯的感觉。

OpenAI 关于语音版公告

二、如何开通使用 ChatGPT 语音版

由于此功能现在还属于内侧阶段仅部分用户能体验到我这里说的是我亲测有效的方法前提需要安卓手机。大体流程是安卓手机安装 Google Play申请加入 Beta 测试下载 ChatGPT Beta 版本开通 plus 账号打开语音入口。
以下是流程图。

2.1、申请加入 Beta 测试

这是最关键的一步就是目前从应用商店下载的都是稳定版很多未受邀请用户暂时无法体验那我们需要申请加入 Beta 测试才可抢先体验该功能。这里以安卓的 Google Play 为例演示如何加入 Beta 测试。

申请加入 Beta 测试

账号申请 Beta 测试需要几分钟加入成功后我们就可以看到如上图提示这个时候我们直接下载测试版本。一般而言测试版本非稳定版本但确是最新版本也是我们抢先体验功能的基础。

2.2、开通 plus 账号

目前仅有 plus 账号才可抢先体验所以需要开通。如何开通 plus 相信大家都已经会了这里不赘述但值得注意的是由于 OpenAI 的封控策略一定要注意尽量不要在 web 端开通以及尽量保证网络的「清洁」。

2.3、开通语音入口

打开设置
设置页面
点击 Beta Features

点击 Beta Features

开启 Voice conversations

开启 Voice conversations

注意这里的 Browse with Bing 是 ChatGPT 的联网功能我们以前需要通过插件联网现在直接打开这个开关即可联网了。

点击主页图标

点击主页图标

开启语音对话

开启语音对话

查看对话历史

查看对话历史
我们每进行的一轮语音对话均会以文本的形式进行对话展示方便随时进行查看。

三、ChatGPT 语音版使用指南

3.1、哪些用户可以进行语音对话

Plus 和 ChatGPT 企业计划的所有用户。其中 ChatGPT 企业计划管理员可以在管理工作区设置中为其用户切换可用性。预计一周之后会慢慢开放。

3.2、哪些应用程序可以进行语音对话

语音对话可在适用于 iOS 和 Android 的 ChatGPT 移动应用程序上进行。

3.3、有多少个语音选项

ChatGPT 从五种逼真的输出声音中进行选择每种声音都有自己独特的音调和字符。可以通过 Setttings-Speech-Voice 进行声音选择。个人试验看 Breeze 对中文支持性更好。

语音设置

五种声音类型

3.4、我可以在语音对话中使用哪些模型

GPT 3.5 和GPT 4 可用于语音对话。
请记住对于Plus用户GPT-4 每 3 小时有50条消息的上限。对于企业计划上的用户没有消息上限。

3.5、我可以为语音对话设置音量限制吗

在 ChatGPT 中语音对话没有音量限制。音量将在设备本身上设置。

3.6、我可以在同一对话中使用ChatGPT视觉功能和语音对话吗

可以使用视觉功能在聊天中启动语音对话就像可以使用 GPT 3.5 或 GPT 4 在对话中启动语音对话一样。

3.7、为什么需要打开聊天记录和培训才能使用语音对话

聊天记录和来自数据控件的培训必须切换以便能够进行语音对话以便可以查看对话的笔录。

主要是使用数据来提高模型性能以何使用内容 (包括语音聊天的转录) 来改善服务和选择。

3.8、语音对话会不会保存音频

在测试版期间来自语音对话的音频片段不会保存。ChatGPT 将音频片段发送到 Whisper API 以转录它们但处理后不会保留它们。

要找到历史对话可以在 ChatGPT 对话历史中找到语音对话中的文本转录。

3.9、语音对话是免提的吗

一旦你进入语音对话它是免提的直到你退出语音对话。相信以后会慢慢开放更多功能
有手动控件可暂停继续和退出语音对话。

3.10、语音对话使用

开始对话
要开始语音对话需要点击耳机图标。建立连接后ChatGPT 将听你讲话。
开启对话

暂停语音对话
暂停语音对话
中断语音对话
当ChatGPT正在说话时您可以点击以中断:
中断

或者你可以点击停止图标
停止图标
恢复语音对话
点击恢复图标然后重新开始
恢复语音对话
取消语音对话的静音
点击取消静音。
点击取消静音
退出语音对话
要退出语音模式请点击 X 图标以结束语音对话并返回到使用 ChatGPT 的基于文本的对话。
退出语音对话

3.11、可以让语音对话暂停多久

没有限制理论上可以无限时间暂停。

3.12、 收到 “对不起我不能帮忙” 的回复是什么原因

这是由于 ChatGPT 的安全措施造成的。如果提示符合可以通过聊天中的“竖起大拇指/竖起大拇指” 选项向 ChatGPT 发送反馈。

四、总结

想象一下当语音对话支持 API我们可以把他集成到手机虽然现在的 sari 也能如此但还不够智能放到人型机器人上那不就是现实版的贾维斯吗相信这一天不远了。拥抱 AI 才是普通人的破局之道。

全文完你的点赞是对苍何创作最大鼓励


苍何个人介绍.png

创作不易如果本文对你有帮助欢迎点赞、收藏加关注你的支持和鼓励是我创作的最大动力。
文章最下方关注图片.gif

阿里云国内75折 回扣 微信号:monov8
阿里云国际,腾讯云国际,低至75折。AWS 93折 免费开户实名账号 代冲值 优惠多多 微信号:monov8 飞机:@monov6
标签: ChatGPT