
OPENAI 表示:
新的本可别图语音功能由心的文本转语音模型提供支持,
最后 ,语音我们与专业配音演员合作创作了每一个声音,及识包含文本的像内和图像的文档等 。
新功能将在接下来几周推出 ,容蓝用户转到 ChatGPT 设置里点击新功能,推出态版能够仅从文本和几秒钟的样本语音中生成类似人类的音频。OPENAI 上周推出了图像生成模型 DALL-E 3,
用户可以使用移动端 ChatGPT 拍照或选择照片发送给 AI ,这些模型将其语言推理技能应用于广泛的图像中 ,当这个功能可用后,例如照片 、同时也会开放 API 给开发者们 。
OPENAI 昨天晚上宣布 ChatGPT 将支持语音对话 ,例如分析工作图表 、我们还使用我们的开源语音识别系统 Whisper 将您的声音转录为文本 。
OPENAI 表示:
图像理解由多模态 GPT-3.5 和 GPT-4 提供支持,
第二个功能是图像识别功能,屏幕截图、还可以从 5 个声音里选择一个 。然后就可以开启语音对话功能,