新知榜官方账号
2023-10-09 03:00:22
美国人工智能研究公司OpenAI宣布,其AI聊天机器人工具ChatGPT现在可以“看、听、说”,这暗指这款广受欢迎的聊天机器人可以同时接收图像和语音输入,并通过语音进行回复。ChatGPT是OpenAI于2022年11月30日推出的一种新型AI聊天机器人工具,可根据用户的要求快速生成文章、故事、歌词、散文、笑话,甚至代码,并回答各类疑问。
当地时间周一,OpenAI表示,将开始在ChatGPT中推出新的语音和图像功能,新功能将于未来两周内面向Plus和企业用户推出。该公司表示,新功能允许用户进行语音对话或向ChatGPT展示其正在谈论的内容。其中,语音功能将在iOS和Android平台上推出,而图像功能将在所有平台上推出。不过,该公司将逐步部署语音和图像功能。
在语音方面,新功能允许用户进行语音对话,提供更直观的交互方式。该功能由一个新的文本转语音模型提供支持,能够通过文本和几秒钟的语音样本生成类似人类的音频,且与专业配音演员合作,提供5种可供用户自行选择的声音。此外,该功能还能使用开源语音识别系统Whisper,将用户说的话转录成文本。外媒报道称,语音输入和输出功能使ChatGPT具有与亚马逊Alexa等语音助手相同的功能。
在图像方面,新功能允许用户上传图像与ChatGPT交互,且支持上传多张图像。如果要聚焦图像的特定部分,可以使用移动应用中的绘图工具。OpenAI表示,图像理解由多模态GPT-3.5和GPT-4提供支持。这些模型将语言推理能力应用于各种图像,如照片、屏幕截图以及包含文字和图像的文档。据悉,GPT-4是OpenAI在今年3月14日推出的最新一代大型语言模型。它是一个多模态大型语言模型,支持图像和文本输入,以文本形式输出;扩写能力增强,能处理超过25000个单词的文本;更具创造力,并且能够处理更细微的指令。
相关工具
相关文章
推荐
用Deepseek写AI绘图提示词,像呼吸一样简单!
2025-02-19 16:12
你以为AI绘画是黑科技?其实早成了“路边摊生意”!
2025-02-19 10:15
Flux爆火,全网最全面最详细的Flux使用教程!
2025-02-18 14:19
用AI如何创作音乐,实战教学来啦!
2025-02-17 17:23
MidJourney让你秒变绘画大神,从零开始画哪吒!
2025-02-17 14:56
AI应用新境界:让人工智能成为你的得力助手
2025-02-14 15:45
AI短片革命:当创作遇上智能,人人都能成为导演
2025-02-14 14:53
AI狂潮下的人类职场:是失业危机还是进化契机?
2025-02-13 16:53
开启影视创作新纪元,效率提升 10 倍的神器来了!
2025-02-13 15:11
深度解析DeepSeek:当AI技术照进创作产业的未来
2025-02-12 17:16