全新「美洽AI」上线,聚焦新媒体线索增长,新功能盘点!国产科幻机甲游戏《解限机》定档7月2日公测,登顶Steam国产游戏愿望单榜首文档解析LLM MonkeyOCR震撼登场:3B小模型完胜Gemini从实验室严测到家庭信赖:友望(UWANT)洗地机以技术透明赢得用户深度信任小红书发布首个开源大模型dots.llm1:11.2 万亿非合成数据助力中文性能提升英伟达 CEO 黄仁勋本周访欧,行程覆盖英法德三大国消息称印度计划开发 2nm AI GPU,瞄准 2030 年投入应用微星笔记本RTX50媒体交流会+昆山工厂行回顾:创新+品质服务玩家一场重新定义测评规则的跨界实验 解码友望与知乎携手的清洁行业革新意义Hugging Face发布轻量级开源机器人模型SmolVLA 助力开发者低成本入门高通同意收购半导体 IP 企业 Alphawave,总价约 24 亿美元恩智浦计划关闭多家 8 英寸晶圆厂,转向更高效率 12 英寸制造金砖大赛之元宇宙3D数字内容设计创作赛项·行业大咖谈|积木易搭CTO毛凯:3D数字内容的商业应用与发展传京东大举进军OTA 给出3倍薪资从各知名平台挖人三大运营商上线一键解绑服务!手机号码“二次焕新”到底有多重要?更有质感的iOS26要来了,但AI功能将继续跳票?西班牙Liberux推出NEXX隐私手机:硬件开关+Debian 13系统辅信推出XPC nano NE10N迷你主机:兼顾高效连接与多功能扩展需求江淮汽车 5 月新能源乘用车销量 1132 辆,同比下滑 57.81%奇瑞QQ多米微型车明日上市 预售价5.99万元起
  • 首页 > 云计算频道 > 大模型

    OpenAI升级ChatGPT语音模式,体验更自然对话

    2025年06月09日 15:28:59   来源:AIbase基地

      OpenAI 在去年推出的 GPT-4o 基础上,再次对其高级语音模式进行了重大的更新,使得语音交流变得更加自然和贴近人类的对话方式。这一先进的功能依托于原生的多模态模型,能够快速响应音频输入,最快在232毫秒内作出反应,平均响应时间为320毫秒,几乎与人类的对话速度不相上下。

      在今年年初,OpenAI 已经对这一语音模式进行了小幅更新,改善了打断频率和口音处理。而此次的重大升级,更是使语音回复的语调变得更加细腻、节奏更加自然,尤其是在停顿和强调的处理上,显得更加生动。此外,更新后的系统能够更加精准地表达各种情绪,包括同情和讽刺,使得机器与人类的交流更具人情味。

      更令人兴奋的是,本次更新还增加了翻译功能。ChatGPT 用户只需简单指令,便可让它在对话中进行实时翻译,直到收到停止指令。这一功能的推出,无疑会减少对专门语音翻译应用的需求,进一步提升用户体验。目前,更新后的高级语音模式仅向付费用户开放。

      尽管这一系列的改进显著提升了语音交互的质量,但 OpenAI 也明确指出,当前更新仍存在一些已知的局限性。例如,在某些情况下,音频质量可能会略有下降,音调和语调可能出现意外变化,尤其是在某些语音选项中较为明显。此外,偶尔也会出现与真实对话不符的情况,例如出现广告、胡言乱语或背景音乐的意外声音。OpenAI 表示,他们将继续努力提升音频的一致性,逐步解决这些问题。

      这次升级不仅让 AI 的语音交互体验更加自然,也为人类与人工智能之间的沟通打下了更为坚实的基础。

      文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。

    即时

    新闻

    明火炊具市场:三季度健康属性贯穿全类目

    奥维云网(AVC)推总数据显示,2024年1-9月明火炊具线上零售额94.2亿元,同比增加3.1%,其中抖音渠道表现优异,同比有14%的涨幅,传统电商略有下滑,同比降低2.3%。

    企业IT

    重庆创新公积金应用,“区块链+政务服务”显成效

    “以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。

    3C消费

    华硕ProArt创艺27 Pro PA279CRV显示器,高能实力,创

    华硕ProArt创艺27 Pro PA279CRV显示器,凭借其优秀的性能配置和精准的色彩呈现能力,为您的创作工作带来实质性的帮助,双十一期间低至2799元,性价比很高,简直是创作者们的首选。