产品更新

ChatGPT语音模式重大更新:用户可自由选择GPT-5.6 Sol和GPT-6 Astra模型

2026年9月10日,OpenAI语音产品负责人Atty Eleti宣布,ChatGPT语音模式(ChatGPT Voice)迎来重大更新——用户现在可以自由选择所需的模型以及推理深度。Pro套餐用户可在GPT-5.6 Sol和GPT-6 Astra之间选择,根据任务复杂度调整AI的推理能力。在需要执行网络搜索或复杂推理时,语音模式将自动调用用户指定的模型来完成任务。

这一更新标志着语音AI从"单一模型固定调用"进化到"多模型智能选择"的新阶段。此前,语音助手通常使用固定的模型——无论用户问什么问题,底层模型都是同一个。而现在,ChatGPT Voice允许用户为不同场景选择不同模型:简单对话用轻量模型(速度快、成本低),复杂推理用旗舰模型(GPT-6 Astra,能力强但速度慢、成本高)。这种"按需选模"的模式类似于云计算中的"弹性伸缩"——根据实际需求动态分配计算资源。

推理深度控制是另一项重要功能。用户不仅可以选择模型,还可以调整推理深度——即AI在回答前"思考"多少。浅层推理适合快速问答(如天气查询),深层推理适合复杂问题(如数学推导或代码分析)。这种设计将ChatGPT的"思维链推理"能力从文本扩展到语音——AI可以先"深度思考"再"开口说话",而非即时给出可能不够准确的回答。

这一更新的战略意义在于推动语音与多模态能力的深度融合。结合近期ChatGPT Images 2.5(图像生成)和ChatGPT Live(实时视频交互)的发布,OpenAI正在构建一个多模态AI平台——语音、图像、视频、文本统一在一个交互框架中。用户可以通过语音要求AI分析图像、搜索网络、执行复杂推理,AI根据任务自动选择最合适的模型和能力。这种"多模态+多模型+推理深度控制"的组合可能成为AI交互的新标准——不再是一个模型做所有事,而是根据任务特征动态调度多个模型和能力。对于竞争对手(如Google Gemini、Anthropic Claude)而言,这意味着语音AI的竞争门槛已大幅提高——单一模型的语音助手已无法满足用户需求。

← 返回AI热点列表