news 2026/6/15 14:00:24

OpenAI重组团队开发语音AI硬件产品,2026年推出新模型

作者头像

张小明

前端开发工程师

1.2k 24
文章封面图
OpenAI重组团队开发语音AI硬件产品,2026年推出新模型

据The Information报道,开发ChatGPT模型和产品的OpenAI公司计划在2026年第一季度推出新的语音大语言模型,这将是迈向基于语音的物理硬件设备的关键一步。

整合团队资源提升语音技术

引用多位熟悉计划的消息人士(包括现任和前任员工)的话,The Information报道称,OpenAI已经努力将工程、产品和研究等多个团队整合到一个专注于改进音频模型的项目下。公司研究人员认为,目前的音频模型在准确性和速度方面都落后于文本模型。

此外,他们观察到相对较少的ChatGPT用户选择使用语音界面,大多数人更倾向于文本界面。希望通过大幅改进音频模型能够改变用户行为,让用户更多地使用语音界面,从而使模型和产品能够部署在更广泛的设备中,比如汽车。

硬件设备战略布局

OpenAI计划在未来几年推出一系列物理设备,首先是专注于音频的设备。公司内部人士已经讨论了未来设备的各种形式,包括智能扬声器和智能眼镜,但整个产品线的重点都是音频界面而不是基于屏幕的界面。

OpenAI并非独行者。其竞争对手,包括Google、Meta、Amazon等公司,也越来越多地将研发工作转向专注于语音和音频界面的产品和技术,比如Meta在智能眼镜领域的推进。

语音助手技术的新机遇

当然,这并不是首次出现这样的技术推进。几年前曾经出现过Alexa、Google Assistant和(在一定程度上)Siri驱动的语音助手设备的繁荣期。这些助手在某些用户群体中相对受欢迎,通常是一般技术消费者而非核心技术专家。

然而,这些设备存在重大局限性。基于大语言模型的新方法可能会开创新的可能性(和风险)。

一些AI产品开发者,包括前苹果设计主管乔纳森·艾维,认为语音控制产品比基于屏幕的产品更不容易让人上瘾,并将此作为追求音频界面的理由,尽管他们通常没有引用可靠的证据来支持这一点。

OpenAI首款专注于音频的物理设备目前预计将在大约一年后发布,但我们还不知道它会是什么样子。

Q&A

Q1:OpenAI为什么要重组团队开发语音AI技术?

A:因为OpenAI研究人员认为当前的音频模型在准确性和速度方面都落后于文本模型。同时他们发现很少ChatGPT用户使用语音界面,大多数人更喜欢文本界面。通过改进音频模型,希望改变用户行为,让产品能部署在更多设备中。

Q2:OpenAI计划推出哪些硬件产品?

A:OpenAI计划推出一系列物理设备,首先是专注于音频的设备。公司内部讨论过的未来设备形式包括智能扬声器和智能眼镜,但整个产品线的重点都是音频界面而不是基于屏幕的界面。

Q3:OpenAI的语音硬件设备什么时候能买到?

A:根据报道,OpenAI的新音频大语言模型计划在2026年第一季度推出,而首款专注于音频的物理设备目前预计将在大约一年后发布,但具体外观和功能还不清楚。


版权声明: 本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若内容造成侵权/违法违规/事实不符,请联系邮箱:809451989@qq.com进行投诉反馈,一经查实,立即删除!
网站建设 2026/6/15 10:45:04

springboot+vue基于spring的药品销售商城进销存管理系统的设计与实现

目录摘要技术要点开发技术核心代码参考示例1.建立用户稀疏矩阵,用于用户相似度计算【相似度矩阵】2.计算目标用户与其他用户的相似度总结源码文档获取/同行可拿货,招校园代理 :文章底部获取博主联系方式!摘要 该系统基于SpringBoot和Vue.js技…

作者头像 李华
网站建设 2026/6/15 10:42:01

springboot+vue社区居民信息流动人口管户籍理及数据分析与可视化系统设计

目录 摘要 开发技术 核心代码参考示例1.建立用户稀疏矩阵,用于用户相似度计算【相似度矩阵】2.计算目标用户与其他用户的相似度总结源码文档获取/同行可拿货,招校园代理 :文章底部获取博主联系方式! 摘要 该系统基于SpringBoot后端框架与Vue…

作者头像 李华
网站建设 2026/6/15 11:44:54

openJiuwen 0 基础入门:工作流编排从零到一及深度踩坑指南

openJiuwen 0 基础入门:工作流编排从零到一及深度踩坑指南、 前言:什么是工作流? 在接触 openJiuwen 之前,我对“工作流”(Workflow)这个概念几乎一无所知。听起来像是企业级系统里的高深术语,…

作者头像 李华
网站建设 2026/6/8 19:07:45

Gemini CLI 终极使用指南

1. 简介:为什么使用 Gemini CLI?Gemini CLI (google/gemini-cli) 是 Google 推出的开源命令行 AI 代理。它不仅是一个聊天机器人,更是一个能通过终端理解你项目上下文、读取文件甚至执行任务的开发助手。主要特点:上下文感知&…

作者头像 李华
网站建设 2026/6/15 11:39:59

极限编程(ExtremeProgramming)是什么?

极限编程(ExtremeProgramming)是什么? 极限编程(ExtremeProgramming),简称 XP,是一种敏捷软件开发框架,它强调软件质量和响应变化的能力,尤其适用于需求快速变化或存在不…

作者头像 李华