开放式耳机霸主入局AI的第一款耳机,新品值得买吗?

「开放式耳机 + AI」的潜力。

「开放式耳机 + AI」的潜力。

👦🏻 作者: GaKi

🥷 编辑: Koji

🧑‍🎨 排版: NCon

过去两年里,越来越多硬件公司和大厂开始把 AI 接进耳机、手机、手表这些设备里。其中耳机,尤其是开放式耳机,不堵耳、不隔绝外界,可能是 AI 最合适的落地入口之一。

8 月 17 日,韶音的新 AI 开放式耳机—— OpenFit 2 AI 开始预售,24 号正式发售,接入了千问大模型,从「开放聆听」的硬件设备,升级为「耳边的 AI 生产力」。

论做 AI,韶音来得不算早。但在开放式耳机这个品类里,它几乎一直是先行者和领跑者之一,也是名副其实的卷王,经历过「开放式耳机」的整个周期,连续三年全球出货量第一,专利数量也常年排在最前,用过、买过开放式耳机的人,大多都知道韶音。

这样一个知名厂商,这次也一头扎进了自己比较陌生的 AI 领域,算得上是一位「有力的入局者」。

正因如此,人们关注的已不仅是 OpenFit 2 AI 这一款新品,而是韶音,能否为「AI + 开放式耳机」带来新的可能。

韶音把 AI 功能接入开放式耳机之后,究竟能带来怎样的体验?

「开放式耳机 + AI」到底是噱头,还是真的能成为生产力工具?

🚥

产品发布的第一时间,我们拿到了这款耳机,做了一次完整的开箱体验。

实测 【1】录音

拿到这款产品后,我们做了比较完整的实测,结合了不少实际工作场景。

这款产品主要有三个使用方向:录音转写、AI 总结和实时翻译,均接入了千问大模型,将 AI 功能贯穿其中。

下面先说录音功能。

录音可以由硬件三端开启:耳机功能键长按、App 端手动操作,还有耳机充电盒长按开启录音。

OpenFit 2 AI 耳机支持三个录音场景:通话录音、现场录音和音视频录音,基本覆盖到了常见场景。

我们通过三端开启录音的场景,依次来看。

耳机开启录音

OpenFit 2 AI 可以直接识别来电并自动开始录音。遇到临时电话会时,它比其他录音设备顺手得多。

你完全不用特意掏手机或打开某个 App,戴着就能无缝记录,整体体验非常连贯。

通话录音时,这副耳机的拾音非常灵敏,即便对方声音含糊一点,转录出来的文字精度也很高。

而且在 App 里可以直接选翻译,或者提前选好对方的说话语言,让 AI 转得更准。

再看一个场景,拿 Alphabet 2026 年 Q2 财报电话会来说,只要有空我都会听。现在的云厂商都在讲 AI 故事,整场会议既有硬核的财务数据,又有复杂的 AI 业务,信息量极大。

这个电话会议我全程用 OpenFit 2 AI 耳机录制。它戴起来比较简单,可以直接按下面这种方式佩戴,整体比较稳固。

这类财报会议信息密度非常大,我特别依赖「录音+纪要」功能。平时很多临时会议也是这样,沟通强度大、信息又密,现场根本来不及完全消化。

这个时候就可以用到 OpenFit 2 AI 耳机的另一个功能,双击耳机功能键会自动标注重点句。演示视频放在下面,我用红箭头标注出来,可以看到重点内容会直接标黄,到下一段时自动恢复正常。

这个功能用起来比较顺畅,也比较精准,符合实际使用场景,尤其是在信息密度高的会议场景。

充电盒开启录音

除了耳机录音和手机 App 录音之外,也可以直接把耳机放进充电盒,长按充电盒旁边的录音键,就能一键开始录音。这样就很适合不方便戴耳机的录音场景,减少冒犯。

具体操作是长按录音键,直到录音盒前面出现黄色指示灯,就说明已经开始录音了。

这时候耳机放哪都可以,所以没有太多时间听的时候,我往往会直接这样录音,再回头看转写和总结。

App 开启录音

App 端开启录音,比较适合于选择录制音视频录音,或者是现场录音场景。

像是平常开线上会议,或者看长篇外文音视频的场景。我平时会反复听 Anthropic 和 OpenAI 相关频道之前发布的专业场景教学视频,以及一些宣传片,从中了解他们目前在做什么。

前段时间 Anthropic 发布了一个讲 Claude 用于法律场景的宣传片,围绕一个主角详细讲述了公司内部在法律场景下使用 Claude 的工作流程。

然后,你可以直接单点这只耳机,也可以用 Shokz App 连接耳机开启录音。它对音频的捕捉比较细致,转写速度也很快。

你可以直接在里面点翻译功能,它会额外给出翻译。这类 YouTube 频道,有很多专有名词,这款耳机在这方面的转写也非常精准。

耳机、手机 App 端以及耳机盒录制的内容,都会同步到手机 App,在电脑端也可以查看、编辑,以及一键转发。

【2】 AI 转写与总结

录音完成后,由千问大模型支持 AI 转写和 AI 总结,这是它比较核心的功能。实际体验下来,OpenFit 2 AI 耳机对 12 个行业的专业场景都有比较好的支持:

其中,尤其是法律和金融场景,表现很不错。

下面展示我用 AI 转写这场 Anthropic 法律场景视频的内容。

可以看到文字转写比较精准,尤其是科技与法律联动的场景。比如 Claude 和 Claude Code 这两个词,还有一些法律词汇,很多 AI 语音输入法都识别不出来,大多数时候会被识别成 Cloud。

OpenFit 2 AI 在这些场景下表现还不错。

以上所有内容都支持编辑。

电脑端也会同步所有录音文件,你可以直接在电脑端转写、翻译,并进行标记。

下面再说说「AI 总结」,总结部分内置了 19 种总结模板,可以适配非常多种的专业场景,像是咨询呀,通用会议、金融、问诊等等。

总结的精度和摘要质量都还不错。里面有不少专业词汇,比如法律工单,后面会用英文标注出来。比较有意思的是「人在回路」(Human in the loop),算是 AI 领域比较知名的说法,翻译也比较精准。

再比如,在听一些更复杂的 Legal Professional Lessons 的时候,我发现它会有很好的 AI 翻译和总结习惯。

首先,这些专有名词翻译的是非常准确的,然后在很多这种专业名词都会保持它原本的英文,再在括号里标上中文,如果是机构的话则是中文翻译,然后后面标注该机构的英文名称。

下面再说说另一个大的使用方向,翻译。

【3】翻译

OpenFit 2 AI 耳机支持 4 个翻译场景:通话翻译、同声传译、面对面翻译、音视频字幕,基本该覆盖的都覆盖到了。

翻译支持 49 种语言,中文、英语、日语这些常见语言之外,还覆盖不少其他语言。

同声传译

先看同声传译,这个功能日常比较实用。

看全英文 YouTube 视频时,如果没有翻译插件,只有英文字幕会比较麻烦,尤其是专业场景下想同步听懂内容的时候。

这次我听的是 Anthropic 之前发布的一个讲 Claude 内部推理机制的视频,用 OpenFit 2 AI 耳机做同声传译,翻译的同时会立刻出现中文转写,速度比较快。

所有内容也支持 AI 转写和 AI 总结。

通话翻译

还有一个我个人觉得好用的功能:耳机连上 Shokz App 并保持连接状态后,如果有人打电话进来,它能自动识别,耳机里会响一声提示音,随后开始通话记录或通话翻译。

我试了一次,和一位做金融 AI 产品的增长负责人通话,它识别来电的反应速度很快,可以直接做英文翻译和转写,方便不少。

音视频字幕

OpenFit 2 AI 耳机的其中有一个场景是它翻译功能里的音视频字幕。日常使用中,我主要看 YouTube 的 Shorts 短视频,有些视频会有多语言夹杂的说话习惯,理解起来并不容易。

比如下面这个视频,是用普通话、日语、英语,甚至带一点粤语讲解日语和英语的教学视频。

这类视频我一般用手机看,但用手机看的话很难同时录音或转录,因为手机本身常用来录音,没办法两头兼顾。

这时候用 OpenFit 2 AI 耳机比较适合,在 YouTube 上打开这个音视频后,App 的音视频字幕功能会在后台自动开启,自动转录和翻译,而且支持浮窗实时翻译。

而且,如果你需要记录学习视频内容,当你第一遍粗略看过 YouTube 音视频之后,可以再回到 App 里二次细读。

这种场景其实就很适合托福、雅思等各种语言学习了。

而且,这种中文、日语、英语等多语言交杂的场景,它的翻译效果比较好。这个短视频里真人说话就是中日英交杂,转录也会用这种交杂形式呈现:这句道歉用的是日语,主持人说的英语部分还是保留 Sorry。

面对面翻译

最后一个翻译功能是面对面翻译,这个功能日常比较实用,尤其适配出国留学这类交流多的场景。

这次我找了一个日语讲座对话来测试,因为我对这类日语场景也算比较熟悉。这次是生物场景,属于比较专有的内容,翻译也比较精准:

我注意到,它会按说话人的语气和转折点进行切断,再翻译。

按住语音按钮代表开始说话,它会很快截断。我说的是中文,系统会把内容转录成日语文字,同时播出日语语音。松开录音按钮后,会切回让对方讲话,这种切换比较顺畅。

以上过程会涉及不少数据,这些数据会保存在手机 App 和电脑端,自然涉及数据安全问题。

这次韶音推出这款耳机时专门强调,它通过了网络安全等级保护三级认证,也完成了 SOC 2-Type 1 独立审计。

给隐私安全又加了一道门槛。

【4】音质与舒适度怎么样?

整体听下来,不管是声音捕捉的敏锐度、细致程度,还是回放时的音量表现,都对得起「深耕开放式耳机近二十年、技术功底扎实」这块招牌。

我平时听歌的强度比较高,OpenFit 2 AI 尤其低音部分,下潜感更明显一些,高音也通透,没有一般开放式耳机那种模糊感。

我仔细看了他们的产品说明书,以及官网上关于这款产品的介绍,能看出背后确实有韶音自己的技术积累。

前面听到的整体音感,来自不少比较复杂的技术,相关音质技术基本都用上了,比如 Shokz DualBoost 双引擎技术、OpenBass 2.0 算法、DirectPitch 2.0 分频降漏音。

我不是这方面的发烧友,有兴趣的话大家可以自己再查查看。

还有一点值得说的是戴上耳机的整体舒适程度。

这款耳机是开放式耳机,没有入耳式耳机那种戴久了耳道肿胀的感觉。听歌时间长了以后,比如 4 到 6 个小时,入耳式耳机的耳塞部分会撑得耳朵难受。

我的耳道稍大一些,用入耳式耳机只能用中小尺寸的耳塞,塞得比较紧,通常超过两个小时耳朵大概率会疼。

开放式耳机天生就有不堵耳的设计。它的材料是双层硅胶,整体佩戴还算舒适。

开放式耳机一般会有比较松的情况,但这款还好,采用了海豚弧设计,弧度设计合理,大小耳都适配。说明书里提到内嵌 0.7 毫米柔性钛丝,所以挂上去很稳。而且韶音家的耳机我看很多跑马拉松的人都在戴,稳固性上没问题。

开放式耳机 + AI = 生产力?

体验下来,我认为耳机,天然具有「生产力 Up」的基础。

耳机先是个人音乐设备,后来变成手机的声音延伸,到真无线时代,又成了很多人几乎全天佩戴的随身设备。

AI 出现之后,耳机就从一个「设备」,变成一个「入口」。

耳机能做入口,靠的是贴身和高频。跟手机这种强视觉、强操作的终端比,耳机的优势在于能解放双手、减少打扰,交互可以更连续、更自然。

前面提到的通话录音场景就是个例子,电话临时打进来,不用掏手机、不用点开 App,耳机直接识别来电,自动开始记录和翻译,整个过程不打断对话的节奏。这种能力,是手机这类需要主动操作的终端很难做到的。

想承接这层入口价值,前提是用户得先愿意长时间戴着它。

开放式耳机的位置就在于此,不堵耳、能同时听清环境声、长时间戴着不难受,这几条本身就是「愿意长时间戴着」的必要条件,佩戴体验不过关,后面的 AI 能力根本没有机会被用上。

从用户体验角度来说,好的入口,需要打扰感足够低。

它应该在需要的时候自然出现,不需要的时候保持安静,把原来要掏手机、打开 App、手动记录、会后再整理的这些步骤压缩甚至省掉,用户不用为了唤醒它多做动作。

韶音「开放式耳机」这条产品线自己的演变,其实就是这个方向演进的缩影。

最早的骨传导耳机解决的是运动场景里的环境感知问题,戴着耳机也能听清车流和路人。后来场景往日常通勤和办公延伸,耳挂式、耳夹式陆续补齐了长时间佩戴的舒适度和全场景适配性。

到了 OpenFit 2 AI 这一代,场景又往职场和商务方向拓宽了一步,接入千问大模型之后,耳机要做的不只是把声音传进耳朵,还要在会议、通话这些场景里帮着记录、总结、提炼重点。

韶音近20 年积累下来的开放式声学技术、舒适科技,决定了这副耳机能被舒舒服服戴多久;新接入的千问大模型,决定了戴着的这段时间里它还能替用户做多少生产力场景下的事。

🚥 2026 年,声学厂商们大概率会集体往主流 AI 硬件市场里挤,新品密度接下来一两年只会比过去更高。

这波浪潮里,韶音的入场更像是沿着早已规划好的升级路线,稳扎稳打地走到了这里。它的落点是用户真实的使用场景和高频需求,会议记录、通话翻译、多语言字幕,这些都是实打实的日常刚需,AI 只是把这些需求接住的技术手段。

2025 年,韶音已经把开放式耳机这个品类的形态基本全走了一遍,骨传导、耳挂式、耳夹式,加上已布局的 AI 眼镜。OpenFit 2 AI 接入千问大模型,是这盘布局里最新的探索。

过去十多年,韶音这家企业一直在琢磨怎么让人听得自然,又不用为此和周围的环境、身边的人、真实世界断开连接。

在运动场景这条线,韶音已经用出货量和专利数证明过自己。这一次,它想把同样的体验带进生产力场景。

从产品定义到技术落地,OpenFit 2 AI 已经给出了一个足够扎实的起点,能不能在这个标准下做出成绩,值得期待。