造车的人去卖眼镜 | 一个理想车主戴Livis AI眼镜2个月的真实报告

造手机的在造车,造车的开始同时造眼镜了。

**

造手机的在造车,造车的开始同时造眼镜了。

👦🏻 作者: 镜山

🥷 编辑: Koji

🧑‍🎨 排版: NCon

最近科技领域有个很有意思的现象:造手机的在造车,造车的开始同时造眼镜了。

**大家似乎都在「错位」**发展。

12 月 3 日,十字路口团队应邀参加了理想的线上发布会,这场的主角就是理想最新发布的 AI 硬件:

Livis AI 智能眼镜。

它没有大家对 AI 智能硬件所预想的「侵入感」,没有很夸张的摄像头凸起,没有非常很厚的镜腿,看起来就和我们日常佩戴的眼镜差不多。它想用最接近普通眼镜的形态,进入理想汽车用户、科技用户、日常用户的生活。

不过,这种「不务正业」的跨界,自然引发了一些争议。

有人吐槽:

理想不好好造车,开始做眼镜了?

也有人说:

理想的 AI 眼镜挺良心的,与车机系统互联的话,会很期待。

本周,理想汽车高级副总裁范皓宇与 Koji 录制了一期「十字路口」视频播客《偏执、野心,与一副 AI 眼镜:顶级产品经理的底层燃料|对谈理想 SVP 范皓宇》。

在播客中,皓宇给出了一个很感性的回应:

我们在车里做了一个还不错的智能体验,但是离开车以后,瞬间就没有了,为什么不把它带出来?

为了验证这幅「新势力车厂」做的 AI 眼镜到底表现如何,我们也特意购入了一副,做了一次很真实的开箱测评。

这 2 个月,我戴着它挤地铁、逛商场、码字、工作,发呆……

🚥

全程体验下来,这款产品确实给了我一些意料之外的答案。接下来,分享我们的这段时间的实际体验和洞察。

Livis AI 眼镜开箱测评报告

首先,我们先来说说硬件侧。

理想这次发布的智能眼镜,定价定在了 1999 元,算是很有诚意了,主要因为它标配了蔡司镜片

但作为一款「智能」设备,它的实际体验究竟如何?正好我的「座驾」也是理想汽车,就搭配着说一下它真实的使用状态。

1)眼镜硬件

拿到手的第一印象是,它比我想象的要轻一些。理想这款眼镜在重量控制上做得不错,虽然搭载了很多功能,但整机只有 36g

在边框上,为了避免外放声音太刺耳,Livis 在末端安装了 2 个扬声器,分布在不同位置。右侧靠前端有一个记录按键,用来和 AI 眼镜进行交互,旁边还有一个滑动触控板,可以方便地控制操作,同时也配备了麦克风。

镜框前侧则设计了一个摄像头和一个隐私提示灯:

在实际佩戴的一整天里,鼻梁和耳朵的负重感并不明显。镜框设计比较克制,边框和可调节的鼻托让它看起来和普通眼镜差别不大。

外观方面也做得很有质感,一共有** 3 个颜色(经典黑、 科技灰、橄榄绿)、2 种质感(亮光、哑光)**可选。

镜片方面,平光镜、近视镜、变色镜都能配(具体的,大家可以去官网或门店详询)。

我的这款就是「黑色哑光光致变色」款(质感不错)。

充电逻辑采用了类似** TWS 耳机**的方案。配套的眼镜盒自带电池(支持 Type C 充电),把眼镜放进去就能通过触点充电。

而且,Livis 眼镜盒跟理想汽车的搭配很协调,放上充电板,就可以无线充电,下面是我们的现场实录:

满电状态下,眼镜本体使用时长大概能有 18 小时,配合充电盒(可充 3-4 次),差不多能覆盖日常通勤使用。

Livis 的后台 APP 是「理想同学」,你通过 AI 眼镜做的所有操作和得到的反馈,都会实时显示在 APP 上。配对过程也很简单,基本和蓝牙耳机连接差不多,没有太复杂的步骤:

这款眼镜的核心逻辑,是作为手机和车机的延伸,解决一些「不方便掏手机」场景下的痛点

2)日常场景

首先,在日常场景下,Livis 眼镜主要支持下面这几个功能:

【1】AI 实时对话

【2】拍照

【3】录像

【4】播放音乐

我们一一来说,这些功能怎么用、硬件交互如何、能用成什么样

首先,Livis 背后用的核心多模态大模型是理想的 MindGPT-4o,能支持各种类型的任务。

AI 实时对话 先来看看我的一天。

今天北京刚下完雪,晚上我准备去周边的天街商场逛一逛。我就直接戴着 Livis:

丽泽天街我该怎么去?

Livis 虽然还没办法直接从地图 APP 里实时调取数据,从 0 到 1 地告诉你到底该怎么走,但会从网络上搜取很多信息源,告诉你这个地方在哪、从地铁口出来怎么去:

这一步里,其实我非常关心** Livis 回答我时的这种「顿挫感」。其次,就是 Livis 的语气和音轨**,它的说话的声音是不是非常的拟人,这一点对我来说更为重要,因为直接影响了我在日常与它互动时的体感。

为了让大家更直观地感受,我录制了一段我与 Livis 对话的音频。

你可以去听一听,整个录音没有做什么剪辑。可以说,在我发出指令后,Livis 与我的互动感觉非常流畅,没有很明显的顿挫感。

而且,它的语气拟人化得很好,听起来很自然

所有的对话信息都会记录在手机 APP 后台:

我还真去大众点评查了下,确实信息都是能够对的上的:

除了这种简单的 AI 对话之外,Livis 甚至支持你直接开口让它做一个深度研究报告。这一点体现在日常场景里,确实很方便。

比如说,你突然有一个想法,想研究一下理想汽车 2024 年在 AI 研究上的投入情况。你可以直接张口就来一句,让理想同学帮你查一下,它会立刻在后台进行一个深度研究报告

(ps.为了方便,之后所有对话全部都是语音对话,使用截图方式展示,以下本部分的图片都是 Livis 拍摄

Livis 做的深度研究报告大概会有 7000-8000 字、50-60 篇引用文献的水平,支持非常方便地 PDF 导出:

由于你与 Livis 的对话会自动记录在理想同学的 App 后台中,所以你还可以利用它的一些小功能,比如直接让它帮你记下某些事情

它会将这些信息记录在一个叫做「记事」的标签中,并进行智能解析。

所有内容都会被整理到这个标签下,方便你以后查看和回顾。

拍照

光是用「AI 对话」功能,进行这类「文本对话」,趣味感确实不算强。所以,我个人特别喜欢的玩法就是让 Livis 利用它的拍照功能,做视觉识别,效果还可以。

右侧镜腿有触摸区域和实体按键,你可以按一下实体按键拍照

Livis 用的是索尼 IMX681,1200 万像素,算是基本够用,当然对画质不能太过强求。这里有几个真实场景,我甚至在 Livis 的身上感受到了「情感陪伴」的作用……

比如,我在逛无印良品的时候问 Livis:

你觉得前面这些衣服哪一件、哪一套搭配会看起来更协调一些?

下面是 Livis 的回答,它确实能够通过视觉识别功能选出一套衣服,并给出理由。需要注意的是它真的在进行视觉识别。

因为每次 Livis 调用视觉识别功能时,你会发现,在和它对话之后,它会发出「叮」的一声,然后自动拍一张照片,再进行思考和推理,最后给出回答

为什么我说 Livis 是真的在做视觉识别?除了拍照声响外,我还会让它帮我算算下面这套衣服目前正在打几折……

除了上面提到的两种用法,我还会在逛丝芙兰时,让 Livis 帮我看看面前的那套 The Oridinary 的化妆品,或者请它查一下网络上的资料,看看这款产品的评价如何。

这里有一个很重要的点,就是你完全可以把它当做朋友一样,想说什么就说什么,它也会真实地回应你,给出一些有生产力的答案。

所以说,这种互动体验其实挺不错的。

这是 Livis 的回答:

当我逛完斯芙兰之后,我就会顺势问它:盒马在丽泽天街的哪一层?这种问题,它其实也能给出比较准确的回答。

当然,由于它没有实际接入大众点评这类 APP,所以它调用的信息主要来源于网络上的一些资源

在这种情况下,某些店铺的位置可能就无法解析出来。不过,盒马可能因为太有名了,Livis 还是会准确告诉我在 B2 层。

录制视频

双击按键开始录像,支持 1080P 分辨率,画幅比例可以选择 16:9 或 4:3 或者其他的尺寸。录制时,镜腿上有白色指示灯闪烁提醒,能录 1 分钟

其实我觉得用 Livis 来录制视频,特别适合一个场景。

很多时候,我们并不太愿意拿出手机专门录一段视频,因为那样会觉得比较耗费注意力。你没有那么强烈的动力去专门拿手机拍摄。

但如果你用眼镜的话,场景就不一样了。

比如说,在夜晚打车回家的路上,假如你已经很疲惫了,但还是想记录一下窗外的景象,因为那样感觉更有氛围感、更有 Feel。这时候,Livis 就显得特别方便

而且你可以看到,即使在晚上,它录制视频的效果其实也挺不错的。

如果你仔细听的话,会发现 Livis 的音频录制效果其实还不错。

所以,它还有一个非常实用的场景。

比如,在开会时,你可以直接用 Livis 来录音,这样你就不必拿出手机或其他 AI 录音设备了,Livis 能大大简化这些音频录制的场景。

这其实也正是 AI 眼镜一个非常重要的功能点。许多厂商推出 AI 眼镜的原因之一,就是眼镜戴起来几乎不显突兀。

很多人本来就戴近视眼镜或平光镜,眼镜成为一个非常高频的配件。因此,使用眼镜完成这些任务,不仅对你来说非常自然,对于在场的其他人来说也几乎感受不到任何异常。

它能「悄无声息」地完成很多任务,而最关键的是,它几乎不会分散你的注意力。这一点,在日常的长期使用中,很重要,它不会让你觉得「自己又又又多了一个需要注意的硬件」。

播放音乐

这款眼镜还带有一些耳机功能。

可以通过蓝牙连接手机播放,或者直接说「理想同学播放音乐」来听歌。

Livis 还支持与网易云音乐链接,授权网易云后,是可以语音搜歌的,因为基础播控任何一个音乐平台起播都可以被控制。

镜腿支持触摸操作,轻点一下播放/暂停,双击切换下一首,三下切换上一首。不过是开放式的,既能听到声音,也能听到周围的环境音。

有朋友会担心,眼镜放歌会不会对周围的人造成很大干扰,让别人也听见音乐,觉得不太好呢?

我特意录制了一个视频,注意听,当音乐声量控制在 15% 时,我录制视频的手机大概离 Livis 只有 20 厘米左右,已经几乎完全录不到声音了,但是我实际听起来,音乐的播放还是蛮清晰的:

音轨上基本很难录到 Livis 发出的声音了

所以,如果你是在户外跑步或者运动时,我觉得用 Livis 来听歌,感觉是很不错的

要是平时用 AirPods 这类耳机,当然也不用非得换成 Livis 的音乐播放功能,确实从绝对音质来说,外放肯定完全比不过入耳式耳机。

当然,作为车商推出的 AI 眼镜,它和理想汽车的配合是大看点,车机互联的体验很受关注。

下面,我们搭配着理想汽车,实测了几个比较重要的亮点,来和大家分享一下

3)车控

首先,Livis 和理想汽车的车机配对,很顺,戴着眼镜进入车内即可配对:

我们先来说说最直观、最符合直觉的用法:「眼镜控车」。

其实,我并不是特别关注 Livis 执行提示词任务的表现(毕竟,AI 眼镜能做到这些任务,从技术上来说其实并不算太难),反而我更在意的是,当我说出「理想同学」时,理想汽车的车机反应速度有多快。

简单来说,我更关心的是那种「顿挫感」。

首先,在「利用 Livis 眼镜,让理想汽车打开后备箱」这个场景里,整体流程很顺,而且很有意思的是,当我说出指令之后,Livis 非常快地响应了,然后会让我确认:车后空间是否足够、是否安全,而不是直接「不管不顾」地就直接开后备箱:

这类很顺的车机 - 眼镜搭配的场景,还有很多,再比如「开车锁」:

「开车窗」:

以上所有视频,都没有进行加速和剪辑,你能很明显地感受到车机和 Livis 眼镜之间的交互很顺畅。

而且,我还发现所有唤醒不用加「hey」,直接说「理想同学」就行,第二轮则直接说「确认」就行,不用像我说的这么长。

这种交互的未来潜力确实非常大,尤其是在某些特定场景下,比如你手上拿着东西,或者下雨天不方便掏出手机的时候,Livis 能提供很大的便利

除了这种「眼镜控车」很「大 」的功能,周围很多朋友包括我其实都非常关注一个细节:当我戴着 Livis AI 眼镜进入理想汽车,用「理想同学」呼叫,是理想汽车先理我还是眼镜先理我?这 2 者会不会出现矛盾?

这样小的细节,是否被理顺了?谁是最主要的「大脑」?

我仔细理了理。当你说出「理想同学」后,其实是车机首先回答你

比如当你说出:

理想同学,拍个视频

理想给出的逻辑是:在使用过程中,理想汽车的车机系统会先响应用户的指令,然后再交给 Livis AI 眼镜来拍摄视频。这样安排可以避免设备之间出现冲突,让用户操作起来更直观,也符合平常的使用习惯。

用户习惯了语音指令先由车机响应(比如在车上操作时,大多数人会先期待车载系统回应),这种优先级设置符合用户的预期。这样,用户在使用时不会感到不适应。

这种**「无缝」的体验**,其实是理想推出 Livis AI 眼镜的一大卖点。虽然现在还比较初级,但这种思路是对的。

现在,我们可以再回过头聊聊续航。

就像前面提到的,官方说这款眼镜的续航时间是 18 小时。但根据我的实际测试,如果你没有频繁使用拍照、录像、播放音乐和 AI 对话这些高强度功能,续航时间其实会更长一些

比如说,我自己大多数时间都是轻度使用,平时在办公室里基本不会用到这些功能。像我在通勤路上稍微用一下的话,眼镜的续航实际上能远远超过 18 个小时。

所以续航时间对我来说,问题不是很大。


最后总结一下这几天戴下来的真实感受。

第一,真的轻。戴习惯了之后,你会忘记它是一个电子产品。

第二,续航还可以。白天戴一天,晚上摘下来放进盒子,第二天又是满电,几乎没有什么充电焦虑。

第三,生态比较丝滑。呼叫理想同学之后的对话过程很顺,这种不需要掏手机的感觉,比较上瘾。

这里我们想引用范皓宇在「十字路口」播客中提到的一句话:

产品不是一个简单的理念,产品是由无数的 detail 细节堆积在一起的一座山。

在使用 Livis 的这段时间里,虽然它现在还不完美(比如我也遇到过客服响应和一些小 Bug 的问题),但它确实像范皓宇所期望的那样让那个在车里大家都很喜欢的「理想同学」走了出来,成为了一个无时无刻不在的伙伴

如果你已经购买了 Livis,或者有兴趣购买的朋友,不管是有新鲜体验,还是有什么问题、感受,欢迎在评论区留言交流~