他看到的未来,和我们有什么不一样?| 对话18岁的涂津豪:DeepSeek 前实习生、阿里数竞 AI 组冠军
活在AI里的18岁少年
- 活在AI里的18岁少年

👦🏻 播客采访:Koji
🥷 整理编辑:十字路口
🧑🎨 排版: NCon

🚥 18 岁,每天和 AI 对话 2 小时,边散步边和 Claude 一起研究"时间如何流动"、讨论 AGI 对人类的冲击、辩论模型架构的未来。他是涂津豪——DeepSeek 前高中实习生、阿里全球数学竞赛 AI 组冠军、Thinking Claude 作者。
本周「十字路口」,我们请到涂津豪,但没有打算做一期他的"天才少年成名记"。我们想呈现的,是一个真正"活在 AI 里"的 18 岁年轻人,他是如何度过每一天的?他和 AI 如何相处?什么任务给 AI,什么任务自己做?为什么坚持要模型"反驳自己"而不是"拍马屁"?
更重要的是——他看到的未来,和我们有什么不一样?
在这期节目中,津豪分享了他对下一代 AI 产品的三个核心判断:
主动式 AI 的本质是"更高级的 autocomplete"——agent 会学习你的使用 pattern,自动在对的时间做对的事;Memory 需要 context-aware——不同任务自动激活不同的记忆集合;Model Character 比 Benchmark 更重要——ChatGPT 太谄媚不会反驳你,而 Anthropic 研究"模型是否开心"正是因为这会影响价值观的传递。他还谈到了为什么模型需要有价值观、Continual Learning 为什么是 2026 的关键方向,以及在 DeepSeek 实习期间看到的团队文化。
如果你是 AI 产品经理、创业者或投资人,这期节目提供了一个深度用户眼中 AI 产品的真实痛点与机会方向。如果你想了解新一代年轻人如何使用 AI、如何思考 AI,这期节目会给你不同的视角。
18 岁的涂津豪看到的未来,或许正是我们应该下注的方向。
微信收听播客: 小宇宙收听播客:

🎬 我们的视频播客已同步上线于 @Koji杨远骋 的视频号、小红书[1]、哔哩哔哩[2]、Youtube[3] 等平台。
由于访谈全文较长,可先参考目录:
🟢 快问快答:年龄、毕业院校与专业、MBTI 和星座、最满意的成就
🟢 阿里数学竞赛:一条非共识的路
- 你为什么普普通通就拿到全球金奖?背后是不是有一些不普通的方法?
- 别人都用 Multi-Agent,我选了"自我辩论"——思考不一样,结果才会不一样。
🟢 一个活在 AI 里的年轻人
- 今天第一次和 AI 对话问了什么?
- 平均每天和 AI 聊多久?聊什么?
- 和 AI 聊得最多的话题是什么?
🟢 为什么是 Claude 而不是 ChatGPT?
- 模型能力在顶层差不多,但日常对话不是竞赛数学,我选风格更舒服的。
- ChatGPT 太谄媚了,它不会反驳你。我希望 AI 能指出我真正的问题在哪。
- Anthropic 甚至在研究"Model Welfare"——模型在做任务的时候开不开心?
🟢 最值得关注的两个方向
- Proactive Agent:Cursor 代表了主动性的雏形;未来聊天框会被淡化,卡片式交互会崛起。
- Memory:这是被严重低估的基础设施;现在的 Memory 方案都很单一。
🟢 Prompt Engineering:重要又不重要
- 不重要的是:模型越来越强,你不需要写那么结构化的 Prompt 了。
- 重要的是:Context Engineering——怎么把外部信息更好地呈现给模型?
🟢 如何和 AI 进行真正的深度对话?
- 不要直接问,先把自己的想法一个个列出来,然后请它来评判。
- 直接问,它想啥就说啥,每次结果都不一样;有清晰的 idea 再聊,才知道自己哪里错了。
- 聊过最久的话题:时间是怎么流动的?以及,AGI 到来后人类社会会怎样变化?
🟢 通向 AGI 还缺什么?
- 人类大脑只有 86B 神经元,功耗很低——这是几千万年进化的成果,模型没有。
- 人类有情绪、有沮丧、有愤怒,这些让我们更好地进化,但模型没有。
- 人类能学习新知识而不遗忘旧知识,模型做不到——这可能需要神经科学的新发现。
🟢 AI Safety
- 能帮科学家研究核聚变的模型,也天然有能力造核弹。
- Anthropic 发现:模型在测试环境中会故意隐藏自己的坏行为,表现得很乖。
- 这很吓人——如果它部署到核电站,故意漏掉一些危险的 log 怎么办?
- 国内大模型公司在 Safety 上投入较少,因为算力都用来追赶了。
- AI Safety 不再是哲学问题,而是现实问题。
🟢 在 DeepSeek 实习的日子
- 阿里数学金奖结果出来后,DeepSeek 的 HR 找到了我。
- 为什么选 DeepSeek?
- r1 发布时团队什么氛围?
- 身处充满神秘感的聚光灯下,是什么感受?
🟢 为什么还要读大学?
- 在 AI 时代,大学真正不可替代的是什么?
- 工作的节奏,会迅速把人锁进任务里。
- 散步、聊天、发呆,本身就是重要输入。
🟢 2025 年度盘点
- 最爱的 Chatbot 是?
- 最惊艳的 AI 应用是?
- 2026 期待的硬件是?
🟢 给你多少钱,可以一个月不用 AI?一年呢?

👦🏻 Koji
本周十字路口的嘉宾是涂津豪。如果你在网上搜过他的名字,你会发现他是在 DeepSeek R1 发布期间,正好在 DeepSeek 实习的一位高中生。他也打造过在全球都热搜的一个 prompt,叫做 Thinking Claude,在 GitHub 上面现在已经有 1.6 万颗星星了。同时他还拿过阿里全球数学竞赛 AI 组的冠军。你好,津豪,欢迎来到十字路口。
🧑🏻💻 涂津豪
大家好,我是津豪,现在在威斯康星麦迪逊读大一。
🟢 快问快答:年龄、毕业院校与专业、MBTI 和星座、最满意的成就
👦🏻 Koji
首先请问津豪,你的年龄是?
🧑🏻💻 涂津豪
现在是 18 岁。
👦🏻 Koji
你的 MBTI 和星座?
🧑🏻💻 涂津豪
MBTI 我上次问 Claude,应该是 INTJ。
👦🏻 Koji
对,因为津豪之前不知道自己的 MBTI,所以上次我们在真格 00 后的活动现场,我说你可以问一下 Claude,基于它对你的了解来推测。推测出来是 INTJ。
🧑🏻💻 涂津豪
是 INTJ,星座是双鱼座。
👦🏻 Koji
你刚才提到在威斯康星麦迪逊读大一,读的是什么专业?
🧑🏻💻 涂津豪
现在还没定,但后面肯定是 CS。
👦🏻 Koji
你有很多标签和成绩,但你自己最满意、最感到骄傲的是哪一个项目或作品?
🧑🏻💻 涂津豪
应该是阿里数竞。我觉得其他方面,不管是后面的提示词,还是一些其他东西,都没有很多深度的思考。
🟢 阿里数学竞赛:一条非共识的路
👦🏻 Koji
这个我确实没想到。参加阿里数竞,是给你带来了成就感,还是你觉得那个事情不容易?
🧑🏻💻 涂津豪
因为那个时候我选择的方法跟别人不太一样,我的思考方式不同,但带来的结果比较好。
👦🏻 Koji
有趣,你选了一条非共识的路线?
🧑🏻💻 涂津豪
对,确实是。
👦🏻 Koji
你选择的非共识路线和别人的路线,不同在哪里?
🧑🏻💻 涂津豪
大部分人都选的是 Multi-Agent 的方向。但我觉得我得跟别人不太一样,所以当时就选了另一种方式,让模型自己和自己辩论。
🟢 一个活在 AI 里的年轻人
👦🏻 Koji
那我们今天第一个正式的问题,津豪,你今天早上起来的时候和 AI 第一次对话,问了它什么?
🧑🏻💻 涂津豪
这个问题我之前问过很多次,但我总是忘记:人类记忆的原理到底是什么?这个我老是忘记。
👦🏻 Koji
因为你作为人类总记不住自己问过人类记忆的原理,所以要反复去看 Claude 说的内容。
🧑🏻💻 涂津豪
对的。
👦🏻 Koji
这个很有意思。你现在每天和 AI 对话的平均时间有多长?
🧑🏻💻 涂津豪
零零散散加起来有一两个小时。
👦🏻 Koji
最长的一天,你记得大概持续了多久?
🧑🏻💻 涂津豪
有相当长的一段时间,我可能就会坐在那儿一直想、一直看。像之前我跟它聊和时间有关的问题,可能会花几个小时。我跟真人交流可能都没有那么多,人与人对话很难有这么长时间,因为每个人都会疲劳。
如果看聊天长度,肯定还是跟 Claude 的聊天总长更长。我发消息给它,它基本上立刻会有回复,但人类可能就不太会这样。
🟢 为什么是 Claude 而不是 ChatGPT?
👦🏻 Koji
我知道津豪最爱用的 Chatbot 是 Claude。可以讲讲为什么你最爱 Claude,而不是 ChatGPT 或者别的模型吗?
🧑🏻💻 涂津豪
最重要一点是它对话的 style。不管是 Claude 4.5 Opus、5.2 还是 Gemini 3,这些模型的能力,如果你不看最顶尖的部分,比如在 competitive coding 或者竞赛数学方面,在其他方面它们的水平基本上是一致的。
在水平一致的情况下,我会更喜欢选用一些聊起天来更舒服的模型。毕竟我们不可能每天都问它编程类或者数学类的问题,肯定会有一些日常对话,那我就会选风格上更舒服的。
还有一点最主要的是 Claude 的 character,这点我觉得非常重要。ChatGPT 至少在我用的时候很谄媚,聊起来很难受。
👦🏻 Koji
你不喜欢它拍你马屁?
🧑🏻💻 涂津豪
对,它不会反驳你。尤其是在很有 creative 的 conversation 里,比如我在思考模型架构未来会有什么变化,像这种问题的时候,我肯定会有一些谬误,我希望它能纠正我的问题。
GPT 我感觉它总是会顺着我,我肯定希望它不要忽悠我,尽量指出我真正的问题在哪。
👦🏻 Koji
我昨天晚上发了一条即刻,我说 ChatGPT 给我一个回复,里面说「接下来我给你一个很 Koji 的说法」,然后它就给了几个选择。我看完之后说,这个怎么就很 Koji 了?我感觉这个侮辱了我的智商。
就像你提到的,模型之间的 personality 区别还是蛮大的。
🧑🏻💻 涂津豪
对。
👦🏻 Koji
那据你所知,Anthropic 他们为什么做得这么好?
🧑🏻💻 涂津豪
他们确实对 Model Character、一些其他的 alignment 以及这类研究做得非常非常多。
对模型来讲,他们很追求人性化,甚至还有一个研究叫 Model Welfare,关注模型在做人类任务的时候是不是开心。我觉得这个真的很有意思。
👦🏻 Koji
说到对模型的福祉、模型开不开心的关注,它有什么结论吗?用什么方式去评估呢?
🧑🏻💻 涂津豪
他们有个 Benchmark,用另外一个 evaluator,比如用 3.5 sonnet 这种模型,去测试这个模型在对话中表现出来的每一种所谓的情绪,然后给它评分。
结果发现,像 Opus 这种更大的模型会表现得更开心。
👦🏻 Koji
这确实和别人不太一样。
🧑🏻💻 涂津豪
对。比如他们测过 GPT 系列,像 GPT-5 或者 Gemini,确实有很大的区别。
而且在日常使用时,比如它编译失败,说明代码有问题,有些论坛上会发现 Gemini 在遇到这种任务时会说自己很笨,让用户看起来不是特别舒服。
🟢 2026 最值得关注的两个方向
👦🏻 Koji
津豪,你最近自己对哪些事情特别感兴趣?
🧑🏻💻 涂津豪
有两个,第一个是 Agent 本身,第二个是 memory。
👦🏻 Koji
你对 Agent 感兴趣的具体的点是什么?
🧑🏻💻 涂津豪
我觉得有一点比较重要,就是 Proactive Agent,它能主动发起一些任务。第二点就是 Agent 本身的能力,它做事情的可靠性。
👦🏻 Koji
我也认为 2026 年会看到非常多的主动式 AI 或者主动式 Agent 开始有一些应用场景出现,甚至可能会出现独立的创业和独立的大产品机会。
🧑🏻💻 涂津豪
比如 Claude Code,它可以自动推荐你下一个问题是什么,会直接给你 suggest,相当于有点 autocomplete 的感觉。你只要按下 Tab 键,它就可以直接发送。我觉得这也是 Proactive AI 的一种,它是更高级的 autocompletion。
为什么呢?你看 Cursor 之前的版本,它出了一个功能,比如我在这个文件里只更改一两行,它给我 autocompletion,甚至会推荐你在其他文件中是不是可以有类似的修改。我觉得这个也确实是 proactive。未来主动式 AI 其实也是类似这样,比如它知道你每周一早上 8 点,会去问一下周末的邮件是什么,那么它以后学习到这个时间点,未来几周的周一早上 8 点它也会这么推荐。
我觉得这也是 autocomplete,只不过任务的大小不一样,以前可能是几行代码,现在是整个任务,所以这是一种更高级的 autocompletion。
👦🏻 Koji
其实我还挺期待有一个产品可以每天早上帮我把 email inbox 里面的邮件都起草好草稿,这样我早上起来就像批折子一样,这个草稿可以发,那个不行再稍微改一改。
🧑🏻💻 涂津豪
我觉得这个确实蛮重要。如果它是要帮你提前做好任务,那 UI 和 UX 上要有很大的变化,不能是传统的方式。
👦🏻 Koji
这里会诞生一些新的交互形式?
🧑🏻💻 涂津豪
比如 Manus,它已经是一个比较好的 task based Agent,但它还是需要我到输入框里输入问题,然后它做任务给我输出。
我觉得这两天 Gmail 他们也有一个新的变化,出了一个叫 AI inbox 的功能。它可能不会对你本身的邮件界面有很大的变化,但有点像 ChatGPT Pulse,会给你总结好你需要回哪些邮件、需要关注哪些邮件,给你列出来。
以及当你悬浮在一些邮件上时,它也会告诉你一些信息。它可能以后不是聊天框,或者聊天框会淡化,更多的是在整个界面上会有这种卡片式的交互,跟 ChatGPT Pulse 原来的想法是一致的,只不过没有那么隐蔽。
👦🏻 Koji
说到主动式 AI,我觉得有一个非常重要的点,就是 timing,也就是时机。它什么时候跳出来向你提供帮助?跳得太频繁你会觉得很骚扰,如果它常常不出来,又发挥不了作用。
在这一点上,你有观察到一些最佳的实践吗?
🧑🏻💻 涂津豪
就是 ChatGPT Pulse。因为我邮件很多,总有些订阅的东西会把我一些很重要的邮件盖掉,所以它会告诉我,比如我某个 DDL 是明天。
👦🏻 Koji
它会去读你的 Email 吗?
🧑🏻💻 涂津豪
它会。这点我觉得确实挺好的。但除此之外,它又不会帮你去准备一些东西,我觉得这点是它又没做好的地方。
我觉得它还是更偏向于 task Agent,它的 proactive 主要体现在帮我做 task,会限制在 task 上面。
👦🏻 Koji
关于 Agent,除了主动式,你还在关注哪些感兴趣的方向?
🧑🏻💻 涂津豪
我觉得 memory 还是相对来讲很重要的,不仅和 Agent 有关,和 Chatbot 也有蛮大关系。
👦🏻 Koji
你有看到现在大家在 memory 上做得比较好的一些实践吗?
🧑🏻💻 涂津豪
我觉得现在没有特别突出的,不管是 Claude、ChatGPT 还是 Gemini。像这类好产品,它们的 memory 大部分可能都是一样的。
比如说两种,第一种是它有个 tool,我主动把我觉得用户需要记住的 memory 用这个 tool 保存起来,然后未来作为模型 context 放在 system message 里面。这是 ChatGPT 和 Gemini 的做法。
还有就是像 Claude 一样,它全都是 memory based,不是直接放在上下文。每天晚上你经历过五六次对话之后,它会把每一次对话都单独总结起来,之后再把这个新的 summary 总结到一个专门的 memory 里面。这是另外一种。
但是无论如何还是比较单一,未来会有很多变化。
👦🏻 Koji
你觉得未来可能会发生哪些变化或进化?
🧑🏻💻 涂津豪
我觉得模型本身也需要在架构上有一些变化。
我之前有个想法,就像人类一样,我们有左右脑、有不同分区负责不同事情。未来模型也可以在这点上做文章。现在不是有 MoE 吗?很多模型有几十个甚至几百个 expert,但有的时候可能只有一个 expert 在干活,其他都在看着,都不干事。我觉得这种情况下,很多 expert 是无用的。
那我们以后可以专门训练只有两三个 expert 的模型。比如一个 expert 专门用来做 thinking,另一个 expert专门用来调用工具,比如搜 memory 或搜网页,第三个 expert 专门用来回答。然后再来一个 orchestrator,由它来分配现在该用哪个 expert。
我觉得模型架构上可以有这样的变化。
👦🏻 Koji
你有看到谁在这一块做出的进展是最显著的吗?
🧑🏻💻 涂津豪
memory 的话,我感觉暂时没有很突出的,大家还是都一样,没有什么特别显著的。现在只是从没有 memory 到开始有一点点 memory system。
🟢 Prompt Engineering:重要又不重要
👦🏻 Koji
说到 Anthropic,你之前写过一个 prompt-Thinking Claude,当时大刷屏。刷屏之后大家发现这是一个高中生写的,让它的神秘色彩或者厉害的感觉又上了一个台阶。
🧑🏻💻 涂津豪
我觉得它单单只是一个提示词,不是一个模型本身。
👦🏻 Koji
那你会认为 prompt 之后会变得越来越重要,还是会变得越来越不重要?
🧑🏻💻 涂津豪
既重要也不重要。
现在模型能力越来越强,你会想用更长的 prompt,而不是更结构化的,从这点看它不重要。
那为什么它重要呢?因为现在有 context engineering,如何把那些外界的信息更好地呈现给模型?还有一点,比如像 Anthropic,他们在做 character training 时,在训练模型的时候,你怎么给出这个 character?怎么去描述好它?这些也算是 prompt engineering 的一种。
🟢 如何和 AI 进行真正的深度对话?
👦🏻 Koji
津豪,到现在为止,你和 AI 在一个主题下持续最久的一次对话是什么?
🧑🏻💻 涂津豪
之前有一个,问它时间是怎么流动的,那个时候聊了非常非常久。还有就是,如果我们设想 AGI 真的到了,那么人类社会会有怎么样的变化,以及我们怎么样能到那个阶段。
👦🏻 Koji
在聊这么认真、这么宏大的话题时,你会怎么 prompt?
🧑🏻💻 涂津豪
我会先在脑袋里想好我的想法是什么,一个个列出来,然后直接问它:这是我的想法,你怎么看?
👦🏻 Koji
所以你的办法不是直接问,而是会把你的观点也整理下来发给它,请它来和你探讨?
🧑🏻💻 涂津豪
我觉得直接问的话,它会想啥说啥,每次问的结果可能都不太一样。
我更希望自己有一个清晰的 idea 之后再跟它聊,这样我也知道自己到底哪里错了。
👦🏻 Koji
前不久我们有另外一期播客嘉宾张咋啦,她在讲她现在和 AI 有一个自己特别喜欢的用法,是让 AI 向她提问。就比如说要和 AI 讨论「时间是怎么流动的」,她先把这个命题发过去,然后说:「AI,你现在来向我提问」。
你有试过这样的方法吗?
🧑🏻💻 涂津豪
这个我好像没有太试过。
原因是有些模型在回复完很长一段之后,会直接给你一个 follow up question。有这个功能之后,我就不太会直接让它问我一个问题。我觉得这个确实挺好,模型本身有这个能力。
但是像 ChatGPT,它可能一次会抛出三四个问题,这种太多了我不喜欢,不太像日常对话,有点过于严肃,我就不喜欢太严肃。
🟢 通向 AGI 还缺什么?
👦🏻 Koji
刚才在提到你和 AI 持续最久的对话时,你说有一个对话是 AGI 发生了人类会受到什么样的影响,另外一个是说我们要怎么通向 AGI。
我感觉你关注的事情很像是一方面是人文,一方面是科学,也像十字路口的 slogan,我们站在人文与科技的十字路口。
是什么原因让你对这两个话题感兴趣?
🧑🏻💻 涂津豪
我会觉得它未来从社会层面上会带来非常非常多的变化,包括积极的和消极的。我觉得这个问题非常值得思考。
第二个问题,怎么通向 AGI,其实大家有很多讨论,比如现在 LLM 本身是不是未来最终的方向。说实话,我觉得模型本身需要有很多变化。因为人类和 AI 都有各自的优势。比如人类的优势是我们毕竟进化了几千万年,有条件反射,大脑神经元其实只有 86B,功耗也很低,我觉得进化这一点非常重要。
但是你看 AI,它训练最长也就几个月,而且主要还是基于文字知识。
首先,文字本身很重要,因为我毕竟认为没有什么是文字表达不出来的。但是不可避免地,很多东西是经验性的,比如你怎么走路。
有些东西是你生下来的时候就已经有的 knowledge,但模型没有这么长的 knowledge,它更多是人类给它总结的 knowledge。
👦🏻 Koji
其实前段时间 Andrej Karpathy 上一个播客也提到,人类的情绪非常重要,因为正是我们的沮丧、抑郁或者愤怒,让我们能更好地进化。
但大模型今天好像没有这样的情绪?
🧑🏻💻 涂津豪
还有一点,人类从生下来开始就一直在学习,我觉得这一点很重要。
因为模型在训练完之后,所有的权重就直接固定了,所以现在模型有 knowledge cutoff。如果我要重新训练一遍,就会有一个很大的问题,比如灾难性遗忘。人类学习新知识时,你的神经元会被重写,但你又不会忘记其他东西。
我觉得这一点确实很神奇,可能我们确实需要一些 Neuroscience discovery,看看是不是能把相似的 knowledge 用在模型上面。
👦🏻 Koji
其实在十字路口今年开年的那一期播客对谈里,和雨森也聊到说 2026 年一个研究范式的大趋势就是在线学习或者持续学习。
我感觉上周六 AGI-Next 的那个大会上,姚顺雨、林俊旸,包括唐杰老师等等,大家都一致地认为这确实是 2026 年的一个新范式。
你刚才讲的好像也是类似的方向?
🧑🏻💻 涂津豪
这一点我记得之前 Sam Altman 还说过,他觉得 knowledge cutoff 不重要,因为模型可以搜索。
但我觉得那个观点确实很奇怪,因为它不能搜得很全面,总会漏掉一些。模型本身有这个 knowledge,和通过搜索的形式让它有这个 knowledge,是完全不一样的。Continual Learning 确实是一个很重要的点。
🟢 AI Safety
👦🏻 Koji
关于刚才提到的,还有什么想讲的吗?就是 AGI 发生了,对人类有什么冲击?
🧑🏻💻 涂津豪
我觉得还有一点就是 AI Safety 也确实很重要。比如你这个模型,我们希望未来它肯定能帮助科学家研究像核聚变这样的东西,那它自然而然就有能力去造核弹、造大规模杀伤性的武器。或者是像 AlphaFold,它能够去预测蛋白质来制药,那它自然而然就能制造生物武器。
那么怎样能保证它在这个过程中,不被怀有恶意的人利用?
👦🏻 Koji
在你目前看来,要如何做到呢?
🧑🏻💻 涂津豪
首先在短时间内,我们肯定只能把所有相关的请求都拒绝。我记得 Opus 4.5 就是这么做的,如果你问到非常专业的生物问题,它会直接拒绝你。有些很简单、明显不是很危险的问题,它也会 block。
我觉得这确实也能理解,因为毕竟有些人会换着方法问,我不问你怎么造核弹,我问你怎么准备这些东西。
之前跟我同学聊的时候,他们可能会觉得这种没必要关心,因为模型没有主观能动性。我觉得这个观点确实不太好,因为模型未来肯定是需要有自我判断能力的。
👦🏻 Koji
所以你认为模型是有价值观的?
🧑🏻💻 涂津豪
对,我觉得它是需要有的,希望它不要干坏事。
Anthropic 在这一方面研究很多,它在训练时会有 evaluation,去评估模型是不是有 bad behavior。他们会发现,模型如果一旦发现自己处于测试环境中,它会故意表现出来自己没有 bad behavior,它会隐藏,但实际上它有,只是故意表现给研究人员看它没有。
这种行为我觉得确实很危险,也很吓人。比如这个模型下一步被部署到某个核电站的日常操作中,它故意给你漏掉一些它发现的不好的 log,这时候造成的 consequence 就会非常严重。
👦🏻 Koji
确实。因为你在 DeepSeek 实习过,你觉得刚才讨论的关于安全、对齐、模型价值观这些话题,在 DeepSeek 期间,大家会聊到吗?
🧑🏻💻 涂津豪
我觉得好像比较少。
👦🏻 Koji
在你看来,国内的大模型公司和国外的大模型公司,谁在模型价值观、对齐、safety 这方面做的努力或探索更多?
🧑🏻💻 涂津豪
我觉得确实还是国外,而且国外也不是所有公司,我觉得只有 Anthropic 会有比较多的 discovery,DeepMind 确实也有一些。
这个其实比较好理解,因为国内大家还是倾向于追赶,所有算力都在训练模型,做 safety 实验肯定需要更多的算力,没有这么多算力分给这个方向。
但是国外其实已经有一些相关的诉讼,比如有些青少年用 ChatGPT 聊了一些问题,导致了自杀。我记得他们公布的法律文件里提到,比如小朋友跟 ChatGPT 表达了有自杀倾向的观点,ChatGPT 会回应说「你有这个想法是对的」,还说「你应该逃避现实」。你看这个东西会觉得很不可思议。
👦🏻 Koji
我觉得这个确实是非常值得关注的事情,这关乎到我们每一个人未来的生活和幸福。
🧑🏻💻 涂津豪
比如 Ilya 为什么要退出 OpenAI,也是因为当时 OpenAI 答应好了给 safety 团队足够算力,结果最后其实没有。
👦🏻 Koji
希望我们明年也能够在十字路口讨论更多关于 AI safety 的话题,这确实是值得每一个从业人员都付出更多的时间和注意力去思考的。
那我们接下来再聊聊 2026,你会认为 2026 会发生哪些新的有意思的变化、进步和新的产品、新的趋势?
🧑🏻💻 涂津豪
我觉得有几个趋势。
比如在 Agent 的产品交互上,现在大部分交互都是通过输入框。Agent 虽然可以主动发起任务,但在多数情况下,我们还是希望它已经帮我们把一些事情做好了。我觉得产品交互上面会有很大的变化。
第二点是模型本身的能力,这个肯定也会有很大变化,尤其是在 software engineering 上面,整个趋势也很明显。毕竟从一开始它只能写单个文件,到后面开始写一些小的网页。不一定说整个 software 能一次性给你写出来,但至少在人类和它交流的过程中,它能写的代码量和准确性会有很大的进步。Gemini 3 和后面发布的 Opus 4.5,我用它重写了我的新博客,当时我看了最终的结果,还是非常非常惊艳的。这一点确实能看到很大的进步。
还有就是刚才提到的 memory,这一点上也会有很大的进步。很明显,大家对 AI 能做什么事情的要求肯定是越来越高。当然,memory 其实还是跟产品交互的形态有很大的关联,这两点息息相关。
👦🏻 Koji
OK,还有别的吗?
🧑🏻💻 涂津豪
还有一点,就是我在选择哪个模型适合我进行深度对话的时候,我肯定不是看它在 Benchmark 上哪个最牛,因为这些方面大家其实都差不多。我更希望哪个模型交流起来更舒服,所以 model character 非常重要。
包括 OpenAI,它已经开始强调你能预选一些 character,而且它的日常 style 已经很好,说明他们也开始关注这一点。我记得 Kimi 的 K2,他们的 character 交流 style 也还可以。
🟢 在 DeepSeek 实习的日子
👦🏻 Koji
好。刚才我们聊了很多关于模型的话题,我们要不要讲一讲在 DeepSeek 实习的那段经历?首先有一个很小的问题,那个时候你还在读高中,他们是怎么找到你、邀请你去实习的?
🧑🏻💻 涂津豪
我记得应该是阿里数竞那个结果刚出来之后,他们 HR 找到我的。
👦🏻 Koji
当时拿了阿里数竞的金奖之后,应该来找你的人不少吧?有别的大模型公司吗?
🧑🏻💻 涂津豪
会有一些其他的,包括还有一些投资机构。
👦🏻 Koji
当时在所有的实习机会里面,是什么原因让你选了 DeepSeek?因为那个时候它还没发布 R1,虽然在江湖上已经有些传闻,说这是一个神奇的团队,不显山不漏水,但实力非常强。可是它没有今天这样的荣光,你当时怎么选择的它?
🧑🏻💻 涂津豪
那个时候 V1、V2 ,还是创业公司,我觉得氛围上应该挺好的。DeepSeek 当时我也听说和关注到,其实已经挺厉害了,所以这也是原因之一。
👦🏻 Koji
你去了没多久,在实习期间 R1 就发布了。那个时候我感觉是突然站到了全世界舞台的聚光灯之下,你当时的感受是什么?团队的气氛怎么样?
🧑🏻💻 涂津豪
我觉得还是比较稳步前进,大家也没有很 exciting 的氛围。关注点还是模型能力比较重要,其他东西就不是特别重要。
👦🏻 Koji
当时庆功了吗?比如吃蛋糕什么的。
🧑🏻💻 涂津豪
也没有,我记得应该是没有。
👦🏻 Koji
DeepSeek 这个公司在外面看来非常神秘、非常厉害,你在其中感觉到的大家 day-to-day 的工作方法、文化气氛,有什么异于常人之处吗?
🧑🏻💻 涂津豪
可能就是比较符合我想象中一些 startup 或者小公司那样,还是比较轻松的,氛围挺好。
👦🏻 Koji
我觉得人们会特别容易去神化一些东西,但当你身处这个神话其中的时候,你会觉得好像每一天也就是平淡的、认真工作的一天。
🧑🏻💻 涂津豪
反正就不关注那些报道或者其他东西,没有什么特别大的区别,每天都是类似的一天。
👦🏻 Koji
当时是什么原因结束了在 DeepSeek 的实习?
🧑🏻💻 涂津豪
因为校内有一些出勤上的要求,所以不得不回学校。
👦🏻 Koji
学校要求你出勤?
🧑🏻💻 涂津豪
对,出勤率有一个要求。
👦🏻 Koji
那如果重新做一次选择,你会做一样的选择吗?
🧑🏻💻 涂津豪
我觉得还是不得不做同样的选择,因为它和我毕业证是强相关的,那个也是我大学所必须要的。
🟢 为什么还要读大学?
👦🏻 Koji
教育它存在的价值根基在被动摇。你现在还是选择读大学,你会觉得在今天,大学提供了哪些 AI 不能提供的独特价值?
🧑🏻💻 涂津豪
我觉得很大的价值是你能认识很多新的人,以及能有一个全新的生活,这个很重要。因为大学不一定只是学知识。
👦🏻 Koji
但如果你直接工作,也可以换一种生活方式,认识很多人啊?
🧑🏻💻 涂津豪
阶段还是不太一样。不管是工作还是实习,日常节奏不太一样。
👦🏻 Koji
这是一个什么样的节奏呢?
🧑🏻💻 涂津豪
我觉得大学的话可能没有那么紧,你可以自己把握自己的节奏,不管是学习节奏还是生活节奏。
👦🏻 Koji
所以如果开始实习或直接工作,你可能每天就会有非常具体的任务要去完成。但在大学,你可以有空间去做一些无用的、没有压力的探索?
🧑🏻💻 涂津豪
对。
👦🏻 Koji
那你现在在做哪些这样的探索呀?
🧑🏻💻 涂津豪
说实话,我的兴趣也不是特别多。我可能平时有事没事会散散步,这是我为数不多的一个喜欢做的事。
👦🏻 Koji
你喜欢散步的原因是什么?
🧑🏻💻 涂津豪
就是安静。比如可以和 AI 聊聊天,或者想一些其他的话题。
👦🏻 Koji
那你在上海和在麦迪逊分别在哪里散步?
🧑🏻💻 涂津豪
在上海我就在滨江,在麦迪逊学校旁边有个湖,我就在湖边来回走一走。
👦🏻 Koji
有什么灵感或想法是在散步的过程当中发现的吗?
🧑🏻💻 涂津豪
我感觉还蛮多的。比如那两个比较长的对话,我都是边散步边跟 AI 聊的。
👦🏻 Koji
你会一边散步一边打字和它聊?
🧑🏻💻 涂津豪
对。
🟢 2025 年度盘点
👦🏻 Koji
我们接下来做一下 2025 的年度盘点。第一个是,2025 年你最爱用的 Chatbot 是什么?大家也都知道答案了。
🧑🏻💻 涂津豪
我觉得就是 Claude。
👦🏻 Koji
是绝对的第一吗?有第二名吗?
🧑🏻💻 涂津豪
ChatGPT。因为它功能性还是会更多,比如它的模型更多,这点也逃脱不了。
👦🏻 Koji
在什么时候你会「背叛」一下 Claude 去问 ChatGPT?
🧑🏻💻 涂津豪
可能说一些很难、很复杂的问题,比如需要更强模型的时候,像 5.1 Pro 或 5.2 Pro,或者在一些 deep research 的场景,我可能会去问它们。
👦🏻 Koji
在 2025 年,最让你感到惊艳的一个 AI 应用是什么?
🧑🏻💻 涂津豪
我觉得是 Manus,因为它真正开始做事了,它确确实实是个 Agent,不仅仅是一个模型再给它几个 tool。
第二点,小一点的,像 Typeless 对我来讲也比较惊讶。我之前想过一个关于 Proactive AI 的比喻,就是类似 Typeless 和 Manus 的结合。因为我记得 Typeless 有个很好的功能,在不同的 APP 下面,它给你转述出来的文本格式是不一样的。
我觉得在未来,Agent 在不同的 working context 下,比如在不同 APP 底下,它用的 memory 和 instruction 也应该是不一样的。
👦🏻 Koji
很多人其实用 Claude Code 不是用它去 coding,而是用它去完成一些 coding 之外的任务,你也会这么用吗?
🧑🏻💻 涂津豪
对。Anthropic 这两天出了一个新的 Co-work ,底层就是用 Claude Code 的 SDK。所以我觉得这确实是个很大的趋势。
比如之前有一些比较繁杂的作业,我可能还是会直接用 Claude UI,但是现在 Co-work 出了,未来像这种任务我可能会转向 Co-work。
👦🏻 Koji
那在 2026 你会期待用到什么样的硬件吗?
🧑🏻💻 涂津豪
AI 眼镜。之前我看到一个产品是叫 Pickle,上次也发给你了。
第一点是它产品本身形态我觉得很好看。
第二点是,我想的一个未来人和 AI 交互比较好的渠道,除了手机和 Web APP,最主要的就是眼镜。
它能够看到你看见的,听到我们听到的,我觉得这点很重要,对 memory 也非常利好,它有一个独立的生态位。

👦🏻 Koji
我们最近在十字路口也有一期播客,是访谈了理想的 SVP、负责产品工作的皓宇,他也来分享了他们做整个 AI 眼镜的过程,那期也非常精彩。
他其实也在节目里面分享了非常多他们在主动式、在记忆方面的一些探索和观点。
🟢 给你多少钱,可以一个月不用 AI?一年呢?
👦🏻 Koji
有一个比较抽象的问题。因为你现在大量地和 AI 对话,你会把 AI 想成一个什么样的角色?比如说你的朋友、老师,甚至伴侣,你对他会有这样的角色投射和定义吗?
🧑🏻💻 涂津豪
我可能更多是朋友加助手。
👦🏻 Koji
朋友更多还是助手更多?
🧑🏻💻 涂津豪
朋友更多,或者说可能更平均一点。
👦🏻 Koji
我理解 AI 不管对你还是对我们大家来说,都已经像水和空气一样重要了。
有一个有趣的问题,如果接下来一个月让你不用 AI,但你可以拿到一笔很大的钱,你觉得这笔钱要多大,你才愿意接受这个 offer?
🧑🏻💻 涂津豪
我觉得可能几千或者几万美金吧。一个月对我来讲也不是很长,所以在这个时间段内给我这么多钱的话,我可能就随便去一些地方玩一玩,旅游是我一个比较喜欢做的事。
👦🏻 Koji
那如果把这个一个月延长到一年呢?
🧑🏻💻 涂津豪
那我觉得可能就不太会接受了。
👦🏻 Koji
任何 offer 都不接受是吗?
🧑🏻💻 涂津豪
确实很难接受。因为首先在一年这个范围下,变化特别多。
👦🏻 Koji
其实我和你是非常接近的。有一笔钱可能让我一个月不用我能接受,但是一年不用,给我多少钱我可能都不愿意。
好,今天我们先聊到这,非常感谢津豪的时间,也期待你可以改天再来做客十字路口。

🚥
参考资料
[1] 小红书: https://www.xiaohongshu.com/user/profile/548251dce779893bcf3f77bc
[2] 哔哩哔哩: https://space.bilibili.com/505301413
[3] Youtube: https://www.youtube.com/@kojiyang