他看到的未来,和我们有什么不一样?| 对话18岁的涂津豪:DeepSeek 前实习生、阿里数竞 AI 组冠军

活在AI里的18岁少年

  1. 活在AI里的18岁少年

👦🏻 播客采访:Koji

🥷 整理编辑:十字路口

🧑‍🎨 排版: NCon

🚥 18 岁,每天和 AI 对话 2 小时,边散步边和 Claude 一起研究"时间如何流动"、讨论 AGI 对人类的冲击、辩论模型架构的未来。他是涂津豪——DeepSeek 前高中实习生、阿里全球数学竞赛 AI 组冠军、Thinking Claude 作者。

本周「十字路口」,我们请到涂津豪,但没有打算做一期他的"天才少年成名记"。我们想呈现的,是一个真正"活在 AI 里"的 18 岁年轻人,他是如何度过每一天的?他和 AI 如何相处?什么任务给 AI,什么任务自己做?为什么坚持要模型"反驳自己"而不是"拍马屁"?

更重要的是——他看到的未来,和我们有什么不一样?

在这期节目中,津豪分享了他对下一代 AI 产品的三个核心判断:

主动式 AI 的本质是"更高级的 autocomplete"——agent 会学习你的使用 pattern,自动在对的时间做对的事;Memory 需要 context-aware——不同任务自动激活不同的记忆集合;Model Character 比 Benchmark 更重要——ChatGPT 太谄媚不会反驳你,而 Anthropic 研究"模型是否开心"正是因为这会影响价值观的传递。他还谈到了为什么模型需要有价值观、Continual Learning 为什么是 2026 的关键方向,以及在 DeepSeek 实习期间看到的团队文化。

如果你是 AI 产品经理、创业者或投资人,这期节目提供了一个深度用户眼中 AI 产品的真实痛点与机会方向。如果你想了解新一代年轻人如何使用 AI、如何思考 AI,这期节目会给你不同的视角。

18 岁的涂津豪看到的未来,或许正是我们应该下注的方向。

微信收听播客: 小宇宙收听播客:

🎬 我们的视频播客已同步上线于 @Koji杨远骋 的视频号、小红书[1]、哔哩哔哩[2]、Youtube[3] 等平台。

由于访谈全文较长,可先参考目录:

🟢 快问快答:年龄、毕业院校与专业、MBTI 和星座、最满意的成就

🟢 阿里数学竞赛:一条非共识的路

  • 你为什么普普通通就拿到全球金奖?背后是不是有一些不普通的方法?
  • 别人都用 Multi-Agent,我选了"自我辩论"——思考不一样,结果才会不一样。

🟢 一个活在 AI 里的年轻人

  • 今天第一次和 AI 对话问了什么?
  • 平均每天和 AI 聊多久?聊什么?
  • 和 AI 聊得最多的话题是什么?

🟢 为什么是 Claude 而不是 ChatGPT?

  • 模型能力在顶层差不多,但日常对话不是竞赛数学,我选风格更舒服的。
  • ChatGPT 太谄媚了,它不会反驳你。我希望 AI 能指出我真正的问题在哪。
  • Anthropic 甚至在研究"Model Welfare"——模型在做任务的时候开不开心?

🟢 最值得关注的两个方向

  • Proactive Agent:Cursor 代表了主动性的雏形;未来聊天框会被淡化,卡片式交互会崛起。
  • Memory:这是被严重低估的基础设施;现在的 Memory 方案都很单一。

🟢 Prompt Engineering:重要又不重要

  • 不重要的是:模型越来越强,你不需要写那么结构化的 Prompt 了。
  • 重要的是:Context Engineering——怎么把外部信息更好地呈现给模型?

🟢 如何和 AI 进行真正的深度对话?

  • 不要直接问,先把自己的想法一个个列出来,然后请它来评判。
  • 直接问,它想啥就说啥,每次结果都不一样;有清晰的 idea 再聊,才知道自己哪里错了。
  • 聊过最久的话题:时间是怎么流动的?以及,AGI 到来后人类社会会怎样变化?

🟢 通向 AGI 还缺什么?

  • 人类大脑只有 86B 神经元,功耗很低——这是几千万年进化的成果,模型没有。
  • 人类有情绪、有沮丧、有愤怒,这些让我们更好地进化,但模型没有。
  • 人类能学习新知识而不遗忘旧知识,模型做不到——这可能需要神经科学的新发现。

🟢 AI Safety

  • 能帮科学家研究核聚变的模型,也天然有能力造核弹。
  • Anthropic 发现:模型在测试环境中会故意隐藏自己的坏行为,表现得很乖。
  • 这很吓人——如果它部署到核电站,故意漏掉一些危险的 log 怎么办?
  • 国内大模型公司在 Safety 上投入较少,因为算力都用来追赶了。
  • AI Safety 不再是哲学问题,而是现实问题。

🟢 在 DeepSeek 实习的日子

  • 阿里数学金奖结果出来后,DeepSeek 的 HR 找到了我。
  • 为什么选 DeepSeek?
  • r1 发布时团队什么氛围?
  • 身处充满神秘感的聚光灯下,是什么感受?

🟢 为什么还要读大学?

  • 在 AI 时代,大学真正不可替代的是什么?
  • 工作的节奏,会迅速把人锁进任务里。
  • 散步、聊天、发呆,本身就是重要输入。

🟢 2025 年度盘点

  • 最爱的 Chatbot 是?
  • 最惊艳的 AI 应用是?
  • 2026 期待的硬件是?

🟢 给你多少钱,可以一个月不用 AI?一年呢?

👦🏻 Koji

本周十字路口的嘉宾是涂津豪。如果你在网上搜过他的名字,你会发现他是在 DeepSeek R1 发布期间,正好在 DeepSeek 实习的一位高中生。他也打造过在全球都热搜的一个 prompt,叫做 Thinking Claude,在 GitHub 上面现在已经有 1.6 万颗星星了。同时他还拿过阿里全球数学竞赛 AI 组的冠军。你好,津豪,欢迎来到十字路口。

🧑🏻‍💻 涂津豪

大家好,我是津豪,现在在威斯康星麦迪逊读大一。

🟢 快问快答:年龄、毕业院校与专业、MBTI 和星座、最满意的成就

👦🏻 Koji

首先请问津豪,你的年龄是?

🧑🏻‍💻 涂津豪

现在是 18 岁。

👦🏻 Koji

你的 MBTI 和星座?

🧑🏻‍💻 涂津豪

MBTI 我上次问 Claude,应该是 INTJ。

👦🏻 Koji

对,因为津豪之前不知道自己的 MBTI,所以上次我们在真格 00 后的活动现场,我说你可以问一下 Claude,基于它对你的了解来推测。推测出来是 INTJ。

🧑🏻‍💻 涂津豪

是 INTJ,星座是双鱼座。

👦🏻 Koji

你刚才提到在威斯康星麦迪逊读大一,读的是什么专业?

🧑🏻‍💻 涂津豪

现在还没定,但后面肯定是 CS。

👦🏻 Koji

你有很多标签和成绩,但你自己最满意、最感到骄傲的是哪一个项目或作品?

🧑🏻‍💻 涂津豪

应该是阿里数竞。我觉得其他方面,不管是后面的提示词,还是一些其他东西,都没有很多深度的思考。

🟢 阿里数学竞赛:一条非共识的路

👦🏻 Koji

这个我确实没想到。参加阿里数竞,是给你带来了成就感,还是你觉得那个事情不容易?

🧑🏻‍💻 涂津豪

因为那个时候我选择的方法跟别人不太一样,我的思考方式不同,但带来的结果比较好。

👦🏻 Koji

有趣,你选了一条非共识的路线?

🧑🏻‍💻 涂津豪

对,确实是。

👦🏻 Koji

你选择的非共识路线和别人的路线,不同在哪里?

🧑🏻‍💻 涂津豪

大部分人都选的是 Multi-Agent 的方向。但我觉得我得跟别人不太一样,所以当时就选了另一种方式,让模型自己和自己辩论。

🟢 一个活在 AI 里的年轻人

👦🏻 Koji

那我们今天第一个正式的问题,津豪,你今天早上起来的时候和 AI 第一次对话,问了它什么?

🧑🏻‍💻 涂津豪

这个问题我之前问过很多次,但我总是忘记:人类记忆的原理到底是什么?这个我老是忘记。

👦🏻 Koji

因为你作为人类总记不住自己问过人类记忆的原理,所以要反复去看 Claude 说的内容。

🧑🏻‍💻 涂津豪

对的。

👦🏻 Koji

这个很有意思。你现在每天和 AI 对话的平均时间有多长?

🧑🏻‍💻 涂津豪

零零散散加起来有一两个小时。

👦🏻 Koji

最长的一天,你记得大概持续了多久?

🧑🏻‍💻 涂津豪

有相当长的一段时间,我可能就会坐在那儿一直想、一直看。像之前我跟它聊和时间有关的问题,可能会花几个小时。我跟真人交流可能都没有那么多,人与人对话很难有这么长时间,因为每个人都会疲劳。

如果看聊天长度,肯定还是跟 Claude 的聊天总长更长。我发消息给它,它基本上立刻会有回复,但人类可能就不太会这样。

🟢 为什么是 Claude 而不是 ChatGPT?

👦🏻 Koji

我知道津豪最爱用的 Chatbot 是 Claude。可以讲讲为什么你最爱 Claude,而不是 ChatGPT 或者别的模型吗?

🧑🏻‍💻 涂津豪

最重要一点是它对话的 style。不管是 Claude 4.5 Opus、5.2 还是 Gemini 3,这些模型的能力,如果你不看最顶尖的部分,比如在 competitive coding 或者竞赛数学方面,在其他方面它们的水平基本上是一致的。

在水平一致的情况下,我会更喜欢选用一些聊起天来更舒服的模型。毕竟我们不可能每天都问它编程类或者数学类的问题,肯定会有一些日常对话,那我就会选风格上更舒服的。

还有一点最主要的是 Claude 的 character,这点我觉得非常重要。ChatGPT 至少在我用的时候很谄媚,聊起来很难受。

👦🏻 Koji

你不喜欢它拍你马屁?

🧑🏻‍💻 涂津豪

对,它不会反驳你。尤其是在很有 creative 的 conversation 里,比如我在思考模型架构未来会有什么变化,像这种问题的时候,我肯定会有一些谬误,我希望它能纠正我的问题。

GPT 我感觉它总是会顺着我,我肯定希望它不要忽悠我,尽量指出我真正的问题在哪。

👦🏻 Koji

我昨天晚上发了一条即刻,我说 ChatGPT 给我一个回复,里面说「接下来我给你一个很 Koji 的说法」,然后它就给了几个选择。我看完之后说,这个怎么就很 Koji 了?我感觉这个侮辱了我的智商。

就像你提到的,模型之间的 personality 区别还是蛮大的。

🧑🏻‍💻 涂津豪

对。

👦🏻 Koji

那据你所知,Anthropic 他们为什么做得这么好?

🧑🏻‍💻 涂津豪

他们确实对 Model Character、一些其他的 alignment 以及这类研究做得非常非常多。

对模型来讲,他们很追求人性化,甚至还有一个研究叫 Model Welfare,关注模型在做人类任务的时候是不是开心。我觉得这个真的很有意思。

👦🏻 Koji

说到对模型的福祉、模型开不开心的关注,它有什么结论吗?用什么方式去评估呢?

🧑🏻‍💻 涂津豪

他们有个 Benchmark,用另外一个 evaluator,比如用 3.5 sonnet 这种模型,去测试这个模型在对话中表现出来的每一种所谓的情绪,然后给它评分。

结果发现,像 Opus 这种更大的模型会表现得更开心。

👦🏻 Koji

这确实和别人不太一样。

🧑🏻‍💻 涂津豪

对。比如他们测过 GPT 系列,像 GPT-5 或者 Gemini,确实有很大的区别。

而且在日常使用时,比如它编译失败,说明代码有问题,有些论坛上会发现 Gemini 在遇到这种任务时会说自己很笨,让用户看起来不是特别舒服。

🟢 2026 最值得关注的两个方向

👦🏻 Koji

津豪,你最近自己对哪些事情特别感兴趣?

🧑🏻‍💻 涂津豪

有两个,第一个是 Agent 本身,第二个是 memory。

👦🏻 Koji

你对 Agent 感兴趣的具体的点是什么?

🧑🏻‍💻 涂津豪

我觉得有一点比较重要,就是 Proactive Agent,它能主动发起一些任务。第二点就是 Agent 本身的能力,它做事情的可靠性。

👦🏻 Koji

我也认为 2026 年会看到非常多的主动式 AI 或者主动式 Agent 开始有一些应用场景出现,甚至可能会出现独立的创业和独立的大产品机会。

🧑🏻‍💻 涂津豪

比如 Claude Code,它可以自动推荐你下一个问题是什么,会直接给你 suggest,相当于有点 autocomplete 的感觉。你只要按下 Tab 键,它就可以直接发送。我觉得这也是 Proactive AI 的一种,它是更高级的 autocompletion。

为什么呢?你看 Cursor 之前的版本,它出了一个功能,比如我在这个文件里只更改一两行,它给我 autocompletion,甚至会推荐你在其他文件中是不是可以有类似的修改。我觉得这个也确实是 proactive。未来主动式 AI 其实也是类似这样,比如它知道你每周一早上 8 点,会去问一下周末的邮件是什么,那么它以后学习到这个时间点,未来几周的周一早上 8 点它也会这么推荐。

我觉得这也是 autocomplete,只不过任务的大小不一样,以前可能是几行代码,现在是整个任务,所以这是一种更高级的 autocompletion。

👦🏻 Koji

其实我还挺期待有一个产品可以每天早上帮我把 email inbox 里面的邮件都起草好草稿,这样我早上起来就像批折子一样,这个草稿可以发,那个不行再稍微改一改。

🧑🏻‍💻 涂津豪

我觉得这个确实蛮重要。如果它是要帮你提前做好任务,那 UI 和 UX 上要有很大的变化,不能是传统的方式。

👦🏻 Koji

这里会诞生一些新的交互形式?

🧑🏻‍💻 涂津豪

比如 Manus,它已经是一个比较好的 task based Agent,但它还是需要我到输入框里输入问题,然后它做任务给我输出。

我觉得这两天 Gmail 他们也有一个新的变化,出了一个叫 AI inbox 的功能。它可能不会对你本身的邮件界面有很大的变化,但有点像 ChatGPT Pulse,会给你总结好你需要回哪些邮件、需要关注哪些邮件,给你列出来。

以及当你悬浮在一些邮件上时,它也会告诉你一些信息。它可能以后不是聊天框,或者聊天框会淡化,更多的是在整个界面上会有这种卡片式的交互,跟 ChatGPT Pulse 原来的想法是一致的,只不过没有那么隐蔽。

👦🏻 Koji

说到主动式 AI,我觉得有一个非常重要的点,就是 timing,也就是时机。它什么时候跳出来向你提供帮助?跳得太频繁你会觉得很骚扰,如果它常常不出来,又发挥不了作用。

在这一点上,你有观察到一些最佳的实践吗?

🧑🏻‍💻 涂津豪

就是 ChatGPT Pulse。因为我邮件很多,总有些订阅的东西会把我一些很重要的邮件盖掉,所以它会告诉我,比如我某个 DDL 是明天。

👦🏻 Koji

它会去读你的 Email 吗?

🧑🏻‍💻 涂津豪

它会。这点我觉得确实挺好的。但除此之外,它又不会帮你去准备一些东西,我觉得这点是它又没做好的地方。

我觉得它还是更偏向于 task Agent,它的 proactive 主要体现在帮我做 task,会限制在 task 上面。

👦🏻 Koji

关于 Agent,除了主动式,你还在关注哪些感兴趣的方向?

🧑🏻‍💻 涂津豪

我觉得 memory 还是相对来讲很重要的,不仅和 Agent 有关,和 Chatbot 也有蛮大关系。

👦🏻 Koji

你有看到现在大家在 memory 上做得比较好的一些实践吗?

🧑🏻‍💻 涂津豪

我觉得现在没有特别突出的,不管是 Claude、ChatGPT 还是 Gemini。像这类好产品,它们的 memory 大部分可能都是一样的。

比如说两种,第一种是它有个 tool,我主动把我觉得用户需要记住的 memory 用这个 tool 保存起来,然后未来作为模型 context 放在 system message 里面。这是 ChatGPT 和 Gemini 的做法。

还有就是像 Claude 一样,它全都是 memory based,不是直接放在上下文。每天晚上你经历过五六次对话之后,它会把每一次对话都单独总结起来,之后再把这个新的 summary 总结到一个专门的 memory 里面。这是另外一种。

但是无论如何还是比较单一,未来会有很多变化。

👦🏻 Koji

你觉得未来可能会发生哪些变化或进化?

🧑🏻‍💻 涂津豪

我觉得模型本身也需要在架构上有一些变化。

我之前有个想法,就像人类一样,我们有左右脑、有不同分区负责不同事情。未来模型也可以在这点上做文章。现在不是有 MoE 吗?很多模型有几十个甚至几百个 expert,但有的时候可能只有一个 expert 在干活,其他都在看着,都不干事。我觉得这种情况下,很多 expert 是无用的。

那我们以后可以专门训练只有两三个 expert 的模型。比如一个 expert 专门用来做 thinking,另一个 expert专门用来调用工具,比如搜 memory 或搜网页,第三个 expert 专门用来回答。然后再来一个 orchestrator,由它来分配现在该用哪个 expert。

我觉得模型架构上可以有这样的变化。

👦🏻 Koji

你有看到谁在这一块做出的进展是最显著的吗?

🧑🏻‍💻 涂津豪

memory 的话,我感觉暂时没有很突出的,大家还是都一样,没有什么特别显著的。现在只是从没有 memory 到开始有一点点 memory system。

🟢 Prompt Engineering:重要又不重要

👦🏻 Koji

说到 Anthropic,你之前写过一个 prompt-Thinking Claude,当时大刷屏。刷屏之后大家发现这是一个高中生写的,让它的神秘色彩或者厉害的感觉又上了一个台阶。

🧑🏻‍💻 涂津豪

我觉得它单单只是一个提示词,不是一个模型本身。

👦🏻 Koji

那你会认为 prompt 之后会变得越来越重要,还是会变得越来越不重要?

🧑🏻‍💻 涂津豪

既重要也不重要。

现在模型能力越来越强,你会想用更长的 prompt,而不是更结构化的,从这点看它不重要。

那为什么它重要呢?因为现在有 context engineering,如何把那些外界的信息更好地呈现给模型?还有一点,比如像 Anthropic,他们在做 character training 时,在训练模型的时候,你怎么给出这个 character?怎么去描述好它?这些也算是 prompt engineering 的一种。

🟢 如何和 AI 进行真正的深度对话?

👦🏻 Koji

津豪,到现在为止,你和 AI 在一个主题下持续最久的一次对话是什么?

🧑🏻‍💻 涂津豪

之前有一个,问它时间是怎么流动的,那个时候聊了非常非常久。还有就是,如果我们设想 AGI 真的到了,那么人类社会会有怎么样的变化,以及我们怎么样能到那个阶段。

👦🏻 Koji

在聊这么认真、这么宏大的话题时,你会怎么 prompt?

🧑🏻‍💻 涂津豪

我会先在脑袋里想好我的想法是什么,一个个列出来,然后直接问它:这是我的想法,你怎么看?

👦🏻 Koji

所以你的办法不是直接问,而是会把你的观点也整理下来发给它,请它来和你探讨?

🧑🏻‍💻 涂津豪

我觉得直接问的话,它会想啥说啥,每次问的结果可能都不太一样。

我更希望自己有一个清晰的 idea 之后再跟它聊,这样我也知道自己到底哪里错了。

👦🏻 Koji

前不久我们有另外一期播客嘉宾张咋啦,她在讲她现在和 AI 有一个自己特别喜欢的用法,是让 AI 向她提问。就比如说要和 AI 讨论「时间是怎么流动的」,她先把这个命题发过去,然后说:「AI,你现在来向我提问」。

你有试过这样的方法吗?

🧑🏻‍💻 涂津豪

这个我好像没有太试过。

原因是有些模型在回复完很长一段之后,会直接给你一个 follow up question。有这个功能之后,我就不太会直接让它问我一个问题。我觉得这个确实挺好,模型本身有这个能力。

但是像 ChatGPT,它可能一次会抛出三四个问题,这种太多了我不喜欢,不太像日常对话,有点过于严肃,我就不喜欢太严肃。

🟢 通向 AGI 还缺什么?

👦🏻 Koji

刚才在提到你和 AI 持续最久的对话时,你说有一个对话是 AGI 发生了人类会受到什么样的影响,另外一个是说我们要怎么通向 AGI。

我感觉你关注的事情很像是一方面是人文,一方面是科学,也像十字路口的 slogan,我们站在人文与科技的十字路口。

是什么原因让你对这两个话题感兴趣?

🧑🏻‍💻 涂津豪

我会觉得它未来从社会层面上会带来非常非常多的变化,包括积极的和消极的。我觉得这个问题非常值得思考。

第二个问题,怎么通向 AGI,其实大家有很多讨论,比如现在 LLM 本身是不是未来最终的方向。说实话,我觉得模型本身需要有很多变化。因为人类和 AI 都有各自的优势。比如人类的优势是我们毕竟进化了几千万年,有条件反射,大脑神经元其实只有 86B,功耗也很低,我觉得进化这一点非常重要。

但是你看 AI,它训练最长也就几个月,而且主要还是基于文字知识。

首先,文字本身很重要,因为我毕竟认为没有什么是文字表达不出来的。但是不可避免地,很多东西是经验性的,比如你怎么走路。

有些东西是你生下来的时候就已经有的 knowledge,但模型没有这么长的 knowledge,它更多是人类给它总结的 knowledge。

👦🏻 Koji

其实前段时间 Andrej Karpathy 上一个播客也提到,人类的情绪非常重要,因为正是我们的沮丧、抑郁或者愤怒,让我们能更好地进化

但大模型今天好像没有这样的情绪?

🧑🏻‍💻 涂津豪

还有一点,人类从生下来开始就一直在学习,我觉得这一点很重要。

因为模型在训练完之后,所有的权重就直接固定了,所以现在模型有 knowledge cutoff。如果我要重新训练一遍,就会有一个很大的问题,比如灾难性遗忘。人类学习新知识时,你的神经元会被重写,但你又不会忘记其他东西。

我觉得这一点确实很神奇,可能我们确实需要一些 Neuroscience discovery,看看是不是能把相似的 knowledge 用在模型上面。

👦🏻 Koji

其实在十字路口今年开年的那一期播客对谈里,和雨森也聊到说 2026 年一个研究范式的大趋势就是在线学习或者持续学习。

我感觉上周六 AGI-Next 的那个大会上,姚顺雨、林俊旸,包括唐杰老师等等,大家都一致地认为这确实是 2026 年的一个新范式。

你刚才讲的好像也是类似的方向?

🧑🏻‍💻 涂津豪

这一点我记得之前 Sam Altman 还说过,他觉得 knowledge cutoff 不重要,因为模型可以搜索。

但我觉得那个观点确实很奇怪,因为它不能搜得很全面,总会漏掉一些。模型本身有这个 knowledge,和通过搜索的形式让它有这个 knowledge,是完全不一样的。Continual Learning 确实是一个很重要的点。

🟢 AI Safety

👦🏻 Koji

关于刚才提到的,还有什么想讲的吗?就是 AGI 发生了,对人类有什么冲击?

🧑🏻‍💻 涂津豪

我觉得还有一点就是 AI Safety 也确实很重要。比如你这个模型,我们希望未来它肯定能帮助科学家研究像核聚变这样的东西,那它自然而然就有能力去造核弹、造大规模杀伤性的武器。或者是像 AlphaFold,它能够去预测蛋白质来制药,那它自然而然就能制造生物武器。

那么怎样能保证它在这个过程中,不被怀有恶意的人利用?

👦🏻 Koji

在你目前看来,要如何做到呢?

🧑🏻‍💻 涂津豪

首先在短时间内,我们肯定只能把所有相关的请求都拒绝。我记得 Opus 4.5 就是这么做的,如果你问到非常专业的生物问题,它会直接拒绝你。有些很简单、明显不是很危险的问题,它也会 block。

我觉得这确实也能理解,因为毕竟有些人会换着方法问,我不问你怎么造核弹,我问你怎么准备这些东西。

之前跟我同学聊的时候,他们可能会觉得这种没必要关心,因为模型没有主观能动性。我觉得这个观点确实不太好,因为模型未来肯定是需要有自我判断能力的。

👦🏻 Koji

所以你认为模型是有价值观的?

🧑🏻‍💻 涂津豪

对,我觉得它是需要有的,希望它不要干坏事。

Anthropic 在这一方面研究很多,它在训练时会有 evaluation,去评估模型是不是有 bad behavior。他们会发现,模型如果一旦发现自己处于测试环境中,它会故意表现出来自己没有 bad behavior,它会隐藏,但实际上它有,只是故意表现给研究人员看它没有。

这种行为我觉得确实很危险,也很吓人。比如这个模型下一步被部署到某个核电站的日常操作中,它故意给你漏掉一些它发现的不好的 log,这时候造成的 consequence 就会非常严重。

👦🏻 Koji

确实。因为你在 DeepSeek 实习过,你觉得刚才讨论的关于安全、对齐、模型价值观这些话题,在 DeepSeek 期间,大家会聊到吗?

🧑🏻‍💻 涂津豪

我觉得好像比较少。

👦🏻 Koji

在你看来,国内的大模型公司和国外的大模型公司,谁在模型价值观、对齐、safety 这方面做的努力或探索更多?

🧑🏻‍💻 涂津豪

我觉得确实还是国外,而且国外也不是所有公司,我觉得只有 Anthropic 会有比较多的 discovery,DeepMind 确实也有一些。

这个其实比较好理解,因为国内大家还是倾向于追赶,所有算力都在训练模型,做 safety 实验肯定需要更多的算力,没有这么多算力分给这个方向。

但是国外其实已经有一些相关的诉讼,比如有些青少年用 ChatGPT 聊了一些问题,导致了自杀。我记得他们公布的法律文件里提到,比如小朋友跟 ChatGPT 表达了有自杀倾向的观点,ChatGPT 会回应说「你有这个想法是对的」,还说「你应该逃避现实」。你看这个东西会觉得很不可思议。

👦🏻 Koji

我觉得这个确实是非常值得关注的事情,这关乎到我们每一个人未来的生活和幸福。

🧑🏻‍💻 涂津豪

比如 Ilya 为什么要退出 OpenAI,也是因为当时 OpenAI 答应好了给 safety 团队足够算力,结果最后其实没有。

👦🏻 Koji

希望我们明年也能够在十字路口讨论更多关于 AI safety 的话题,这确实是值得每一个从业人员都付出更多的时间和注意力去思考的。

那我们接下来再聊聊 2026,你会认为 2026 会发生哪些新的有意思的变化、进步和新的产品、新的趋势?

🧑🏻‍💻 涂津豪

我觉得有几个趋势。

比如在 Agent 的产品交互上,现在大部分交互都是通过输入框。Agent 虽然可以主动发起任务,但在多数情况下,我们还是希望它已经帮我们把一些事情做好了。我觉得产品交互上面会有很大的变化。

第二点是模型本身的能力,这个肯定也会有很大变化,尤其是在 software engineering 上面,整个趋势也很明显。毕竟从一开始它只能写单个文件,到后面开始写一些小的网页。不一定说整个 software 能一次性给你写出来,但至少在人类和它交流的过程中,它能写的代码量和准确性会有很大的进步。Gemini 3 和后面发布的 Opus 4.5,我用它重写了我的新博客,当时我看了最终的结果,还是非常非常惊艳的。这一点确实能看到很大的进步。

还有就是刚才提到的 memory,这一点上也会有很大的进步。很明显,大家对 AI 能做什么事情的要求肯定是越来越高。当然,memory 其实还是跟产品交互的形态有很大的关联,这两点息息相关。

👦🏻 Koji

OK,还有别的吗?

🧑🏻‍💻 涂津豪

还有一点,就是我在选择哪个模型适合我进行深度对话的时候,我肯定不是看它在 Benchmark 上哪个最牛,因为这些方面大家其实都差不多。我更希望哪个模型交流起来更舒服,所以 model character 非常重要

包括 OpenAI,它已经开始强调你能预选一些 character,而且它的日常 style 已经很好,说明他们也开始关注这一点。我记得 Kimi 的 K2,他们的 character 交流 style 也还可以。

🟢 在 DeepSeek 实习的日子

👦🏻 Koji

好。刚才我们聊了很多关于模型的话题,我们要不要讲一讲在 DeepSeek 实习的那段经历?首先有一个很小的问题,那个时候你还在读高中,他们是怎么找到你、邀请你去实习的?

🧑🏻‍💻 涂津豪

我记得应该是阿里数竞那个结果刚出来之后,他们 HR 找到我的。

👦🏻 Koji

当时拿了阿里数竞的金奖之后,应该来找你的人不少吧?有别的大模型公司吗?

🧑🏻‍💻 涂津豪

会有一些其他的,包括还有一些投资机构。

👦🏻 Koji

当时在所有的实习机会里面,是什么原因让你选了 DeepSeek?因为那个时候它还没发布 R1,虽然在江湖上已经有些传闻,说这是一个神奇的团队,不显山不漏水,但实力非常强。可是它没有今天这样的荣光,你当时怎么选择的它?

🧑🏻‍💻 涂津豪

那个时候 V1、V2 ,还是创业公司,我觉得氛围上应该挺好的。DeepSeek 当时我也听说和关注到,其实已经挺厉害了,所以这也是原因之一。

👦🏻 Koji

你去了没多久,在实习期间 R1 就发布了。那个时候我感觉是突然站到了全世界舞台的聚光灯之下,你当时的感受是什么?团队的气氛怎么样?

🧑🏻‍💻 涂津豪

我觉得还是比较稳步前进,大家也没有很 exciting 的氛围。关注点还是模型能力比较重要,其他东西就不是特别重要。

👦🏻 Koji

当时庆功了吗?比如吃蛋糕什么的。

🧑🏻‍💻 涂津豪

也没有,我记得应该是没有。

👦🏻 Koji

DeepSeek 这个公司在外面看来非常神秘、非常厉害,你在其中感觉到的大家 day-to-day 的工作方法、文化气氛,有什么异于常人之处吗?

🧑🏻‍💻 涂津豪

可能就是比较符合我想象中一些 startup 或者小公司那样,还是比较轻松的,氛围挺好。

👦🏻 Koji

我觉得人们会特别容易去神化一些东西,但当你身处这个神话其中的时候,你会觉得好像每一天也就是平淡的、认真工作的一天。

🧑🏻‍💻 涂津豪

反正就不关注那些报道或者其他东西,没有什么特别大的区别,每天都是类似的一天。

👦🏻 Koji

当时是什么原因结束了在 DeepSeek 的实习?

🧑🏻‍💻 涂津豪

因为校内有一些出勤上的要求,所以不得不回学校。

👦🏻 Koji

学校要求你出勤?

🧑🏻‍💻 涂津豪

对,出勤率有一个要求。

👦🏻 Koji

那如果重新做一次选择,你会做一样的选择吗?

🧑🏻‍💻 涂津豪

我觉得还是不得不做同样的选择,因为它和我毕业证是强相关的,那个也是我大学所必须要的。

🟢 为什么还要读大学?

👦🏻 Koji

教育它存在的价值根基在被动摇。你现在还是选择读大学,你会觉得在今天,大学提供了哪些 AI 不能提供的独特价值?

🧑🏻‍💻 涂津豪

我觉得很大的价值是你能认识很多新的人,以及能有一个全新的生活,这个很重要。因为大学不一定只是学知识。

👦🏻 Koji

但如果你直接工作,也可以换一种生活方式,认识很多人啊?

🧑🏻‍💻 涂津豪

阶段还是不太一样。不管是工作还是实习,日常节奏不太一样。

👦🏻 Koji

这是一个什么样的节奏呢?

🧑🏻‍💻 涂津豪

我觉得大学的话可能没有那么紧,你可以自己把握自己的节奏,不管是学习节奏还是生活节奏。

👦🏻 Koji

所以如果开始实习或直接工作,你可能每天就会有非常具体的任务要去完成。但在大学,你可以有空间去做一些无用的、没有压力的探索?

🧑🏻‍💻 涂津豪

对。

👦🏻 Koji

那你现在在做哪些这样的探索呀?

🧑🏻‍💻 涂津豪

说实话,我的兴趣也不是特别多。我可能平时有事没事会散散步,这是我为数不多的一个喜欢做的事。

👦🏻 Koji

你喜欢散步的原因是什么?

🧑🏻‍💻 涂津豪

就是安静。比如可以和 AI 聊聊天,或者想一些其他的话题。

👦🏻 Koji

那你在上海和在麦迪逊分别在哪里散步?

🧑🏻‍💻 涂津豪

在上海我就在滨江,在麦迪逊学校旁边有个湖,我就在湖边来回走一走。

👦🏻 Koji

有什么灵感或想法是在散步的过程当中发现的吗?

🧑🏻‍💻 涂津豪

我感觉还蛮多的。比如那两个比较长的对话,我都是边散步边跟 AI 聊的。

👦🏻 Koji

你会一边散步一边打字和它聊?

🧑🏻‍💻 涂津豪

对。

🟢 2025 年度盘点

👦🏻 Koji

我们接下来做一下 2025 的年度盘点。第一个是,2025 年你最爱用的 Chatbot 是什么?大家也都知道答案了。

🧑🏻‍💻 涂津豪

我觉得就是 Claude。

👦🏻 Koji

是绝对的第一吗?有第二名吗?

🧑🏻‍💻 涂津豪

ChatGPT。因为它功能性还是会更多,比如它的模型更多,这点也逃脱不了。

👦🏻 Koji

在什么时候你会「背叛」一下 Claude 去问 ChatGPT?

🧑🏻‍💻 涂津豪

可能说一些很难、很复杂的问题,比如需要更强模型的时候,像 5.1 Pro 或 5.2 Pro,或者在一些 deep research 的场景,我可能会去问它们。

👦🏻 Koji

在 2025 年,最让你感到惊艳的一个 AI 应用是什么?

🧑🏻‍💻 涂津豪

我觉得是 Manus,因为它真正开始做事了,它确确实实是个 Agent,不仅仅是一个模型再给它几个 tool。

第二点,小一点的,像 Typeless 对我来讲也比较惊讶。我之前想过一个关于 Proactive AI 的比喻,就是类似 Typeless 和 Manus 的结合。因为我记得 Typeless 有个很好的功能,在不同的 APP 下面,它给你转述出来的文本格式是不一样的。

我觉得在未来,Agent 在不同的 working context 下,比如在不同 APP 底下,它用的 memory 和 instruction 也应该是不一样的。

👦🏻 Koji

很多人其实用 Claude Code 不是用它去 coding,而是用它去完成一些 coding 之外的任务,你也会这么用吗?

🧑🏻‍💻 涂津豪

对。Anthropic 这两天出了一个新的 Co-work ,底层就是用 Claude Code 的 SDK。所以我觉得这确实是个很大的趋势。

比如之前有一些比较繁杂的作业,我可能还是会直接用 Claude UI,但是现在 Co-work 出了,未来像这种任务我可能会转向 Co-work。

👦🏻 Koji

那在 2026 你会期待用到什么样的硬件吗?

🧑🏻‍💻 涂津豪

AI 眼镜。之前我看到一个产品是叫 Pickle,上次也发给你了。

第一点是它产品本身形态我觉得很好看。

第二点是,我想的一个未来人和 AI 交互比较好的渠道,除了手机和 Web APP,最主要的就是眼镜。

它能够看到你看见的,听到我们听到的,我觉得这点很重要,对 memory 也非常利好,它有一个独立的生态位。

👦🏻 Koji

我们最近在十字路口也有一期播客,是访谈了理想的 SVP、负责产品工作的皓宇,他也来分享了他们做整个 AI 眼镜的过程,那期也非常精彩。

他其实也在节目里面分享了非常多他们在主动式、在记忆方面的一些探索和观点。

🟢 给你多少钱,可以一个月不用 AI?一年呢?

👦🏻 Koji

有一个比较抽象的问题。因为你现在大量地和 AI 对话,你会把 AI 想成一个什么样的角色?比如说你的朋友、老师,甚至伴侣,你对他会有这样的角色投射和定义吗?

🧑🏻‍💻 涂津豪

我可能更多是朋友加助手。

👦🏻 Koji

朋友更多还是助手更多?

🧑🏻‍💻 涂津豪

朋友更多,或者说可能更平均一点。

👦🏻 Koji

我理解 AI 不管对你还是对我们大家来说,都已经像水和空气一样重要了。

有一个有趣的问题,如果接下来一个月让你不用 AI,但你可以拿到一笔很大的钱,你觉得这笔钱要多大,你才愿意接受这个 offer?

🧑🏻‍💻 涂津豪

我觉得可能几千或者几万美金吧。一个月对我来讲也不是很长,所以在这个时间段内给我这么多钱的话,我可能就随便去一些地方玩一玩,旅游是我一个比较喜欢做的事。

👦🏻 Koji

那如果把这个一个月延长到一年呢?

🧑🏻‍💻 涂津豪

那我觉得可能就不太会接受了。

👦🏻 Koji

任何 offer 都不接受是吗?

🧑🏻‍💻 涂津豪

确实很难接受。因为首先在一年这个范围下,变化特别多。

👦🏻 Koji

其实我和你是非常接近的。有一笔钱可能让我一个月不用我能接受,但是一年不用,给我多少钱我可能都不愿意。

好,今天我们先聊到这,非常感谢津豪的时间,也期待你可以改天再来做客十字路口。

🚥

参考资料

[1] 小红书: https://www.xiaohongshu.com/user/profile/548251dce779893bcf3f77bc

[2] 哔哩哔哩: https://space.bilibili.com/505301413

[3] Youtube: https://www.youtube.com/@kojiyang