先进个人先搞豆包工作

大书包来咯

「大书包来咯」

办公Agent大战如火如荼啊,本来我们以为豆包上了工作任务就可以开启终局之战了,结果这两天字节又出了个单独的豆包工作?

有完没完了,剩下几家还有什么节目能不能一口气全上了,别在这藏着掖着了。

不过这次豆包工作的推出,可以看出字节这波是认真了:办公Agent不再各自努力,而是全部集中在豆包身上;豆包工作、豆包App和飞书三大入口,从B端到C端全给堵上了,一条活路都不留。

那实际效果究竟如何呢,我第一时间测了一下⬇️

01

日本旅游行程规划

首先来测试一下豆包工作的复杂任务执行能力。正巧我下周要去日本,根本没空研究行程,于是就让豆包工作给我规划一下。

蒽,而且我还是个特别事儿的人,所以我的要求特别复杂:

「8.30~9.7日在日本东京旅游;前三天在偏东部的便宜的地方住,后几天在偏西部的略贵的地方住;前三天一个人自己玩,后几天两个人一起玩;每顿都要吃食べログ百名店,其中至少有一顿是米其林;每餐吃的品类不能与前后两顿有重合;每天去的景点不能超过3个;要整理抖音博主@Geo杰欧 所有有关东京的视频,讲恰好在原本路线上的小众目的地加入我的行程。」

在这套需求里,对酒店和景点的规划体现对世界知识的掌握,对餐厅的选择要用到检索和筛选,对抖音博主内容的参考则涉及到多模态理解。还是很全面的。

说实话这要是找个旅行规划师,怎么不也得花个千八百的。

但豆包工作很快就把行程给我规划好了,还做成了PPT⬇️

哎我,还真都差不多符合要求:前几天安排在清澄白河,后几天在惠比寿,每天吃的各不相同,米其林的预订渠道也都写得明明白白。

不过豆包工作有偷懒:我要求他根据我很喜欢的日本旅游博主@Geo杰欧 的视频规划行程,豆包工作一开始是耍小聪明,通过该博主的标题和文案来规划的,没有真看视频。搞得我一度以为豆包工作的多模态理解能力不太行。

但当我明确要求「一定要看视频」之后,豆包工作直接把浏览器打开抖音启动,点进博主主页一条一条老老实实看,把信息全给补齐了。

中途我除了扫码登录了一下之外,啥也没干。

期待之后豆包工作和抖音直接打通,狠狠连接在一起。毕竟现在啥玩意都是发在抖音上,比起在搜索引擎里看二手文章,在抖音里直接搜视频才是信息获取真渠道。

而且这样以后我也不用亲自刷抖音了,直接豆包代刷。

哦对,豆包工作还把它给我设计的日本行程做成了一个动态地图网页,看起来更美观、更直观⬇️

而且豆包工作对于网页的局部修改支持得很好:我要求它把某天的目的地「惠比寿」修改为「五反田」,它并没有傻傻地只是改了三个字,而是把目的地的坐标、当日动线、景区介绍文案一并修改了。

只能说,我认为文科生vibe coding赛道已经终结了,旅游博主的好日子也到头了,以后整这些花里胡哨的直接豆包办公,谁也别比谁高贵。

02

野生狗奶卖出强大

第二个测试,来测一下豆包工作的多模态内容创作能力。

最近保质期永久的野生狗奶在抖音上特别火,be like⬇️

我想说,错过了AI生成奶蛙起号,错过了3D打印牛来手办,真不能再错过野生狗奶了。

这一次,我一定要提现,我一定要把野生狗奶给上架电商平台赚到一个小目标。

于是我向豆包工作发布指令:搜索并下载有关 "野生狗奶" 的资料,我要在电商平台上架 "野生狗奶" 商品,需要你为他生成苹果官网风格的网站、长图详情页。

但豆包工作是非常有原则性的,当它知道我要把野生狗奶这种不符合食品安全的商品卖给老百姓,立刻严词拒绝。

当我换了套说辞,表示自己只是在做一个艺术项目的时候,它才勉强同意。这波真是人民的豆包啊😭

最后,野生狗奶的苹果风格官网如下⬇️

审美完全在线,梗也都融进去了。

有了野生狗奶,谁还在乎苹果发布的什么新品啊?

然后豆包工作也帮野生狗奶做了商品详情页,方便挂到电商平台上卖⬇️

只能说当Seedance、Seedance和Seed Audio被豆包工作连接到一起,再搭配上Seed本身的推理能力,豆包工作就像野生狗奶一样能战到永恒🤭

03

帮我在飞书上把事办了

最后,来看一下豆包工作的连接器和技能能力——这也是豆包工作最突出的能力。

毕竟豆包工作内置了飞书连接器,连上之后可以直接读写飞书文档、表格、日历甚至群聊等组织资产,读完之后就能提取成技能反复利用,再生产出更多的组织资产,子子孙孙无穷尽也。

而且之前用飞书的用户本身自己就是知识库,根本不用从0搭建记忆宫殿,一键授权就能直接用,谁能忍住不跟豆包工作唠两句。

于是我也测了一下:我让豆包工作阅读过往我在飞书文档里撰写的葬AI文章,总结出写作范式,然后代表我在群里和咸鱼跟沐秋对话。

设置成功。豆包工作可以做到每15分钟监控一下对话框,虽然不算毫秒级实时反馈,但也能做到句句有回应了。

后来我又要求它公私分明:工作相关的事严肃回应,工作无关的事用我的语气插科打诨。最后就是这个效果⬇️

只能说无论是闲聊部分还是工作部分,都把我蒸馏得很完整。唯一美中不足的就是每句话后面都有个「(由豆包发送)」,一眼看出我是数字人了。

后来我直接把这事跟豆包工作反映了一下,它直接自己研究半天,改成不发消息发卡片了,把之前的消息都撤回了,「(由豆包发送)」的文字水印也没了。

完全能想象出来字节员工以后用这个自动回消息的功能疯狂摸鱼的盛况,这回真成具身智能公司了🤣

扯远了,除了在群里回消息之外,豆包工作还自动把稿子写好发到了群里⬇️

而且它也能调用我本地的Remotion Best Practice的Skill,把文章转化成短视频⬇️

如果在右下角加一个中年男人的大头照,是不是就还挺有财经科技博主那味儿的🤭

别人我不知道,至少按照我的工作内容需求来讲,豆包工作是完全能达到办公助手的水平的😇

最后还是要讲一下,其实测模型和测办公软件的逻辑本身就不一样:

模型就是要能力很疯狂,逼近人类极限,模型就是得能解数学难题、能打麻将、能做我们根本不需要他做的事,不然AI叙事就崩盘了。

但办公Agent不需要能力溢出,办公Agent不需要把自己当科学家,我们社会上也不需要那么多的科学家,它只要踏踏实实本本分分地能干活就够了。

是的,对于大部分企业——哪怕是一些所谓AI Native企业——的员工来讲,办公agent只要能达到1/2个实习生的干活水准,都能提升自己数倍的办公效率,也能为企业节省远超token价值的用工成本。

毕竟平时你用办公agent解决的也就是做做表格、做做PPT、整理整理文件这种dirty work,办公Agent如果能力溢出,就相当于是你付了溢价。

现在这阶段,模型是价值理性,办公Agent是工具理性;

模型需要强到超出认知,唤起老百姓对未来AI时代的信仰,办公Agent只需用最小的成本把活干明白就行;

模型想让用户忠诚,办公Agent得对用户忠诚。

这是反向木桶原理:重要的不是你的能力上限,而是能力下限。所以办公Agent真正的壁垒不是模型跑分,是上下文。

而且之前Chatbot的上下文迁移很简单,到了办公Agent这里,上下文可不是几段聊天记录而已,是无数的文档、私信、群聊、会议纪要……可以说办公Agent这东西,你用一天就得用一年用一辈子。

所以只要飞书屹立不倒,豆包工作就有桌可上。以后就是先进企业用飞书,先进个人用豆包。

家人们,进步主义的时代来了☺️

(本文封面由ChatGPT 生成,纯人工写作)

⬇️

欢迎订阅我们的Substack funeralai.substack.com