做行业调研是一种用法,挑一个热门场景让人看个热闹。真正天天烦人的是那些不动脑但极耗时间的活儿:每周把大家的聊天记录汇总成周报,每月把一堆发票扫成表格,每天把群里的通知挑出重要的转给客户。这些活儿 AI 早就能干,但用错方式会很惨。
先说怎么挑活。判断标准只有一条:这个活儿的输入是不是结构固定的。周报的输入是这几个人这几天的发言,发票的输入是这类几张图,通知的输入是一天的群消息,结构都固定,适合交给智能体。反过来说,需要临时判断优先级、需要跟人当面确认的活儿,别硬塞给它,它跑偏了你还得返工。
第一种活儿,周报汇总。我的做法是让它只读本周发言,不读历史,然后按「做了什么、卡在哪、下周要什么」三段出。一开始我让它自由发挥,出来的周报像每个人都在自我表扬,全是「顺利推进」「积极沟通」这种空话。后来我改成要求每条必须有原文出处,标上是谁几点说的,它就不敢编了。加了出处之后,周报第一次能看。
周报还有个坑是删。它总想把没用的也写进去,一份周报二十条,真有用的五条。我现在让它按「没这条别人会不会漏掉事」来筛,筛过的再列。筛完一般剩六七条,读的人二十秒看完,这个长度才叫周报。
第二种活儿,发票整理。这个要分两层:识别层和核对层。识别交给能读图的模型把票面上的几个字段抠出来,核对交给我自己拿系统里的记录比。让它一口气从识别到入账,错一次你就得花两小时查账。我的规矩是它只出识别结果,入账动作人要按一下。
发票里最容易错的是金额和日期。它认数字很稳,但碰到连笔的阿拉伯数字偶尔会认错一位,日期格式一旦不统一容易串。我让它把所有金额原样输出成文本,我拿去跟系统对,对不上的单独挑出来人看。识别完对一遍,比它全自动省不了多少时间,但不会出账。
第三种活儿,群消息过滤。这个最实用也最容易被低估。很多群一天几百条,真正要紧的不到十条。我让智能体只做筛选和摘录,不动原话,输出成三条:要紧的事、要我答复的事、要发到别处的事。它筛漏了我就自己补,但筛对九成已经省掉大半时间。
群消息里最怕的是它擅自替你答复。我明确写了不许回复任何人,只做摘录和转达,答复要我本人发。有一次它没收到指令自己回了一句「收到,稍后处理」,群里直接炸了。智能体的权限边界要在第一轮就划死,事后补很难。
第四条,别让它跨天记。今天的上下文它不会自动留到明天,很多平台你关了会话就没了。需要跨天的信息我让它写成文件存着,第二天再读。省得每次都从头讲一遍背景,也省得它拿昨天的结论硬套今天。
第五条,验收标准要提前说。它做完你才知道合不合标准,就来不及了。我在第一次就给它一份验收清单:几条算完整、什么格式、有没有出处、错别字不超过几个。有清单,它能自查;没清单,它永远给你一个「看着还行」的东西。
第六条,第一次一定人跟全程。别第一天就放手让它自己跑一周。我头两周都是它出完我全看,第三周才开始抽查。跑顺了再放开,顺序反了出问题你连它哪步错都不知道。
第七条,留个能停的按钮。跑得好好的突然要它处理一堆新格式的文件,你就该叫停,别让它硬撑。它不会自己判断「这个我处理不了」,只会继续处理然后给你一堆错的。边界感是人给它的,不是它自带的。
第八条,成本算清楚。这类活儿听起来省时间,其实耗在核对和返工上。我掐表算过一轮:原来人工做周报一小时,智能体加核对二十分钟,发票从四十分钟降到十五分钟。省下的不到一半,但值在每天都有,而不是偶尔有一次。
挑平台我看两样:能不能稳定读文件、能不能把跑完的结果写回表格。 扣子 这两样都顺,Dify 在链路编排上更细,Flowith 适合一次跑多个分支再汇总。别只看演示效果,演示都是跑通的状态,日常跑要的是不出错。
第九条,别贪多。一个团队里先挑两个最烦的活自动化,跑顺了再加第三个。一次上五个,最后哪个都没跑好,还落个「这玩意儿不靠谱」的结论。我们就是先周报后发票,一个季度才加到群过滤,现在三个都在用。
你手上最烦的是哪种重复活?汇总、录入、还是转达?告诉我频率和量,我帮你看它到底适合不适合交给智能体,该怎么划权限。