我手机里现在常开的国产大模型至少有五个。早几年我只会盯一个用,结果要么长文档喂不进去,要么复杂题答得飘。后来我改成按活儿分人,效率一下就上来了。
豆包 是我的随手问工具。等电梯、改文案、想个标题,我直接丢给它,它秒回,语气还轻松。它免费额度大方,日常零碎需求我基本不心疼。
长材料我交给 Kimi。上次我让它读一份一百多页的行业报告,它把关键结论和对应页码都拉出来了,我只需要对着核实。它的长上下文是真的能打,这是它和其他家拉开差距的地方。
遇到要动脑子的活,我切到 DeepSeek。写复杂的正则、推一个业务逻辑、算带条件的统计,我开它的深度思考模式,等它慢慢想,出来的东西比我自己闷头写稳。
写作类的长文我常用 通义千问。它中文语感顺,给我列提纲、扩写段落都自然,不会一股机器味。我写周报和复盘时拿它打初稿,再自己收。
文心一言 我留着查中文语境的东西。有些本土的政策、网络梗、生活常识,它理解得更贴,比通用模型少一些翻译腔。
智谱清言 是我写代码和搭小 Agent 时的备选。它的工具调用和长任务拆解比较稳,我做过一个定时抓数据的脚本,让它出的第一版结构就能跑。
开会和语音相关的我找 讯飞星火。它有语音和会议场景的底子,我录一段口播让它转写加提炼,比纯文字模型顺手。
海螺AI 我用在声音和视频上。配个音色、剪一段带配音的短片,它比通用对话模型直接。
腾讯元宝 我偶尔接微信里的活。文档丢进去问、聊天记录里捞信息,它和腾讯系产品的衔接让我少切好几个 app。
天工AI 我当备选搜索。有时候一个问题豆包答得泛,我换它搜一遍,视角互补。
分工不是固定的。同一个需求我先判断它吃不吃长上下文、要不要推理、偏不偏中文。三秒钟归类,再决定开哪个。这样既不浪费贵的额度,也不拿错工具干重活。
便宜的活别用贵的模型。随手问、改错别字这类,我一律豆包,免费就够。把 DeepSeek 的深度思考留给真正难的题目,它的算力才不白烧。
长文别硬塞给短上下文模型。我以前图省事把整本书丢进某个模型,它中途就忘了前面。现在超过几十页一律 Kimi,省得反复重述背景。
推理题别指望通用闲聊模型。有一次我让它推一个库存扣减的逻辑,它给的流程看着对,一跑就错。换成 DeepSeek 深度思考,它把边界情况列全了,我才放心。
切换是有成本的。我给自己定了条规矩:一个问题先在一个模型里问到底,实在卡住再换。频繁横跳反而打断思路,还容易把前面的上下文弄丢。
我攒了个简单的判断表。随手、中文、短答,豆包。长文档、长对话,Kimi。推理、代码、数理,DeepSeek。写作扩写,通义千问。语音会议,讯飞星火。各取所长,不跟单个模型死磕。
多模型交叉验证很重要。关键结论我常让 DeepSeek 和 Kimi 各答一遍,对上的我才信。尤其数字和条款,两个模型一致我才往正式材料里放。
免费额度要算账。我每月大致记一下哪个模型烧得多,发现 DeepSeek 的推理题最费,就把它限定在硬骨头上,零碎活让豆包扛。一年下来省了不少订阅钱。
新人最容易犯的错是一个模型用到底。我带过的同事里,有人拿闲聊模型写代码,有人拿推理模型改标点,都别扭。先认识每个模型的脾气,再谈搭配。
工具之间搬运内容我用复制加精简,不整段搬运。模型给的初稿我都会重写关键句,保留自己的表达。AI 是协作,不是代笔,这点我越用越清楚。
你现在的活主要集中在哪类?告诉我偏写作、偏代码还是偏资料,我把对应的分工表给你细化,省得你从头试错。