我想做个自动给文章写摘要的小工具,不靠现成产品,就自己接 API。一开始怕花钱没底,后来摸出门道,其实成本很好算。

国内几家我都试过。 火山方舟 和 阿里云百炼 接入文档顺,控制台能看到每次调用的消耗,适合新手先跑通。 智谱开放平台 和 腾讯混元 的接口风格接近 OpenAI,我换模型基本不用改代码。

想要一家账号管多家模型,我用 OpenRouter。它把不同家的接口统一了,我试新模型时不用再注册一遍,额度也集中在一处看。 百度千帆 和 硅基流动 我用来跑开源权重,便宜,适合量大但不要顶配效果的活。

估成本我先算一笔账。看清楚单价是按 token 还是按次,输入和输出的价格通常不一样。我把小工具每天大概调多少次、每次输入输出多少字估出来,乘一下就有月预算上限,再留三成余量防突发。

控额度我有三招。第一是给每次请求加超时和重试上限,别让一次卡死把额度烧光。第二是把结果缓存起来,同样的问题不重复调,能省一大笔。第三是在代码里写死每日上限,到了就停,第二天再说。

选渠道看你要什么。图省事统一入口选 OpenRouter,图便宜跑开源选硅基流动,图文档和国内合规选火山方舟或百炼。我一般小项目先用一家跑通,量大了再搬。

新手最容易踩的坑是不设上限就上线。我第一个工具忘了加每日封顶,半夜被刷了一波,第二天才发现账单。从那以后上限是必选项。我第一个小工具是给公众号标题打分。接的是智谱开放平台,文档里有现成示例,我照抄改参数就跑通了。跑通之后才换更便宜的渠道,没一上来追求最优。

鉴权我吃过亏。早期把密钥写进前端代码,被人刷了几次调用。现在密钥只在后端用,前端只发请求拿结果,安全这块不能省。

错误处理我逐步加的。一开始只管成功路径,某个模型返回格式变了工具直接崩。我后来统一接一层适配,把不同家返回转成同一种结构,换模型不影响上层逻辑。

批量任务我一定加分批和限速。有回一口气发几千条,额度打满还被限流。改成每批几百条、中间歇一秒,总耗时反而更短,还不被封。

日志我每版都留。哪天成本突然涨,我能翻日志看是哪段提示词变长、哪个模型换贵了。不记日志,钱花哪儿自己都糊涂。

模型选型我有个笨办法:拿同一段输入,挨个渠道跑一遍,把输出质量、延迟、花费记成表。数据摆出来选谁一目了然,不靠感觉。

免费额度我先用足。多数平台新账号有赠送额度,我拿它把流程跑顺再考虑付费,不花冤枉钱。版本我也控,接的模型升级后行为可能变,我锁一个版本号,要升级先小流量测,确认没退化再全量。

上线前我用假数据测一遍全流程,确认输入输出都对,再接真实流量。省得用户在线上撞到我没测到的边界。监控我也加一条:每天统计调用次数和花费,超过预警线就告警,小工具没人盯着,靠告警才放心。

我最开始想一步到位选最便宜的,结果踩了兼容坑。现在原则是先跑通再优化成本,顺序不能反。一个能用的贵方案,好过一个跑不起来的便宜方案。兜底我也准备。哪家渠道抽风,我切到另一家,接口已适配好,切换不痛。小工具怕单点故障,多接一家心里踏实。

我给每次调用打标,记清楚哪个功能走了哪个模型。月底看报表,哪个功能最烧钱一目了然,下年预算好估。

提示词我也版本化。哪版效果好存一份,调优都从它出发,不乱改,回溯时知道哪次改动让质量掉了。

成本异常我设告警。单次花费超均值三倍就提醒,多半是提示词被改长或模型被换贵,能早发现问题。

新手我建议从最简单场景起步。别一上来做大系统,先让一个接口跑通,再慢慢加功能,跑通的信心比架构图值钱。

我还会定期审计依赖。接的 SDK 版本升了行为可能变,我锁版本,要升先测,不让上游偷偷改我的结果。你打算做什么小工具?告诉我场景,我把对应的接入顺序和预算模板发你。