设计流程这件事 agent 干得很好,但它不会替你值班。把重复的活冻成一条常驻产线,每次留一张带校验的工单——附三条公开在跑的样品线。
credit、倍率、积分——这套东西存在的目的就是让你算不清。我们把每次调用的真实上游成本按工具聚合成一页,免费,可导出。
一批发票进去,一张台账出来。每张都在代码里验一遍"未税+税=价税合计",错的那张标出来并报出差多少。实测三张里藏一张错的,它报 off_by 30。
抽掉一笔流水再让它读,它报出差额 642.30 并指出从哪行开始对不上。把会计的勾稽关系写进代码,当作准确率的自检。
MySQL 的 LIMIT 10, 20 搬到 PostgreSQL 会变成另一页数据;NULL 的排序位置两家默认相反。12 组真实转译实测,附一条能直接 curl 的检查通道。
两栏排版会把你的经历读串,表格里的联系方式可能整个消失。做了个像 W3C 校验器一样的简历检查:只判"机器能不能读懂",不评价你写得好不好。
盯页面变化、定期重查一个问题、监控可达性——这些活不需要你留着电脑开机。任务跑在服务器上,只在结果真的变了时才通知你。
OpenAI API 不通、Anthropic API 通;npm 官方源 2.6 秒、国内镜像 0.38 秒。20 个开发者常用服务的每日实测,数据公开可取。
徽章、图表、Mermaid 架构图、二维码,全都是一条 URL 一张图,直接写进 README。还能让图直接指向仓库里的源文件——改代码,图自动跟着变。
一份别人没有的真实计费数据:同一套计费口径下,gpt-5.6 是 deepseek-v4-flash 的 12 倍价、3 倍慢。给 AI agent 配默认模型,别一把梭。