博客

写的都是自己跑出来的东西:真实计费账单、真实网络测量、真实踩过的坑。 不做行业综述,不转述别人的结论 —— 那种东西你在别处已经看得够多了。

我让 agent 第四次跑同一份对账时,才意识到问题不在它

2026-08-20

设计流程这件事 agent 干得很好,但它不会替你值班。把重复的活冻成一条常驻产线,每次留一张带校验的工单——附三条公开在跑的样品线。

AI, Agent, 对账, 自动化

你的 agent 这个月花了多少?大部分人答不上来,因为供应商不想让你知道

2026-08-14

credit、倍率、积分——这套东西存在的目的就是让你算不清。我们把每次调用的真实上游成本按工具聚合成一页,免费,可导出。

AI, Agent, 成本

让 AI 录发票,真正的风险不是录错,是你不知道哪张错了

2026-08-14

一批发票进去,一张台账出来。每张都在代码里验一遍"未税+税=价税合计",错的那张标出来并报出差多少。实测三张里藏一张错的,它报 off_by 30。

AI, 财务, 发票

让 AI 读对账单,最大的问题不是读错,是你不知道它读错了

2026-08-13

抽掉一笔流水再让它读,它报出差额 642.30 并指出从哪行开始对不上。把会计的勾稽关系写进代码,当作准确率的自检。

AI, 财务, 文档处理

SQL 方言迁移最坑的不是报错,是那些不报错的

2026-08-13

MySQL 的 LIMIT 10, 20 搬到 PostgreSQL 会变成另一页数据;NULL 的排序位置两家默认相反。12 组真实转译实测,附一条能直接 curl 的检查通道。

SQL, 数据库, 迁移

简历投出去没回音,可能不是你不够好,是机器根本没读到

2026-08-13

两栏排版会把你的经历读串,表格里的联系方式可能整个消失。做了个像 W3C 校验器一样的简历检查:只判"机器能不能读懂",不评价你写得好不好。

简历, 求职, ATS

让 agent 在你关掉电脑之后继续干活,不用自己搭一台机器

2026-08-13

盯页面变化、定期重查一个问题、监控可达性——这些活不需要你留着电脑开机。任务跑在服务器上,只在结果真的变了时才通知你。

AI Agent, MCP, 自动化

我把机器放在中国大陆,每天测一遍那些"到底能不能连"的服务

2026-08-13

OpenAI API 不通、Anthropic API 通;npm 官方源 2.6 秒、国内镜像 0.38 秒。20 个开发者常用服务的每日实测,数据公开可取。

中国大陆, 网络, 开发者

给 README 加动态徽章和图表:一条 URL 搞定,不用注册也不用 key

2026-08-12

徽章、图表、Mermaid 架构图、二维码,全都是一条 URL 一张图,直接写进 README。还能让图直接指向仓库里的源文件——改代码,图自动跟着变。

README, 开源, 工具

给 agent 选默认模型,我用两周真实账单交了一次学费

2026-08-12

一份别人没有的真实计费数据:同一套计费口径下,gpt-5.6 是 deepseek-v4-flash 的 12 倍价、3 倍慢。给 AI agent 配默认模型,别一把梭。

大模型, AI Agent, 成本

持续更新的数据页

大陆可达性实测 —— 20 个开发/AI 服务每天测一遍, 从中国移动骨干网真实出口,海外机器给不出这个结果。
模型实测成本 —— 同一道题喂给不同模型,记录真实计费与耗时, 不是厂商标价而是实际账单。