《Token 成本的现实账单:大模型为什么还难以无限替代程序员》
阮一峰从 Token 费用和漏洞赏金滥用谈起,提醒 AI 的真实成本、激励结构和质量控制仍是落地硬约束。
🧠 agentic reading|1️⃣ 精准输入
导语
阮一峰这一期周刊用两个案例提醒:AI 编程的瓶颈不只是能力,而是成本和激励结构。一个程序员如果无限量使用顶级模型,账单可能高到公司无法承受;大模型进入漏洞赏金,也会冲垮原有反馈机制。
1. 一个人的 Token 用量可以贵到像一家公司
OpenClaw 创始人展示一个月 760 万个请求、6030 亿 Token,按预设费率约 130 万美元。这个数字对他本人不是实际支出,但用量真实。如果公司按市场价购买同等模型调用,单个高强度 AI 编程用户就可能制造百万美元级月账单。
2. 便宜模型能降成本,但不能消除约束
国内便宜开源模型可能只有国外旗舰模型 1/30 到 1/50 的价格,但按高强度使用计算,一年仍可能达到 200 万到 300 万人民币。结论不是 AI 编程不可用,而是“不限量使用顶级模型”不可能成为普通公司的默认配置。
3. 巨头也会被账单迫使收紧
周刊提到 Uber 今年前 4 个月就花完全年 AI 预算,不得不限制使用;微软也因费用问题放弃 Claude Code,改用自家托管模型。如果 Uber 和微软都不能无痛承担 AI 调用成本,普通公司更不可能把外部模型 API 当成无限水龙头。
4. 漏洞赏金被 AI 垃圾提交冲击
Turso 的漏洞赏金计划原本激励真实安全研究,大模型普及后却吸引大量低质量漏洞报告。维护者需要筛查看似专业但实际无效的提交。AI 降低了提交成本,也降低了滥用成本。
5. 替代的前提是总成本下降
AI 是否替代程序员,不能只看模型能力,而要看“模型调用、工程验证、返工、管理约束”的总成本。如果总成本没有下降,AI 更像增强工具,而不是替代方案。未来 Token 价格大幅下降后,判断才可能改变。
6. 成本控制会反过来塑造产品形态
一旦 Token 成本成为硬约束,AI 编程产品就不会只比拼最强模型,而会比拼路由、缓存、上下文裁剪、任务分级和本地验证。简单任务用便宜模型,关键判断才调用强模型;重复资料要结构化存储,而不是每次重新塞进上下文。真正成熟的 AI 工作流,会把省 Token 设计成架构能力,而不是靠人临时克制。
7. “算法公司”隐喻说明替代不会一步完成
周刊后半部分还引用了“公司不过是算法图”的说法:公司由流程、判断、权限、反馈和协作构成。这个比喻支持 AI 长期潜力,但也说明替代不会简单发生。如果公司是一张算法图,那么 AI 要替代岗位,就必须接入这张图里的上下文、权限、验证和责任链。现阶段最贵的不只是生成代码,而是让生成结果可靠地进入真实组织流程。
8. 成本、质量和责任会一起决定落地速度
许多 AI 讨论只看单次回答质量,却忽略真实软件项目有回归测试、安全审计、上线窗口、维护文档和事故责任。便宜模型可以处理草稿,强模型可以做关键判断,但整个系统仍需要人来定义目标和承担风险。只要责任不能外包给模型,企业就会把 AI 当作可控增强,而不是无上限替代。这也是文章把 Token 成本和漏洞赏金放在一起的原因:两者都说明生产成本下降后,审核和治理成本会变成新瓶颈。
结论
文章的核心是成本现实。AI 编程有价值,但公司会按账单重新定义可用边界;漏洞赏金案例则说明,AI 不只提高生产力,也会破坏原有激励机制。
思想框架
文章先用极端 Token 账单建立成本感,再用 Uber、微软等例子说明巨头也会收紧使用,随后转向漏洞赏金被 AI 垃圾提交冲击。整体逻辑是:能力叙事必须接受成本和激励结构检验。
建议阅读原文:这篇是中文内容,精准输入只帮助你快速抓住重点,原文的叙事、语气和细节仍值得回读。
ruanyifeng.com · 3 mins
✍️ think & write|2️⃣ 费曼输出
我的笔记
✍️ 写下你的想法,自由记录即可。如果没有灵感,试着回答上方的费曼输出问题。
登录后可记笔记
登录后可保存笔记、高亮、划线和批注。