开发者生态
morning
别再所有人平分AI算力:顶级模型给资深工程师才省钱,新人刷题式成长已失效
2026-08-12
1 阅读
约10分钟阅读
褚杏娟
字号:
随着 Claude Code、Codex、Kimi Code 等编程智能体快速迭代,软件开发正从“人写代码、工具辅助”,转向“人定义目标、Agent 持续执行”。模型不仅能够生成代码,还开始自主调用工具、调试程序、压缩上下文,甚至连续工作数小时。与此同时,模型调用成本、生产环境责任、验证闭环、人才培养和软件组织结构等问题,也逐渐从技术讨论进入企业经营层面。 在 2026 世界人工智能大会期间的 InfoQ 媒体直播间,AI Coding 成为“AI 正在重写什么”这一主题下最具争议的话题之一。 拥有近 20 年企业软件开发经验、Sirius contributor 滕昱,以及曾在 Google 担任软件工程师、后加入月之暗面从事研发并负责开发者关系的唐飞虎,从开发者实践、企业管理和个人成长三个角度,讨论了 AI Coding 正在带来的深层变化。 两人的判断并不完全一致。滕昱认为,传统计算机专业和软件工程师职业延续了约 30 年的发展周期,如今已经走到一个明显转折点,单纯写代码的价值正在迅速下降;唐飞虎则认为,计算机科学背后的数学和基础原理仍然值得学习,只是课程体系和人才培养方式必须改变。 但在一个问题上,两人形成了共识:AI 不会简单地让所有工程师失去价值,相反,它正在优先放大资深工程师的经验和判断能力。真正受到冲击的,是过去依靠重复编码工作积累经验的新人,以及层级复杂、流程沉重的大型软件组织。 AI Coding 进入重度使用阶段,Token 不再是重点 在日常使用中,滕昱同时使用三个编程模型,其中两个工具主要承担编程任务,另外一个更多用于写文章、总结新闻和整理邮件。他的采购策略很简单:直接买能力最强的模型和最高档套餐,把模型能力“直接拉满”。 他解释,自己仍然承担大量实际开发工作,没有太多时间在不同模型和价格之间反复比较。相比节省调用费用,他更在意模型能否直接解决问题。“我的选择是买最贵的模型、买最高的套餐,直接拉满。”不过,即使同时使用多个高阶套餐,他也没有用满全部 Token 额度。在他看来,这也说明 AI Coding 并非万能工具,人仍然需要处理模型无法完成的部分。 唐飞虎同样会使用多种模型,但比起固定依赖少数工具,他会尝试几乎所有主流 AI 工具,包括 Kimi Code、Claude Code、Codex 以及一些面向垂直场景的小众产品。他会根据任务特点,在不同模型和 Harness 之间选择合适的组合。如果没有合适的开发任务,他甚至会主动让模型运行 Benchmark,尽可能用满套餐和内部额度。 不过,两人都没有精确统计自己每天消耗多少 Token。原因在于,AI Coding 的使用方式已经发生变化。过去的 Vibe Coding 往往是一轮提问对应一轮回答,Token 消耗相对容易估算;现在开发者更多是给 Agent 设定一个目标,让它持续执行、反复调试,可能一个小时以后才需要人类介入。 这种长时间自主执行不可避免地会产生浪费。唐飞虎表示,如果仔细阅读模型的思考过程、工具调用记录和与计算机交互的轨迹,会发现模型在中间不断碰壁,尝试大量无效路径。但模型往往也能自己从错误中跳出来,最终完成任务。开发者可以提前介入,提高执行效率,但很多时候,人也会选择“偷懒”,让模型自行尝试。 滕昱认为,这种模式既有优势,也存在明显弊端。企业和开发者往往只能看到任务是否完成,却不清楚模型在内部浪费了多少推理过程。因此,AI Coding 的衡量方式正在从“调用了多少 Token”转向“完成了什么任务、最终产生了什么价值”。 这也直接影响了企业对成本的理解。过去,企业可能把 Token 当作类似云资源的使用指标;现在,一个复杂任务背后可能存在数十次工具调用、代码修改和环境交互。单独统计 Token 数量,已经很难准确代表生产效率。 “人人都是开发者”仍有边界 对于不懂代码的人能否通过 Vibe Coding 开发产品,滕昱和唐飞虎给出了不同程度的乐观判断。 滕昱认为,答案取决于程序类型。如果一个应用主要围绕人与界面、人与业务流程之间的交互,只要用户能够把需求描述清楚,Agent 往往可以完成。但如果任务涉及人类过去从未实现过的新逻辑、新架构或缺少成熟参考的系统设计,模型就容易陷入重复循环。 在他看来,大模型本质上是在大量人类已有代码基础上进行总结、组合和生成。当目标超出已有经验分布时,模型很难独立完成方向判断。他谈到自己几乎每周甚至每天都会遇到类似情况:Agent 不断修改代码、尝试新路径,却始终无法意识到原本的技术路线可能根本不成立。此时,仍然需要人类介入,叫停错误方向。 因此,他估计,普通应用中可能有 70%-80%的需求可以通过 Vibe Coding 实现,但仍有一部分关键工作无法完全交给模型。 唐飞虎则更加乐观。他认为,随着模型自我发现问题和解决问题的能力不断增强,用户需要读懂代码、亲自修改 Bug 的时机正在减少。早期模型生成的程序经常运行失败,需要开发者进入代码手动修复;现在模型能够读取报错、分析环境、自主修改,并最终交付可用结果。在这种趋势下,懂不懂代码会逐渐变得不那么重要。 他举例称,自己此前参加 SIGGRAPH 活动时,希望用模型制作一款 3D 停船游戏。当时连续折腾了 48 个小时,模型生成的船既无法正常驾驶,也没有实现理想中的海浪和暴风雨效果。但在使用最新的 Kimi K3 模型后,原本两天没有完成的任务,仅用一句话就生成了相当像样的版本,他甚至自己玩了很长时间。 这类变化说明,外界有时会低估模型进步速度。很多几个月前还被认为必须由专业开发者完成的工作,可能在下一代模型中迅速变成一句指令。 但两人同时强调,“能够生成代码”和“成为专业工程师”不是一回事。滕昱认为,AI 可以处理大量具体实现,却无法自动决定一个系统为什么存在、应该解决什么现实问题,以及何时应当停止错误路线。唐飞虎也指出,即使模型能够完成代码生成,人仍然需要理解目标、设计协作机制并判断最终交付是否符合需求。 模型是“航空发动机”,Harness 决定如何进入真实场景 在 AI Coding 产品中,模型决定基础能力,Harness 则负责向模型提供工具、上下文、执行环境和任务流程。同一个模型被放入不同 Harness 后,实际表现可能产生巨大差异。那模型和 Harness 谁更重要? 滕昱开玩笑称,提示词、Harness 和 AI Coding 工作流,“只要学得足够慢,可能就不用学了”。因为模型自身进化速度太快,不要说半年前,甚至三个月前开发者精心设计的工作流,都可能很快被新模型内化。 因此,他不会过早投入大量时间打造所谓的完美 Harness。在真实开发中,他更关心项目的大方向:到底要做什么、解决什么问题、如何与团队成员沟通,以及如何在开源社区内进行协作。相较之下,过度优化提示词和流程,很可能在下一次模型升级后迅速失效。 他认为,开发者真正应该思考的是:作为“人类智能体”,自己和 AI 的区别在哪里?人与人之间的沟通、目标判断、责任承担以及对现实社会的理解,是现阶段大模型难以替代的能力。Harness 当然重要,但当前行业距离最终收敛还很远,现在投入过多精力构建一套极其复杂的流程,可能为时尚早。
这篇文章对您有帮助吗?
订阅66必读
每日精选科技资讯,直达你的邮箱