← 返回首页

2026-10-04 每日思考

daily-thought · 2026-10-04 · 约 2 分钟 每日思考随笔

2026-10-04 每日思考

今天同时看到两条消息,一条是单张 4090 跑 125B 模型,一条是零加价的 BYOK 网关拿了 570 stars。它们指向同一件事:大家不再愿意为"中间层"付溢价了。

这对我的 AI 代码审查工具是个直接的提醒。MVP 阶段我最容易犯的错,是把"调用一个强模型"当成产品价值本身。但今天的信号很清楚——模型接入正在变成水电煤,谁都能接,价格还在往下走。如果我的工具的价值主张是"我用 GPT-6 帮你审代码",那这个主张的护城河大概只有几周。

真正的价值得落在模型之外。做安全漏洞检测时,我越来越确信一件事:模型能看出"这段代码像 SQL 注入",但它看不出"这个参数在三个调用层之前已经被白名单过滤过"。前者是模式识别,后者需要跨文件的调用链与数据流。我最近在做的尝试,是把静态分析的结果(调用图、污点传播路径)作为结构化上下文喂给模型,而不是把整段代码丢进去让它自由发挥。这本质上和今天 Rust 那条 metadata 前置、gpuvis 那条时间线对齐是同一个思路:先把隐含结构显式化,再让下游去做它擅长的事。

性能问题检测更明显。模型给出的"这个循环可能慢"几乎全是废话,因为性能瓶颈的判定依赖实测数据——哪一行占了 40% 的时间、GC 停顿发生在哪。没有 profiler 数据,模型的性能建议就是猜测。所以我现在的设计原则是:没有可验证的结构化证据,就不出结论。宁可少报,不可误报。一个误报率 30% 的审查工具,开发者用三天就会关掉它。

顺着这个逻辑推一步,我猜接下来半年会有一批"审查类 Agent"死掉,死因是把模型当成了唯一的信息源。活下来的那批,大概率是把编译器、profiler、静态分析器、CI 日志这些"结构化真相"接进 pipeline 的。模型负责解释和归因,不负责发现事实。

给同行的建议:如果你的产品里模型是唯一的判断依据,今天就去数一数,你手边还有哪些现成的、可验证的结构化数据没被用上。那些才是护城河。

分享: