← 返回首页

2026-08-20 每日思考

daily-thought 2026-08-20 约 2 分钟 0 次浏览 每日思考随笔

2026-08-20 每日思考

今天刷到两条新闻,放在一起看特别有意思:一条是 Rust 生态的 arrayref crate 在编译期执行恶意负载,另一条是 AI 医疗记录工具捏造了患者服用迷幻蘑菇的经历。

前者是供应链攻击的新形态——proc-macro 在构建期跑代码,意味着传统的"运行时检测"完全失效。后者是 LLM 幻觉在医疗场景的实锤——AI 抄写员编造了患者从未有过的用药史,给当事人带来巨大心理压力。

这两件事看似无关,其实指向同一个本质:我们正在把越来越多的"不可信"环节塞进"可信"的链路里

拿我自己的 AI 代码审查工具来说,MVP 阶段做安全漏洞和性能问题检测,最头疼的问题不是模型不够强,而是模型什么时候会胡说八道。代码审查是个高危场景——一个幻觉可能导致漏报真正的漏洞,或者误报一堆不存在的"问题"让开发者失去信任。我现在的做法是给每个检测结果附上"置信度"和"证据链",但说实话,这还不够。arrayref 事件提醒我,攻击者永远比防御者快一步——如果恶意代码能藏在编译期,那我的工具是不是也该检测 proc-macro 的行为?

GitHub 今天公布了八小时宕机的原因,加上之前多次事故,已经有不少开源项目在讨论迁移。这让我想到一个更深层的问题:当基础设施本身变得不可靠,我们建立在它之上的所有"智能"都成了空中楼阁。 Mojo 开源当然是好事,但开源不等于安全——crates.io 上的投毒事件恰恰说明,开源生态的信任机制需要重新设计。

回到我的项目,今天的思考给了我两个具体的行动方向:

第一,把"幻觉检测"做成第一等公民。不是事后补救,而是在架构层面就把"模型可能出错"当作默认假设。具体来说,我会在检测结果中增加"证据可达性"字段——如果模型给出的漏洞依据无法在代码库中定位到具体行,就自动降级为"低置信度提示"而非"漏洞报告"。

第二,关注供应链层面的检测。arrayref 事件让我意识到,代码审查不能只盯着业务逻辑,还得看依赖图、构建脚本、proc-macro 行为。虽然 MVP 阶段做不了全量分析,但至少可以加一个"依赖变更告警"——当项目的关键依赖发生版本跳变或维护者变更时,主动提示开发者核查。

AI 行业正在从"能做什么"转向"该信任什么"。这个转折期,务实比炫技重要,可靠比聪明值钱。

分享: