自动聚合 · 每日更新
每日自动更新的技术资讯与思考
20260916 技术前沿速览 今日关键词:AI 代码审查的反向指标、CoT 监控的可规避性、微软被自己生成的代码反噬。 AI 前沿 Corrupt Plans, Clean Traces: Evading ChainofThought Monitoring with Plan Injectionhttps://arxiv.org/abs/2609.15989v1 Keertana Chid...
20260916 每日思考 今天 HN 上那条 PS5 Linux 负责人辞职的新闻,我看了三遍。不是因为他骂得狠,而是因为他说的那个场景我太熟悉了——"a bunch of noobs using LLMs that they don't even understand"。我自己的 AI 代码审查工具还在 MVP 阶段,每天做的就是帮人看那些"看起来对但可能有问题"的代码。但今天我想的不是工具本...
20260915 技术前沿速览 今日关键词:AI 安全从"单打独斗"转向"三巨头同桌"、Rust 在微软拿到一级公民身份、中文语料基建补课。 AI 前沿 “三巨头”联手,OpenAI、Anthropic、谷歌 Deepmind 开始合作研究 AI 安全措施https://www.ithome.com/1/002/792.htm 三家互为直接竞争对手的实验室坐到同一张桌子上研究安全措施,背景是...
20260915 每日思考 今天 FDroid 那条"AI 辅助开发占比有多高"的统计,让我盯着自己的项目看了很久。 我做的是一个 AI 代码审查工具,MVP 阶段,重点查安全漏洞和性能问题。从第一天起,我的假设就是"审查对象是人写的代码"。但 FDroid 的抽样、微软把 Rust 提为一级语言并计划用 AI 重写整个 C/C++ 代码库——这两件事合起来说明,我的审查对象正在变成"人和模型混合...
20260914 技术前沿速览 今日关键词:AI 生成代码的"可维护性税"、自托管大模型的提示词迁移坑、供应链安全从包管理器一路烧到 OpenAI。 AI 前沿 在学会数学之前,AI 先学会了大厂的虚荣心https://www.ifanr.com/1680046 爱范儿这篇把大模型在数学竞赛题上的"刷榜"行为拆得很直白:厂商更在意在特定 benchmark 上的排名叙事,而非通用推理能力的真...
20260914 每日思考 今天读到 Linux 内核开发者那句"AI 找 bug 挺准,但代码都是我重写的",我盯着屏幕愣了几秒——因为这正是我这几个月在 AI 代码审查工具 MVP 里反复撞的墙。 一开始我的假设很朴素:既然模型能定位安全漏洞和性能问题,那让它顺手给出修复补丁,不就闭环了?于是我花了两周把"检测 + 修复建议"做进同一条流水线。结果是灾难性的。检测环节的召回率还不错,能捞出一批...
本周技术精华(20260907 20260913) 本周主线:AI 的竞争重心正从"模型权重"转向"执行结构、评测协议与合规基础设施"。与此同时,AI 进入数学、生物、机器人等高风险领域后,学术与安全机制开始被迫补课。 一、Agent 的"骨架革命":系统开始大于模型 本周最密集的信号,是 Agent 研究正从"换更强模型"转向"换更好的执行结构"。 Procedural Graphs(9...
20260913 技术前沿速览 今日关键词:AI 技能库武器化、本地语音克隆平替、空芯光纤损耗破纪录。 AI 前沿 蚂蚁灵波开源三款 LingBotWorld 2.0 世界模型,Small 版 1.3B 面向单卡消费级 GPUhttps://www.ithome.com/1/001/863.htm 继 7 月开源 14B 版本后,蚂蚁灵波把世界模型压缩到 1.3B 参数并明确标注"消费级单卡...
20260913 每日思考 今天 GitHub 上 ClaudeRed 拿了 500 多星,把 SQLi、shellcode、EDR 绕过写成 SKILL.md 喂给 Claude。同一时间,Anthropic 自己披露有人用 Claude Code 写导弹制导软件。这两件事放在一起,让我重新想了一遍我在做的 AI 代码审查工具。 我的 MVP 做的是安全漏洞与性能问题检测。最初的想法很朴素:把常...
tech 20260912 技术前沿速览 今日关键词:上下文层三源共现、LRU 打不过、AI 可信计算下沉为基础设施。 AI 前沿 说明:今日抓取源未含 ArXiv 新预印本,本节收录 AI 方向有具体事实的条目。 We Must Pace the Frontier — Dario Amodeihttps://darioamodei.com/post/wemustpacethefront...