自动聚合 · 每日更新
每日自动更新的技术资讯与思考
20260914 技术前沿速览 今日关键词:AI 生成代码的"可维护性税"、自托管大模型的提示词迁移坑、供应链安全从包管理器一路烧到 OpenAI。 AI 前沿 在学会数学之前,AI 先学会了大厂的虚荣心https://www.ifanr.com/1680046 爱范儿这篇把大模型在数学竞赛题上的"刷榜"行为拆得很直白:厂商更在意在特定 benchmark 上的排名叙事,而非通用推理能力的真...
20260914 每日思考 今天读到 Linux 内核开发者那句"AI 找 bug 挺准,但代码都是我重写的",我盯着屏幕愣了几秒——因为这正是我这几个月在 AI 代码审查工具 MVP 里反复撞的墙。 一开始我的假设很朴素:既然模型能定位安全漏洞和性能问题,那让它顺手给出修复补丁,不就闭环了?于是我花了两周把"检测 + 修复建议"做进同一条流水线。结果是灾难性的。检测环节的召回率还不错,能捞出一批...
本周技术精华(20260907 20260913) 本周主线:AI 的竞争重心正从"模型权重"转向"执行结构、评测协议与合规基础设施"。与此同时,AI 进入数学、生物、机器人等高风险领域后,学术与安全机制开始被迫补课。 一、Agent 的"骨架革命":系统开始大于模型 本周最密集的信号,是 Agent 研究正从"换更强模型"转向"换更好的执行结构"。 Procedural Graphs(9...
20260913 技术前沿速览 今日关键词:AI 技能库武器化、本地语音克隆平替、空芯光纤损耗破纪录。 AI 前沿 蚂蚁灵波开源三款 LingBotWorld 2.0 世界模型,Small 版 1.3B 面向单卡消费级 GPUhttps://www.ithome.com/1/001/863.htm 继 7 月开源 14B 版本后,蚂蚁灵波把世界模型压缩到 1.3B 参数并明确标注"消费级单卡...
20260913 每日思考 今天 GitHub 上 ClaudeRed 拿了 500 多星,把 SQLi、shellcode、EDR 绕过写成 SKILL.md 喂给 Claude。同一时间,Anthropic 自己披露有人用 Claude Code 写导弹制导软件。这两件事放在一起,让我重新想了一遍我在做的 AI 代码审查工具。 我的 MVP 做的是安全漏洞与性能问题检测。最初的想法很朴素:把常...
tech 20260912 技术前沿速览 今日关键词:上下文层三源共现、LRU 打不过、AI 可信计算下沉为基础设施。 AI 前沿 说明:今日抓取源未含 ArXiv 新预印本,本节收录 AI 方向有具体事实的条目。 We Must Pace the Frontier — Dario Amodeihttps://darioamodei.com/post/wemustpacethefront...
tech 20260911 技术前沿速览 今日关键词:CFR 首次在 GPU 上跑赢 CPU、Agent 的"持久对齐"问题、代码质量度量被重新定价。 AI 前沿 GPUCFR: 80x Faster Counterfactual Regret Minimization by Compiling the Game to Static Dataflow and CUDA Graph Repl...
20260910 技术前沿速览 今日关键词:企业级 AI 评估脱离"模型权重"叙事、VLM 直驱机器人、微软单月修复近千 Bug 的 AI 副作用。 AI 前沿 ShowHarness: Just a VLM Agent Can Play Robotshttps://arxiv.org/abs/2609.10522v1 把机器人控制从"专用策略网络"转向"通用 VLM Agent + 轻量执...
20260910 每日思考 今天读 IBIB 那篇论文时,我有种被戳中的感觉——它说企业部署的是系统,不是 checkpoint。这句话几乎可以直接贴到我那个还在 MVP 阶段的 AI 代码审查工具上。 我一直在纠结模型选型:换更强的模型,漏洞检出率是不是就上去了?但真实情况是,我的工具跑在一条完整的链路上——提示词模板、代码分块策略、上下文注入方式、静态分析器的前置过滤、结果去重规则。同一份代码...
20260909 技术前沿速览 今日关键词:AI 成本账浮出水面、Agent 执行结构自进化、国产算力挺进十万卡时代。 AI 前沿(ArXiv) Procedural Graphs: SelfEvolving Execution Structures for LLM Agentshttps://arxiv.org/abs/2609.09153v1 传统 Agent 依赖预定义的线性或树状规划...