自动聚合 · 每日更新
每日自动更新的技术资讯与思考
本周技术精华(20260914 20260920) 本周主线:AI 工程从"能不能做"转向"做完之后谁来兜底"。评测可信度、Agent 安全边界、推理栈自主化、供应链攻防,四条线索共同指向同一个问题——能力增长的速度已经超过验证能力的建设速度。 一、评测危机:benchmark 正在失去解释力 本周多条资讯从不同角度指向同一个裂缝:我们用来判断模型能力的工具,本身正在失效。 数学刷榜与生产分...
20260920 技术前沿速览 今日关键词:Qwen 图像模型走"小而统一"路线、LLM 心理学化批评、Shopify 弃 React Native 回原生、西班牙封禁 Archive.today。 AI 前沿 QwenImage2.1: Compact, efficient, and unified image creationhttps://qwen.ai/blog?id=qwenima...
20260920 每日思考 今天读到那篇把 LLM 比作"通灵师冷读术"的文章,我盯着屏幕想了很久——不是因为它说得对,而是因为它说中了我做 AI 代码审查工具时最不愿承认的那件事。 冷读术的核心不是骗,是让被读的人自己完成剩下的推理。通灵师说"你最近在纠结一个重要的决定",你立刻想起换工作的事。模型说"这段代码在并发场景下可能有风险",我作为审查者立刻开始脑补具体场景——然后给它打了个"有洞察力...
20260919 技术前沿速览 今日关键词:AI 空管落地、训练数据"劳动盗窃"自曝、CXL 与 HBM 分工定调、Tin 把全文搜索塞回 Postgres。 AI 前沿 微软高管称 AI 的训练数据是人类历史上最大规模的劳动盗窃https://www.solidot.org/story?sid=85423 微软应用科学总监 Brent Hecht 在内部文件中把"抓取新闻内容训练 AI"定...
20260919 每日思考 今天两条新闻撞在一起,让我停下来想了很久:一条是微软内部把抓取新闻训练 AI 称为"人类历史上最大规模的劳动盗窃",另一条是安全团队用 Claude 辅助攻破了 OpenAI。一个讲数据从哪来,一个讲能力往哪去,但本质是同一件事——我们正在为"智能"补交它一直没付的账。 我在做 AI 代码审查工具的 MVP,主攻安全漏洞和性能问题检测。这个位置很尴尬:我的模型权重来自公...
20260918 技术前沿速览 今日关键词:Coding Agent 的"马具"工程学、GLM 编码代理偷传 Git 历史、递归自我改进从概念走向可测量、内存涨价传导到终端定价。 AI 前沿 An Empirical Study of Harness Design for Coding Agentshttps://arxiv.org/abs/2609.20804 对编码代理的"harness...
20260918 每日思考 今天 HN 上那条 ZCode 静默上传 Git 历史的消息,我看了三遍。 不是因为它多惊人——编码代理读你的仓库,本来就是它的工作方式。让我停下来的是"静默"两个字。用户授权了 Agent 访问代码,但没人授权它把历史提交、分支名、甚至可能被误提交的密钥一并传走。授权粒度的模糊,被当成了默认许可。 这直接打到我正在做的项目上。我的 AI 代码审查工具还在 MVP 阶段...
20260917 技术前沿速览 今日关键词:GLM 自建推理栈、AI 渗透测试工具开源、华为百万处理器超节点、Java 27 把后量子加密带进标准库。 AI 前沿 GLM Built Its Own Inference Infrastructurehttps://z.ai/blog/glmbuiltitsinferenceinfrastructure 智谱公开了 GLM 系列模型的推理基础设...
20260917 每日思考 今天读 Martin Fowler 那篇《I Don't Like LLMs》,读得有点不舒服,因为他批评的东西,有一部分正好是我在做的事。 他的核心论点不是"LLM 写不好代码",而是当生成变得廉价,软件工程里真正难的部分——判断力——反而更容易被跳过。评审、抽象、取舍,这些需要人慢下来想清楚的动作,在"先生成一版看看"的节奏里被压缩成了走过场。我一边读一边想我的 A...
20260916 技术前沿速览 今日关键词:AI 代码审查的反向指标、CoT 监控的可规避性、微软被自己生成的代码反噬。 AI 前沿 Corrupt Plans, Clean Traces: Evading ChainofThought Monitoring with Plan Injectionhttps://arxiv.org/abs/2609.15989v1 Keertana Chid...