2026-09-22 技术前沿速览
今日关键词:Agent Harness 自进化成显学、GPT-6 破解 21 年未解密码、Anthropic 杀入金融垂直、阿里 Qwen 剑指 5-10T 参数。
AI 前沿
harness-zero-harness-distillation-via-agent-as-harnesshttpsarxivorgabs260924974v1">Harness-Zero: Harness Distillation via Agent-as-Harness
把"Agent 外部脚手架"本身当作可蒸馏对象:让强 harness 驱动弱模型产出轨迹,再反向蒸馏回模型权重。这条路线试图解决 harness 增益无法内化的问题——过去 prompt/控制流/工具编排的收益锁死在系统层,换模型即失效。 关键信息:Agent 训练 / harness 蒸馏 / 让脚手架能力沉淀进模型本体。
RRSI: Regularized Recursive Self-Improvement of Agent Harnesses
与上一篇同源思路的另一面:不蒸馏进模型,而是让 harness 自己递归自我改进,并加正则项防止退化。两篇同日出现,说明"harness 是新的可训练层"正在形成共识。 关键信息:Agent 系统 / 递归自我改进 / 正则化约束 harness 演化。
WorldCrafter: Consistent Video World Model with Implicit 3D-aware Memory
视频世界模型的长程一致性难题:跨视角、长时间后容易忘掉此前观测。方案是引入隐式 3D-aware 记忆,而非显式重建几何。对做交互式环境模拟的团队有直接参考价值。 关键信息:视频世界模型 / 隐式 3D 记忆 / 长程跨视角一致性。
DexTacWAM: A Visuo-Tactile World-Action Model for Dexterous Manipulation
灵巧操作中接触动力学往往只能从视觉部分观测,这篇把触觉并入 World-Action Model。世界模型从"预测下一帧"扩展到"预测下一接触状态",是具身智能里比较务实的一步。 关键信息:具身智能 / 视触觉融合 / World-Action Model。
GameHorizon Suite: Multi-Horizon Data and Evaluation in Gameplay
游戏作为可量化测试床,提供多时间尺度的数据与评测。相比通用 benchmark,游戏能同时压测视觉理解、指令分解与目标规划,评测粒度更细。 关键信息:Agent 评测 / 多时间尺度 / 游戏环境基准。
Bayesian Filtering in Physical Systems via Test-time Trained Flow Matching / Discovering Physical Representation Languages
两篇偏科学机器学习:前者用测试时训练的 flow matching 做高维状态估计;后者关注"机器在发现物理定律前,先得发现自己的测量代表什么"——表征发现先于定律发现。 关键信息:SciML / 贝叶斯滤波 / 物理表征语言发现。
开发者热榜
OpenAI GPT–6 Astra breaks Enigma message that has resisted solution since 2005
一条自 2005 年起无人解开的 Enigma 密文被 GPT-6 Astra 破译。真正的看点不是"AI 会解密",而是模型在缺乏训练语料的历史密码学任务上展现出搜索+推理的组合能力——这类任务此前被认为必须靠专用密码分析程序。 关键信息:推理能力 / 历史密码分析 / 长程搜索与约束满足。
Drop – a rootless Linux sandbox with gVisor support
无 root 权限运行 Linux 沙箱并支持 gVisor。对 Agent 执行代码这类场景很关键:既要隔离又要免 root,部署摩擦大幅降低。 关键信息:安全隔离 / gVisor / rootless 沙箱。
We broke an Over-The-Air update on the ESP32 on purpose
故意打断 ESP32 的 OTA 更新,观察设备如何变砖或恢复。嵌入式 OTA 的失败模式长期缺乏系统化测试,这类"主动破坏"的工程实践比成功案例更有信息量。 关键信息:嵌入式 / OTA 可靠性 / 故障注入。
Stanford R&DE Uses AI to Race Swap Students for Advertising
斯坦福住宿餐饮部门用 AI 对宣传物料中的学生做种族替换。技术上是常规图像编辑,争议点在于机构用生成式手段"制造多样性"的伦理边界。 关键信息:生成式图像 / 机构伦理 / 表征真实性问题。
Apple has added persistent 'ads' to iOS, and it's driving users crazy
iOS 加入常驻广告位引发用户强烈反弹。对平台型公司而言,这是在硬件增长见顶后向服务收入要增长的典型动作,但代价是侵蚀"付费即无广告"的隐性契约。 关键信息:平台商业化 / 用户体验 / 服务收入压力。
开源风向
anthropics/financial-services
今日 424 stars,增速第一。Anthropic 官方放出的金融服务仓库,信号很明确:模型厂商开始直接下沉到垂直行业交付,而不只是卖 API。对做垂直 AI 应用的团队是压力也是模板。 关键信息:垂直行业 / 金融 / 模型厂商向下整合。
FareedKhan-dev/train-llm-from-scratch
220 stars today。从下载数据到生成文本的完整训练流程,覆盖全链路而非只给模型定义。在教育与快速原型场景需求稳定。 关键信息:LLM 训练 / 全流程教学 / 可复现。
zhouxiaoka/autoclip
250 stars today,AI 高光提取与二创剪辑。视频理解 + 剪辑自动化的组合正在被大量复刻,说明这是当前最容易跑通商业闭环的多模态方向之一。 关键信息:视频理解 / 自动剪辑 / 二创工具链。
superdesigndev/treg
197 stars today,"Agent 工具界的 OpenRouter"。工具调用层的统一路由,如果成立,会成为 Agent 生态里类似 API 网关的位置。 关键信息:Agent 工具路由 / 中间层 / 生态卡位。
mvt-project/mvt
169 stars today,移动设备取证工具,用于发现设备被入侵的痕迹。在间谍软件频发的背景下,这类工具的需求是刚性的。 关键信息:移动取证 / 安全检测 / 入侵痕迹。
browser-use/video-use
155 stars today,用编码 Agent 剪辑视频。与 autoclip 同赛道,但走的是"Agent 操作工具"而非"专用管线"的路线,值得对比两者的可扩展性。 关键信息:编码 Agent / 视频编辑 / 通用工具操作。
趋势观察
一、Agent 的"harness 层"正在被当作可训练对象。 ArXiv 今日两篇(Harness-Zero、RRSI)从蒸馏与自进化两个方向同时进攻同一问题,而 GitHub 上 treg 做工具路由、video-use 做工具操作,本质都在强化模型之外的那一层。学界和工程界第一次在同一周把注意力集中到"脚手架"而非"权重"上。
二、模型厂商开始垂直下沉。 Anthropic 的 financial-services 仓库单日 424 stars,配合阿里 Qwen 宣布下一代扩到 5-10T 参数、千问办公发布企业上下文,头部厂商都在从"卖能力"转向"卖场景交付"。这对独立开发者是双向的:基础设施更便宜,但直接竞争的垂直赛道正在被上游吃掉。
三、安全与隔离成为 Agent 落地的硬约束。 Drop 提供 rootless + gVisor 沙箱,MVT 做移动取证,两件事指向同一现实:Agent 要执行真实代码、接触真实设备,隔离与取证能力不再是可选项。
一句话总结:今天的信号是"能力从模型里溢出来,跑到了脚手架、垂直场景和隔离层"——这三处,恰好是工程价值最容易被低估的地方。