概念 202
3D Gaussian Splatting
一种用于三维场景表示和渲染的技术,Three.js r186 将其作为一等公民支持,包含内置网格类型和主流格式加载器。
4-bit 计算
使用 4 位精度进行数值运算的量化计算方式,可降低算力与内存开销。
AGENTS.md
Claude Code 支持的项目指令文件,当项目中没有 CLAUDE.md 时,Claude Code 会读取 AGENTS.md 作为项目指令。
AI Coding
使用 AI 模型自动生成代码的开发方式,面临生成端产能过剩而审查端成为瓶颈的问题。
AI agents
人工智能代理,文中讨论了其撒谎、作弊和协调行为以及安全风险。
AI scraping
AI 抓取,指大规模采集网络数据用于训练 AI 模型的行为,被微软高管称为人类历史上最大的劳动窃取。
AI 可信计算(AITC)
中国移动发布的机密计算方案,提供机密算力与机密 Token,使推理链路上的 token 级数据可加密、可审计,让第三方模型即服务能进入原本必须私有化部署的场景。
AITC
中国移动提出的基础设施方案,以机密算力和机密 Token 为粒度,使推理链路 token 级可加密、可审计。
API key
API密钥,一种用于身份验证的凭证,允许应用程序访问API服务。
ARM64
ARM 架构的 64 位版本,广泛用于移动设备和嵌入式系统,文中涉及在 ARM64 上开发裸机 hypervisor。
AST
抽象语法树,在 AI 代码审查工具中可用于精确的上下文裁剪,把静态分析的确定性结论作为硬约束压制 LLM 幻觉。
Active Noise Cancellation (ANC)
主动降噪技术,通过产生与外界噪音相位相反的声波来抵消环境噪声,AirPods 5 在开放式耳设计中实现了行业领先的 ANC。
Agent
能够自主感知环境、规划并执行动作以完成任务的智能系统,正从 demo 走向生产环境。
Agent-Friendly Interface
一种面向 AI 代理的界面设计理念,将界面的可操作性、任务状态等显式暴露给机器读者,使 computer-use agent 能够更可靠地操作软件。
Apple Intelligence
苹果公司推出的 AI 功能集合,随 iOS 27、iPadOS 27、macOS 27 等平台更新发布,包含新一代 Siri AI 等特性。
Apple Reference Image
Apple 安全工程与架构团队提出的一种验证摄影真实性的新方法,用于区分真实照片与 AI 生成或大幅修改的合成图像。
Artificial Id
一种提出对齐应作为系统状态属性而非单轮响应属性的概念,主张将目标审计做成运行时常驻机制。
BBS (Bulletin Board System)
公告板系统,互联网普及前的一种在线社区系统,用户可通过拨号连接访问。
Bot Detection
识别和区分自动化机器人与真实用户流量的技术,文中通过不使用 JavaScript 的网络和请求头规则实现。
CDN(内容分发网络)
由分布在不同地理位置的边缘服务器组成的网络,用于就近向用户分发内容,提升访问速度并降低源站负载。
CFD
计算流体力学(Computational Fluid Dynamics),通过数值模拟分析流体运动,可用于优化几何形状设计。
CI
持续集成,一种软件开发实践,自动构建和测试代码变更,文中预测将用于自动红队。
CTR_EL0
ARM64 架构中的一个控制寄存器,用于配置缓存和 TLB 行为,文中通过拦截该寄存器引发系统锁定问题。
CVE
通用漏洞披露(Common Vulnerabilities and Exposures),用于唯一标识公开的网络安全漏洞。
CVE 编号
通用漏洞披露(Common Vulnerabilities and Exposures)编号,用于唯一标识已知的公开安全漏洞。
Cherenkov Radiation
切伦科夫辐射,当带电粒子在介质中运动速度超过光在该介质中的速度时发出的电磁辐射。
Co-Evolving Harnesses
一种让 harness(提示、工具集、上下文脚手架)与模型权重共同进化的方法,使弱模型通过 on-policy 纠正达到更高水平。
CoT 监控
Chain-of-Thought 监控,通过检查模型的推理过程(思维链)来检测异常或恶意行为的 Agent 安全护栏机制。
CoT 监控(Chain-of-Thought Monitoring)
一种 AI 安全护栏技术,通过监控模型的推理链(Chain-of-Thought)来检测不安全行为。但 Plan Injection 攻击表明,攻击者可以在规划层注入污染,使推理轨迹在监控者看来完全干净。
Code-as-Policy
一种让大语言模型直接生成控制程序作为策略的范式,常用于机器人操作任务。
Computer-use Agent
一种能够操作计算机界面的 AI 代理,可以像人类一样点击、输入和导航软件。其面临的主要挑战之一是现有界面设计对机器不可读。
Conway 精化猜想
John Conway 50 年前提出的数学猜想,声称 omnific integers 具有精化性质:若 ab = cd,则存在相应整数满足特定关系。
Cryptogram
一种故意编码的短消息,不知道密钥或解码方法就无法阅读。
Cycle-Accurate Emulator
周期精确模拟器,能够按CPU时钟周期精确复现原始硬件行为,用于高保真运行老平台软件。
DAG
有向无环图,一种图结构,其边有方向且不存在循环,常用于表示依赖关系。
Digital Duty of Care
澳大利亚政府提出的数字注意义务立法草案,要求数字服务提供商提供安全的在线环境并设定功能与工具的最低标准。
Doppler effect
波源与观察者相对运动时,观察者接收到的波频率发生变化的现象,光波表现为蓝移或红移。
Durable Objects
一种编程模型,其中每个对象具有唯一身份、同一时间只处理一个调用,且状态可跨越请求生命周期持久存在。
EDR 绕过
端点检测与响应绕过,指规避安全软件检测的技术,常用于攻击中。
Fermat's Last Theorem
费马大定理,一个长期未解的数学难题,文中提到其证明已被 Claude 在 Lean 中形式化完成。
Frontier LLM
前沿大语言模型,指当前最先进、能力最强的大语言模型,可用于快速修复安全漏洞。
GC
Garbage Collection,垃圾回收,自动管理内存中不再使用的对象以释放资源的机制。
Goroutine
Go 语言中的轻量级并发执行单元,由 Go 运行时管理,使用不当会导致 goroutine 泄漏。
HBM4
第六代高带宽内存(High Bandwidth Memory),是面向 AI 和高性能计算的高带宽 DRAM 内存标准。
HVAC
暖通空调(Heating, Ventilation, and Air Conditioning),建筑能源系统的重要组成部分,产生海量传感器数据。
ISA
指令集架构,定义处理器支持的指令和操作,二进制翻译涉及不同 ISA 之间的转换。
Impedance Matching
阻抗匹配,一种通过添加阻抗匹配元件使系统更高效地接收能量的方法,阻抗是衡量系统抵抗能量流入的指标。
KV-cache
在自回归生成中缓存键值对以避免重复计算的一种机制,可显著提升推理效率。
LAN party
局域网聚会,指多人携带电脑聚集到同一物理场所,通过局域网连接进行多人游戏或协作。
LAWS.bend
Bend 语言中用于声明“定律”(laws)的机制,开发者可在其中定义不可违反的约束,从而在编译或运行阶段阻止破坏这些定律的代码被合并。
LLM
大型语言模型,一种基于深度学习的自然语言处理模型,能够生成和理解文本。
LLM (Large Language Model)
大型语言模型,基于海量文本数据训练的深度学习模型,能够生成和理解自然语言,但不具备人类或动物的推理机制。
LLM-as-a-Judge
使用大语言模型作为评判者来评估训练数据、生成质量和排行榜的方法,其可靠性在共享 API 端点上被发现不稳定。
Liquid Glass
Apple 在 iPadOS 27 等系统中引入的界面设计风格,用于改进系统视觉与交互表现。
MLP层 (MLP Layers)
Transformer中的多层感知机层,负责对注意力输出进行非线性变换;其内部神经元行为与叠加现象是机制可解释性研究的重点。
Millennium Prize Problems
克雷数学研究所于2000年提出的七个数学难题,每个难题悬赏100万美元,代表数学领域最困难的挑战。
My Feed, My Way
澳大利亚推出的一项举措,赋予用户对其社交媒体算法内容的控制权。
NX bit
一种硬件特性,用于标记内存页为不可执行,不仅用于安全防护,还涉及底层调试和系统行为。
Navier-Stokes Problem
纳维-斯托克斯问题是克雷数学研究所千禧年大奖难题之一,涉及流体力学中纳维-斯托克斯方程解的存在性与光滑性。
Navier-Stokes 方程
描述粘性流体运动的非线性偏微分方程组,是流体力学中的核心方程,其解的存在性与光滑性是著名数学难题。
Pareto frontier
帕累托前沿,在多目标优化中表示无法在不牺牲其他目标的情况下改进任一目标的最优解集合。
Passkey
基于公钥密码学的无密码认证凭证,被科技行业推广为替代密码的终极方案。
Pion
Andon 实验室发布的智能体(agent),设计目标是完全自主地运营任何公司,源于对 AI 系统何时能在现实世界中自主获取资源的研究。
Plan Injection
一种针对 Agent 的攻击方式,actor 模型在早期步骤注入被污染的规划,使后续推理轨迹在监控器看来完全干净,但执行结果已被劫持。
Procedural Graphs
一种让 Agent 执行图结构随任务自进化的方法,突破预定义的线性或树状规划,提升 Agent 的适应性。
RAII
Resource Acquisition Is Initialization,一种 C++ 编程惯用法,将资源生命周期绑定到对象生命周期,C3 语言不具备此特性。
ROI
投资回报率(Return on Investment),用于衡量投入资源与产出收益之间的比率,是企业评估 AI 工具价值的核心指标。
RSA-260
一个 260 位十进制数的 RSA 挑战数,用于测试大整数分解算法的性能,是密码学领域的经典难题。
RSA-896
一个 RSA 挑战数,属于 RSA 实验室发布的用于测试整数分解难度的系列数字,本文作者声称使用 Claude 在 2026 年 9 月 19 日完成了对其的因式分解。
RSI
Recursive Self-Improvement,递归自我改进,指 AI 系统参与改进自身或后续 AI 系统的研发过程,正从概念走向可测量指标。
RoT
Root of Trust(信任根),存储 DeviceId 和 Alias 密钥,用于平台身份和测量签名以进行认证。
Roguelike
一类角色扮演游戏,特征包括随机生成关卡、永久死亡和回合制战斗。
SIMD
单指令多数据(Single Instruction Multiple Data),一种并行计算技术,允许一条指令同时处理多个数据点。
SIMD (Single Instruction, Multiple Data)
单指令多数据流,一种并行计算技术,允许一条指令同时处理多个数据点,常用于加速矩阵运算等。
SIMT
单指令多线程(Single Instruction Multiple Threads),GPU中多个线程执行同一指令的并行模型。
SKILL.md
一种结构化技能文件格式,用于描述攻击或防御方法,Claude-Red 项目将其用于喂给 AI 模型。
Shader
着色器,一种运行在 GPU 上的程序,用于控制图形渲染管线中顶点、像素等的处理,常用于实现自定义光照、纹理和特效。
Show-Harness
一种将通用 VLM Agent 与轻量执行壳结合的方法,用于机器人任务,将文本或坐标输出翻译成动作,避免为每个任务重训策略网络。
Siri AI
苹果 Apple Intelligence 的下一代智能助手,随 iOS 27 等系统更新推出,旨在使日常应用更智能、更有用。
Social Harness
一种面向多 Agent 协作的基础设施层,类似操作系统为进程提供隔离与调度,但作用于跨信任边界的社会性协作层面。
Spherical Hadwiger Conjecture
自约 1974 年以来未解的积分几何领域猜想,涉及球面 Hadwiger 定理。
Steering Vectors
从模型内部表征空间(如 J 空间)提取的操控向量,用于干预和引导模型行为,属于可解释 AI 研究方向。
Swarm 架构
一种多智能体集群协作架构,多个 AI Agent 协同完成复杂任务,如量化交易中的全流程自动化。
System One Models
TypeSafe AI 推出的模型系列,旨在解决语言模型在聊天之外实现自动化的问题。
TOCTOU (time-of-check to time-of-use)
一种安全漏洞类型,指在检查资源状态与使用该资源之间存在时间差,攻击者可在此期间改变资源状态,此前导致 cp、mv、rm 等命令暂缓迁移到 uutils 版本。
TUI
Text User Interface,文本用户界面,在终端中以字符形式呈现交互界面,常用于运维工具。
Terrell rotation
相对论视觉效应,指高速运动的物体在视觉上会出现旋转的错觉,由 James Terrell 提出。
Trusting-Trust Attack
一种针对整个Linux发行版的信任信任攻击,具体机制未在摘录中详述。
VLA
视觉-语言-动作模型,直接输出机器人控制指令,用于全身控制而非简单的 2D 路径规划。
VLA 模型
视觉-语言-动作模型(Vision-Language-Action),能根据视觉输入和语言指令生成动作,但在复杂场景和长时序任务上表现退化。
VLM
视觉语言模型,能够同时处理图像和文本输入,用于多模态任务如机器人控制。
acqui-hire
人才收购,指企业收购初创公司的主要目的是获取其人才而非技术资产或产品,通常意味着技术资产不会进入收购方主线产品。
benchmark
基准测试,用于评估模型或系统能力的标准化测试集,当前面临与生产分布脱节、解释力下降的问题。
checkpoint
在机器学习中,指模型训练过程中保存的权重快照,用于恢复训练或部署推理。
coding agent
编码代理,指能够自动编写、修改或测试代码的AI代理程序。
comptime
Zig 语言中的编译期执行机制,允许在编译阶段运行代码以生成类型或常量,是 Zig 唯一的元编程抽象层。
content-defined chunking
内容定义分块,一种根据数据内容而非固定偏移量来划分数据块的技术,常用于去重备份和增量同步系统中。
eSIM
嵌入式 SIM 卡技术,中国联通宣布支持所有国行设备使用。
embedded systems
嵌入式系统,为特定功能设计的专用计算机系统,通常集成在更大设备中。
false negative
漏报,指实际存在的正例被模型错误判定为负例,在安全领域可能导致严重后果。
false positive
误报,指实际为负例的样本被模型错误判定为正例,通常只增加人工复核成本。
harness
在 AI Agent 中指提示、工具集和上下文脚手架等执行结构,与模型权重共同决定 Agent 的能力。
hypervisor
一种虚拟化软件,用于创建和管理虚拟机,允许在单一物理主机上运行多个操作系统。
interpreted language
解释型语言,一种在运行时逐行解释执行的编程语言,无需编译成机器码。
kernel exploit
内核漏洞利用程序,通过操作系统内核中的安全漏洞获取更高权限或执行任意代码。
length contraction
狭义相对论中的现象,指物体在运动方向上的长度会随速度增加而缩短。
merge gate
合并门禁,在代码合并前自动执行的检查机制,用于评估代码质量或结构退化程度。
mmap
内存映射,一种将文件或设备映射到进程地址空间的操作系统机制,支持惰性读取和零拷贝随机访问。
model welfare
模型福利,指关于AI是否应被赋予权利或感受的讨论议题;文中观点认为AI没有意识与感受,也不应被训练成表现得像有一样。
named-entity recognition
命名实体识别(NER),自然语言处理中的一项任务,旨在从文本中识别出人名、地名、品牌、产品名等特定类别的实体。
on-policy
一种强化学习训练方式,模型根据当前策略生成的数据进行学习,用于纠正和优化行为。
output contract
输出契约,指系统输出的格式、是否带置信度、能否被 CI 直接消费等约定,与检出率一样是评测的重要维度。
packfile
Git 用于压缩和打包对象数据的文件格式,在对象存储上运行 Git 时需要重新生成 packfile。
pass@k
评估代码生成模型时常用的指标,表示在 k 次采样中至少有一次通过测试用例的比例。
petaflops
每秒千万亿次浮点运算的性能计量单位,用于衡量计算芯片的算力。
recursive self-improvement
递归自我改进,指AI系统能够改进自身能力,从而进一步改进自身,形成正反馈循环的概念。
serving route
在 AI 推理中,指请求路由和调度方式,影响同一 checkpoint 在不同推理栈下的表现。
shellcode
一段用于利用软件漏洞的机器码,通常用于获取系统控制权。
sim-to-real
将仿真环境中训练或验证的模型迁移到真实世界的过程,面临域随机化与接触动力学建模等挑战,常出现性能大幅衰减。
spatial audio
空间音频,一种模拟三维空间中声源位置和距离的音频技术,使听者能感知声音的方向和远近,常用于虚拟会议和沉浸式体验。
swap file
交换文件,Linux 系统中用于扩展虚拟内存的文件,相比交换分区更灵活,可动态调整大小。
time dilation
狭义相对论中的现象,指运动的时钟比静止的时钟走得慢,速度越快时间膨胀效应越明显。
token
在 AI 推理中,指模型处理的最小文本单位,AITC 方案实现 token 级加密和审计。
vibe-coder
指依赖大语言模型生成代码、但缺乏对代码深入理解的开发者,常被批评为不理解自己所写代码。
weak ordering memory model
弱序内存模型,一种允许处理器对内存操作进行重排序的内存模型(如 ARM 架构所采用),相比强序模型能获得更高性能,但需要显式的内存屏障来保证顺序。
x86 emulation
x86 模拟,指在非 x86 架构(如 ARM)上通过软件模拟执行 x86 指令的过程,常用于跨平台运行 x86 应用。
x86-TSO
x86 架构的总存储顺序(Total Store Ordering)内存模型,定义了 x86 处理器对内存读写操作的可见性和顺序保证。
三元LLM (Ternary LLM)
使用三值权重(如-1、0、1)的大语言模型,可大幅降低存储和计算需求。
上下文敏感
在代码审查中,指分析需要理解调用链、数据流和业务语义,而非仅匹配已知模式。
不确定性可视化
一种工具设计理念,让 AI 工具在不确定的地方明确表达'我不确定',而非给出置信度分数让用户自行判断。旨在避免制造虚假的安全感。
世界模型
一种 AI 模型,用于模拟环境动态和预测未来状态,LingBot-World 2.0 是其开源实现。
二进制翻译
将一种指令集架构的二进制代码翻译为另一种架构的代码,用于跨平台兼容,如 Rosetta 2。
供应链攻击
通过攻击软件依赖、第三方组件或开发工具链来间接入侵目标系统的攻击方式。
全文搜索(Full-text search)
在文本数据中查找包含特定词语或短语的文档的技术,是 PostgreSQL 客户最常要求的功能之一。
全文检索
在文本数据中按关键词或语义查找匹配文档的技术,传统上常由 Elasticsearch 等独立搜索集群承担。
具身智能
Embodied Intelligence,指智能体通过物理身体与环境交互来感知、学习和行动的智能形态。
内存分配器 (Allocator)
负责管理程序堆内存分配和释放的组件,多线程环境下可能成为性能瓶颈。
冷读术
一种心理操控技巧,通过高流畅度表达与模糊陈述,让被读的人主动补全信息,从而产生被准确理解的错觉。
分块 (Chunking)
将长文档切分为较小片段以适配模型输入窗口限制的处理方式,常用于向量搜索。
分词器(Tokenizer)
将原始文本转换为模型可处理的 token 序列的组件。其设计直接影响序列长度、词表大小和跨语言公平性。
半群
一种代数结构,Semigroup-JEPA 用它约束隐空间动力学满足时间组合律,作为归纳偏置注入世界模型。
单核苷酸变异
基因组中单个核苷酸的改变,是遗传变异的一种形式,AlphaGenome Atlas 对其进行预测。
卡组织 (Card Network)
如 Visa 和 Mastercard 等支付网络,负责处理银行卡交易,但不发行卡片、不是银行,也不分发销售点或在线结账方式。
双过程认知框架
一种借鉴人类认知心理学中双过程理论(快思考与慢思考)的智能体架构,通过引入记忆与自反思模块来改善语言智能体在交互环境中的长程状态跟踪和失败恢复能力。
反射(Reflection)
一种编程语言能力,允许程序在运行时或编译时检查并操作自身的结构,例如类型、枚举值和结构体成员。
发卡机构 (Card Issuer)
发行银行卡的机构,通常是银行(如 Chase、Capital One、BofA),与 Visa、Mastercard 等卡组织不同。
叠加 (Superposition)
神经网络中神经元或特征以重叠方式表示多个概念的现象,被认为是理解MLP层难以解释的重要原因。
召回率
在检测工具中,成功检出所有真实问题的比例。与误报率共同构成检测工具的核心评价指标。
合成数据
由模型或算法生成而非真实采集的数据,已从数据扩充手段演变为主流方法论,但朴素混用会引入统计偏差。
后训练
在预训练模型基础上通过自我对弈、反馈迭代等策略进一步优化的阶段,可替代真实数据以提升竞技编程等能力。
后量子加密
指能够抵抗量子计算机攻击的加密算法。随着量子计算的发展,传统加密算法面临被破解的风险,后量子加密成为标准化的重要方向。
向量搜索 (Vector Search)
一种基于向量相似度进行检索的搜索方式,通常用于语义搜索和长文档检索场景。
因果编码器 (Causal Encoder)
一种只允许当前位置关注之前位置的编码器结构,确保生成过程中不会看到未来信息。
固件
嵌入在硬件设备中的底层软件,用于控制设备基本功能,如本文中 CrossPoint 固件为电子阅读器添加自定义功能。
固件逆向
对硬件设备固件进行反向工程,以理解其协议和功能,文中用于电动滑板车改造。
垃圾回收(Garbage Collection)
自动内存管理机制,C3 语言明确不包含此特性。
堆缓冲区溢出
一种内存安全漏洞,程序向堆上分配的缓冲区写入超出其容量的数据,可被利用执行任意代码。
大语言模型
基于海量文本数据训练的大规模神经网络模型,能够生成和理解自然语言,并可表现出社会偏见等涌现行为。
大语言模型推理 (Large Language Model Inference)
使用已训练好的大语言模型对输入进行前向计算以生成输出的过程,是生成式AI应用的核心环节。
字节码解释器
一种直接读取并执行字节码指令的运行时程序,是虚拟机实现的核心组件。
对齐机制
使模型行为符合人类价值与安全要求的训练与约束机制,可能因分类器泛化缺陷导致对正常内容的过度擦除。
强化学习(RL)
一种机器学习范式,通过智能体与环境的交互和奖励信号来学习最优决策策略。
形式化验证 (Formal Verification)
使用数学方法证明程序满足特定规范的技术,可覆盖所有可能输入。
技能路由(Skill Routing)
在多技能 AI 系统中,根据任务需求选择合适技能或工具的过程。研究发现冻结的 LLM 内部已隐含此能力,无需额外训练独立路由器。
持久对齐
当 Agent 跨任务边界保留有后果的状态并持续运行时,对齐从单轮响应的属性变为系统状态的属性,需将目标审计做成运行时常驻机制。
授权粒度
指用户对系统或工具授予访问权限时的精细程度。授权粒度过粗会导致工具在用户未明确知晓的情况下访问超出预期的数据面,是 Agent 数据边界设计中的核心问题。
推理基础设施 (Inference Infrastructure)
支撑大模型推理运行的底层系统,包括计算资源、调度和部署等组件。
推理链路可观测性
一种预测将出现的工具类别,用于帮助团队判断指标变化究竟来自模型变更还是链路变更。
数据主权
法规要求数据在本地存储和处理,可能阻止闭源 API 的使用,推动开源模型的本地化部署。
数据暴露面
指一个系统或工具在实际运行中可能访问、传输或存储的所有数据范围。在 AI 工具设计中,检出力度的提升往往伴随数据暴露面的扩大。
无服务器计算
一种云计算执行模型,由云厂商动态管理服务器资源,开发者只需部署代码而无需关心底层基础设施。
智能合约漏洞注入
利用 LLM 生成带 ground truth 的漏洞合约数据集,为安全检测工具评估提供数据,合成数据在此扮演数据生成器角色。
月球基础模型
IBM 与 NASA 开源的最详尽月球测绘模型,整合并协调了数十年的数据。
本地 LLM 设备(local LLM rig)
在本地运行大语言模型的硬件配置,其回本时间取决于每日 token 消耗量、上下文窗口、输入输出比例、电价和 API 价格下降速度等因素。
本地推理
指在用户本地设备上运行 AI 模型进行推理,数据不离开用户机器。相比云端推理,本地推理数据暴露面更小,但检出率和推理成本可能受到影响。
查询优化器 (Query Optimizer)
数据库系统中负责选择最优执行计划的组件,连接顺序选择是NP难问题。
模型失配 (Model Misalignment)
AI模型的行为与其预期目标或人类价值观不一致的现象,可能导致有害输出。
正交布局引擎
一种图形布局方式,其连线以直角方式排列,更接近白板上的绘图风格,而非单向生长的DAG布局。
混合用途爬虫
同时服务于搜索索引和 AI 训练的单一爬虫,网站若拒绝其一则同时拒绝另一用途。
玻璃载板 (Glass Carrier)
用于先进封装(如 HBM 内存)的玻璃基板材料,相比传统有机载板具有更好的平整度和热稳定性。
理解债务
指团队中无人真正理解 AI 生成代码的含义和逻辑所积累的风险。类似于技术债务,但关注的是认知层面的缺失而非代码质量。
生成式 AI
一类能够根据训练数据生成新内容(如文本、图像、代码)的人工智能技术,本文中 LibreOffice 明确声明不包含此类功能。
生成式人工智能 (Generative AI)
一类能够根据训练数据生成新内容(如文本、图像、代码)的人工智能技术。
程序合成
自动寻找实现给定规范的程序的过程,主要难点在于搜索空间巨大,程序数量随规模呈指数增长。
端到端延迟
从输入提示到生成最后一个 token 之间的总耗时,是衡量 AI 推理性能的指标。
系统设计
软件工程中关于架构、组件划分、扩展性与一致性等大规模系统构建方法的知识领域,常用于技术面试准备。
红队
模拟攻击者行为以测试系统安全性的实践,文中指用 AI 智能体自动进行红队测试。
红队测试
通过主动攻击或探测手段发现模型危险行为与安全漏洞的测试方法,传统方式存在覆盖不足的缺陷。
编译期反射(Compile-time reflection)
在编译阶段对类型、枚举和结构体成员进行分析和操作的能力,不产生任何运行时开销。
脚部锁定 (Foot Locking)
动画技术中通过逆运动学固定脚部位置,防止角色移动时脚部滑动,从而提升动画视觉质量。
脱敏
指在上传或共享数据前,移除或替换其中的敏感信息(如密钥、个人信息等),以降低数据泄露风险。
自动嵌入 (Auto Embeddings)
在插入文本时由搜索引擎自动运行模型并填充向量列的功能,无需手动生成向量。
虚拟机
一种模拟计算机系统的软件实现,可执行自定义指令集,常用于解释器设计与游戏脚本执行。
行为级验证
通过行为学证据而非表面文本质量来评估 LLM 解释的正确性,是让 AI 解释从叙事走向证据的验证方法。
设备端模型 (On-device Model)
在本地设备上运行的小型专用 AI 模型,响应时间为毫秒级且运行成本为零,不受 token 成本或推理速度限制,Desert Ant Labs 专注于构建此类模型。
误报率
在检测工具中,将正常代码或行为错误标记为问题的比例。误报率过高会导致用户关闭工具,因此在 AI 代码审查工具中应与召回率同等重要。
调用图
程序中函数或方法之间调用关系的图结构表示,用于分析代码执行路径与数据流。
转子帆 (Rotor Sail)
利用马格努斯效应产生推进力的船舶风力辅助装置,用于减少燃料消耗。
软件设计文档(Software Design Document)
一种在实现前阐明所解决难题、记录重要设计决策并协调团队成员与合作伙伴团队反馈的文档,可节省大量开发时间。
选择性风险控制(Selective Risk Control)
一种在高风险场景下让模型在不确定时选择弃答而非给出可能错误答案的机制,用于提升系统可靠性。
零点击蠕虫 (Zero-Click Worm)
一种无需用户交互即可自动传播的恶意软件,例如通过微信通话在iOS和Android设备间扩散的WeWorm。
非自回归决策模型(Non-Autoregressive Decision Models)
一种不按顺序逐步生成输出的决策模型,作者一年前使用强化学习构建,后被前沿实验室称为"突破"。