通过格遍历对多层感知机的区间认证
本文提出了一个严谨的理论框架,针对AI安全中的基础问题——对抗鲁棒性。研究表明,对抗鲁棒性问题可以归约为一个格遍历问题。该格的每个元素对应一个包含输入点的区间(轴对齐的超矩形)。对于多层感知机(MLP)分类器,区间若保证任意在区间内的输入扰动均不改变MLP的预测,则为一个可靠认证;若输入一旦离开区间预测必变,则为完整认证。本文开发了格遍历算子,并采用“细化与验证”的迭代方案,用形式化验证器保证可靠认证的最大性和完整认证的最小性。此外,针对完整认证的最小解可在多项式时间内通过oracle调用获得,而可靠认证则存在强不可解问题。还研究了对称区间的优化算法,并通过新系统ParallelepipedoNN进行了实证评估。
这条 研究论文 信号说明,来自 arXiv cs.AI 的信息已经不只是单点新闻,而是值得放进产品、研究和行业判断里的趋势线索。