IJCAI 2026蚂蚁四篇论文深度解析:AI如何从静态求解进化为动态自适应?

3 阅读

引言:算法的终极考验是动态环境

人工智能的研究范式正在经历一场深刻的静默变革。过去十年,学界与业界大多聚焦于在固定基准数据集上刷榜,追求参数规模的极致膨胀与静态精度指标的突破。然而,当模型走出实验室,进入充满噪声、分布不均且持续演变的真实世界时,传统的"一次训练、永久部署"模式往往遭遇严重的性能衰减。

这种衰减并非源于算法智商的不足,而是源于预设假设与现实世界的错位。真实世界的数据分布是动态的,业务场景是流动的,黑产策略是迭代的,用户行为是涌现的。在这一背景下,真正的智能不再仅仅是静态的求解能力,而是算法感知变化、调整策略并在动态中寻找最优解的自适应能力。

IJCAI 2026 作为国际人工智能联合会议的顶级盛会,其收录的论文往往映射着行业最前沿的技术风向。蚂蚁集团本屆入选的四篇论文,虽分别位于无监督学习、强化学习、黑盒优化和多模态评估四个不同领域,但它们共同指向了一个核心命题:如何构建能够"随机应变"的动态AI系统。这四篇工作不仅展示了理论创新,更深刻反映了工业界在超大规模业务场景下,对算法鲁棒性、效率及实时适应性的极致追求。

无监督学习的动态重构:MSRGC-Net 适应数据密度

时间序列聚类是理解用户行为模式、监控异常信号的基础工具,广泛应用于风控、交易分析等核心场景。然而,现有聚类算法在处理现实数据时面临着难以调和的矛盾:基于相似度的方法计算复杂度高,难以扩展至海量数据;深度学习方法虽然表征能力强,但训练成本高且依赖大量标注或复杂的调参;传统特征提取则往往丢失关键的时间动态信息。

更严峻的挑战来自数据分布的非均匀性。以蚂蚁集团的支付场景为例,双十一期间的交易数据密集如暴雨,而凌晨时段的流量则稀疏如滴水。传统的聚类算法通常需要预先指定聚类数量,且对数据密度变化敏感,这在数据分布剧烈波动的动态环境中显得尤为僵化。

蚂蚁集团联合重庆邮电大学提出的 MSRGC-Net 提供了一种创新的解决思路,其核心在于彻底摒弃了对训练参数的依赖,实现了一种"无训练"的动态适应机制。该模型通过三步逻辑重构了聚类过程:

首先,利用多尺度储备池编码进行特征提取。不同于深度网络,这里采用的回声状态网络(ESN)仅通过调整谱半径,即可从原始时序中同时提取局部波动细节与长期趋势,形成视图特征矩阵。这一设计不仅降低了算力消耗,还保留了对多尺度动态信息的敏感度。

其次,创新性地引入"颗粒球"锚定图构建结构。算法不再孤立地看待单个数据点,而是根据局部数据密度自动划分"颗粒球"。在数据密集的热点区域,形成小而多的颗粒,以捕捉细微模式;在稀疏区域,形成大而少的颗粒,以抑制噪声干扰。这种机制实现了数据规模的自适应压缩,从 N 个样本智能缩减至 M 个颗粒(M < N),显著降低了后续计算的复杂度。

最后,通过基于共识的多尺度图优化融合跨尺度信息。模型无需人工指定聚类数目,即可生成鲁棒的聚类结果。实验数据显示,MSRGC-Net 在多个基准数据集上取得了优异的性能,且计算复杂度接近线性。在实际业务中,这意味着系统能够根据实时流量密度,自动调整聚类的粒度:高峰时精细分群以精准捕捉异常,低谷时粗粒度概括以节省算力,真正实现了算法随数据而变。

强化学习的桥梁:ROAD 解决离线到在线的分布偏移

强化学习在机器人控制、游戏AI等领域取得了巨大成功,但在金融风控、推荐系统等实际应用中,往往面临"离线到在线"迁移的困境。这一问题的根源在于"分布偏移":在历史离线数据上训练的策略,在面对实时在线交互产生的新数据分布时,容易迅速"遗忘"原有知识,导致性能骤降。

现有的缓解策略主要包括固定混合比例采样或启发式近策略采样。然而,这些方法在训练的不同阶段往往失效。在策略训练的早期,模型需要大量的离线数据来稳住基本盘,避免在稀疏的在线数据上过拟合;而在训练后期,模型需要更多的在线数据来探索新的策略空间,避免陷入局部最优。固定比例的策略本质上是一种刻舟求剑,无法适配策略演进的不同需求。

蚂蚁集团联合上海交通大学提出的 ROAD 算法,将数据混合比例从一个静态的预设参数,转化为一个动态的决策变量。该方法的核心理论框架是一个双层优化问题:内层执行标准的 Q 学习更新以最小化贝尔曼误差;外层则利用多臂老虎机(MAB)算法,将数据混合策略视为元决策变量,旨在最大化在线策略的预期回报。

这种机制使得算法能够实时监控模型的训练状态。当检测到模型开始偏离离线知识分布时,系统自动增加离线数据的采样比例,以稳定策略;当发现模型趋于保守、探索不足时,则即时增加在线数据占比,鼓励探索。这种动态平衡机制在 AntMaze、MuJoCo 和 FrankaKitchen 等多个经典基准测试中证明了其有效性。

尤为关键的是,ROAD 具有极强的算法普适性。它与多种主流离线强化学习算法(如 IQL、PEX、CQL 等)结合后,均能带来显著的性能提升。在 D4RL 基准的连续控制任务中,PEX+ROAD 组合取得了压倒性的优势。对于蚂蚁集团的风控模型上线、推荐系统实时优化等场景而言,ROAD 提供了一种无需人工干预即可实现平滑过渡的技术方案,确保了线上业务在快速变化环境中的稳定性与成长性。

高维优化的突围:DSEBO 动态调整搜索子空间

在超大规模机器学习和深度神经网络中,超参数调优往往是一个高维、黑盒且计算昂贵的优化问题。贝叶斯优化是解决此类问题的经典方法,但当维度升高至数百甚至数千时,性能急剧下降。为了解决"维度灾难",研究者常采用随机嵌入技术,将高维问题投影到低维子空间中求解。

然而,传统方法面临一个关键瓶颈:有效维度的确定。有效维度并非固定不变,它往往随优化进程动态变化。在优化初期,低维子空间足以捕捉目标函数的主要趋势;而在后期精细调整阶段,可能需要更高维度来捕捉细微的梯度信息。依赖专家经验固定子空间维度,或者通过试错法不断估计,不仅消耗巨大算力,且难以适配不同任务的特性。

蚂蚁集团联合华东师范大学、南京大学提出的 DSEBO 算法,创造性地将子空间维度设定为随搜索进度自主切换的动态变量。DSEBO 遵循"从低到高,逐级跃升"的机制:算法初始在低维子空间中快速探索,生成候选解并反馈更新高斯过程模型;当检测到收敛趋势时,自动触发维度扩展,通过共享嵌入矩阵将低维解平滑继承至高维空间;随后在新子空间中继续优化,直至达到评估预算上限。

这一机制的精妙之处在于其自适应的扩展幅度控制。算法会根据当前最优值的变化曲线动态调整扩展速度:若曲线平缓,说明低维空间已充分挖掘,扩展放缓以节省开销;若曲线陡峭,则快速扩展以捕捉高维增益。实验表明,DSEBO 在多个高维合成函数及真实任务(如 MSLR、Lasso-Hard)中,在精度和收敛速度上均超越了 REMBO、SIRBO 等主流方法。

在蚂蚁的日常研发体系中,这一技术具有极高的实用价值。无论是信贷模型的超参数搜索,还是风控策略阈值的寻优,DSEBO 都能够实现自动化、高效率的运行,无需专家介入预估维度,显著降低了研发成本,提升了模型迭代效率。

多模态评估的闭环:VGA-BenchV2 驱动 AIGC 进化

前三篇论文聚焦于算法层面的自适应,而 VGA-BenchV2 则展示了基础设施层如何通过"自适应"来推动 AIGC 生态的进化。随着视频生成模型的爆发式增长,如何系统性评估生成视频的质量成为了行业痛点。传统的客观指标如 FVD、CLIP Score 等,仅能评估画面的清晰度、连贯性及语义一致性,却难以量化构图、光影、色彩等关乎"美感"的感知品质。

此前,蚂蚁集团发布的 VGA-Bench 首次建立了包含美学质量、美学标签、生成质量的三维度评估框架。但面对 AIGC 技术以月为单位的快速迭代,静态的基准很快失效。VGA-BenchV2 的推出,旨在构建一个与生成生态"共进化"的活系统。

VGA-BenchV2 的核心进化体现在三个方面:

一是人工标注量的指数级增长。新版本新增了 36,000 条任务级人工标注,涵盖了美学质量、标签及生成质量等多个维度。更充足的"人类偏好"数据,使得评估器能够更精准地对齐人类的审美判断。

二是评估器架构的重大升级。团队设计了混合架构,利用 VAQA-Net 处理连续美学评分,引入基于 Qwen 大视觉语言模型的 VTag-Net 和 VGQA-Net 进行复杂的语义理解。大模型的引入显著提升了评估器对复杂视觉语义和细粒度美学特征的理解能力。

三是打通了从"评估"到"优化"的闭环。这是 VGA-BenchV2 最具突破性的设计。它将学到的美学评估器作为奖励信号,直接用于强化学习驱动生成模型的微调。这意味着评估不再仅仅是事后的"打分"环节,而是成为生成模型持续迭代优化的内生动力。评估基准由此从"裁判员"转变为"教练",直接指导生成模型在美学质量上的提升。

结语:工业界 AI 研究的独特价值

回顾蚂蚁集团 IJCAI 2026 的四篇入选论文,我们可以清晰地看到一个共同的技术脉络:从静态到动态的范式转换。MSRGC-Net 适应数据密度,ROAD 适应分布偏移,DSEBO 适应搜索维度,VGA-BenchV2 适应生态迭代。这些工作不仅在学术上取得了突破,更在蚂蚁集团超10亿用户、8000多种服务的复杂业务场景中得到了验证。

对于工业界而言,AI 研究的独特价值在于其"问题导向"与"场景驱动"。业务场景不是论文的背景板,而是问题的来源、数据的产地和效果的检验场。在金融风控、支付交易、内容生态等高频动态场景中,算法的稳定性、效率及适应性远比单一的精度指标重要。

未来,随着 AI 技术向更深层的认知智能和具身智能迈进,静态模型必将被动态自适应系统所取代。蚂蚁集团的研究路径表明,唯有深入业务土壤,直面动态环境的挑战,才能真正实现 AI 从"智能工具"到"智能伙伴"的跨越。这四篇论文不仅是对 IJCAI 2026 的献礼,更是工业界 AI 研究走向成熟与深化的重要标志。它们证明,真正的技术创新,往往诞生于对真实世界复杂性的深刻洞察与从容应对之中。