迁移学习新突破:无语义噪声也能提升模型学习效果,多数据集实验验证增益
【噪声助力迁移学习新成果】迁移学习里的 源数据未必非得是图像、文本或音频。一组从高斯分布里随机采样出来、没有任何语义的噪声也能帮助模型在少量标注下学得更好。这项工作名为半监督噪声自适应Semi - Supervised Noise AdaptationSSNA论文已发表于ICML 2026。【噪声自适应框架NAF】SSNA团队进一步提出噪声自适应框架Noise Adaptation Framework, NAF它利用随机生成的噪声构造出具有判别性的类别结构并将这种结构迁移到真实目标数据上从而提升模型在少量标注场景下的学习效果。NAF把噪声域和目标域投影到共享表征空间并在类别层面进行对齐。【实验效果显著】在每类仅有4个标注样本的情况下基于ResNet - 18骨干网络NAF在CIFAR - 10、CIFAR - 100、DTD - 47和Caltech - 101上的准确率相比仅使用有标注样本训练的标准监督学习基线ERM 经验风险最小化Empirical Risk Minimization分别提升了12.35、7.61、4.38和2.74个百分点。目前论文源码已开源。【把真实源域换成噪声】传统迁移学习通常需要一个标签丰富的源域但真实源数据并不总是容易获得。隐私、保密和版权限制都可能让源域数据无法共享。SSNA试图把这个前提拿掉源域不再放真实样本而是换成从简单概率分布中生成的噪声。具体做法是假设目标任务包含C个类别研究团队首先在1024维空间中为每个类别随机采样一个均值向量并以单位矩阵作为协方差由此构造C个高斯分布再从每个分布中采样50个噪声向量。噪声域与目标域使用相同的类别索引集合每个噪声类别预先对应一个目标类别索引但这种对应本身不包含语义信息。真正被迁移的是噪声域中形成的判别结构。只要这套结构能够和目标域对齐它就能为真实目标样本提供更清楚的分类边界。【少量标签仍然是必要的】噪声可以替代真实源数据但不能完全替代目标域标签。因为噪声来自另一个空间类别编号又是人为指定的模型必须借助少量已标注目标样本才能知道噪声类0究竟该和哪个真实类别对齐。论文在CIFAR - 100上把每类标注样本降到0时ERM和NAF的准确率分别只有0.97%和1.34%都接近随机水平。一旦提供少量标注NAF便持续超过ERM。因此在半监督分类设定中真实源域未必是实现正迁移的必要条件。【NAF主要做了三件事】围绕论文给出的泛化上界NAF把训练目标拆成三部分。一是先学好少量真实标签目标域编码器把真实样本映射到共享表征空间分类器使用少量标注样本计算交叉熵损失用来建立噪声类和真实类别之间的桥梁。二是再让噪声形成清楚的类别结构噪声投影器负责把随机向量映射到同一个表征空间分类器则按照预设类别编号识别这些噪声。训练之后同类噪声逐渐聚拢不同类噪声彼此分离。三是最后把两边对齐NAF会计算噪声域和目标域之间的分布差异采用负域相似度Negative Domain SimilarityNDS作为默认机制。整套目标可写成特定形式论文给出的泛化上界也对应三项目标域经验误差、噪声域经验误差以及两域在共享表征空间中的分布差异。【从CIFAR到ImageNet噪声都能带来增益】主实验覆盖8个视觉数据集和1个文本分类数据集。除ImageNet - 1K外视觉任务均采用每类4个标注样本其余训练样本作为无标注数据。在ResNet - 18上NAF相较ERM的Top - 1提升分别达到CIFAR - 10 12.35 、CIFAR - 100 7.61 、DTD - 47 4.38 、Caltech - 101 2.74个百分点。在细粒度分类上同样有效。在更大规模的ImageNet - 1K上研究团队为每类保留100个标注样本NAF达到37.10%准确率比ERM高0.99个百分点。文本任务AG News - 4上使用BERT的NAF达到82.82%比ERM的78.64%高4.18个百分点。NAF也可以直接插入现有半监督方法接入后整体都获得了增益。【真正有用的不是“随机”而是结构】噪声为什么能帮忙论文的消融实验把答案指向了同一个因素类别之间是否具有可分离的结构。团队把所有类别的噪声都压成同一个点时噪声域彻底失去判别结构NAF不但没有增益反而出现明显负迁移。相反当逐步拉大噪声类别中心之间的距离时准确率提高。这说明噪声类越容易区分能够提供的结构引导通常越强。噪声数量反倒没有那么关键只要能形成可分离模式少量噪声就足以发挥作用。在Amazon到Caltech - 10的迁移实验中真实源数据整体仍略胜一筹但噪声源域已经能把准确率从ERM的83.51%提升到约88%至89%合成噪声可以成为一种成本很低的替代方案。它也不同于常见数据增强。【总结没有语义结构依然可以迁移】这项工作为迁移学习提供了一个颇具反常识的新视角源数据能够帮助目标任务未必完全依赖其真实语义表征空间中形成的类别结构同样可能成为可迁移的知识。NAF利用随机噪声在共享表征空间中形成具有判别性的结构再借助少量标注样本将其传递给真实数据。实验结果表明即使源域不包含真实图像、文本或音频只要保留合适的类别结构依然可能对目标任务产生正向作用。换句话说迁移学习所迁移的或许不只是“数据讲了什么”还包括“数据在表征空间中如何组织”这也为隐私受限、版权敏感或真实源数据难以获取的场景提供了一条新的研究思路。

相关新闻

Delphi调用VC OBJ文件实战:混合编程实现算法复用与性能优化

Delphi调用VC OBJ文件实战:混合编程实现算法复用与性能优化

1. 项目概述:为什么要在Delphi里调用VC的OBJ? 如果你是一个长期在Windows平台上做客户端开发的“老炮”,手头肯定有几个用Delphi写的祖传项目,界面漂亮、逻辑稳定,但就是某些核心算法或者硬件交互模块,当年…

2026/7/23 7:11:49 阅读更多 →
Java、C、Python、PHP、C#五门主流编程语言核心特性与应用场景深度对比

Java、C、Python、PHP、C#五门主流编程语言核心特性与应用场景深度对比

1. 项目概述:为什么需要对比这五门语言?在技术社区里,关于“哪门语言最好”的争论几乎从未停歇。作为一个在软件行业摸爬滚打了十多年的老码农,我见过太多新手在Java、C、Python、PHP、C#这几门主流语言面前陷入选择困难。有人觉得…

2026/7/23 7:10:48 阅读更多 →
视频平台AI内容审核:从文本检测到多模态审核的后端架构复盘

视频平台AI内容审核:从文本检测到多模态审核的后端架构复盘

视频平台AI内容审核:从文本检测到多模态审核的后端架构复盘 一、背景与问题定义 视频平台的内容安全体系面临一个核心矛盾:内容量的指数级增长与审核人力资源的线性增长之间的巨大差距。传统的人工审核模式在日均百万级视频上传的场景下已难以为继——审…

2026/7/23 7:10:48 阅读更多 →

最新新闻

“VLA-TVA”协同架构:打造具身智能“执行力”闭环(9)

“VLA-TVA”协同架构:打造具身智能“执行力”闭环(9)

前沿技术探索:AI智能体视觉(TVA,Transformer-based Vision Agent)是依托Transformer架构与“因式智能体”理论所构建的颠覆性工业视觉技术,是集深度强化学习(DRL)、卷积神经网络(CNN…

2026/7/23 21:33:59 阅读更多 →
AI数字人交互体验断层?95%企业忽略的3毫秒延迟阈值、眼动追踪校准、多模态意图纠错机制全披露

AI数字人交互体验断层?95%企业忽略的3毫秒延迟阈值、眼动追踪校准、多模态意图纠错机制全披露

更多请点击: https://kaifayun.com 第一章:AI数字人交互体验断层的本质诊断 AI数字人正从“能说会动”的演示型应用,加速迈向真实业务场景中的深度交互角色。然而,用户普遍反馈存在显著的体验断层:语音响应延迟、情感…

2026/7/23 21:33:59 阅读更多 →
2026武汉黄金回收白银回收铂金回收价格高无损耗专业鉴定本地人常去门店联系方式推荐

2026武汉黄金回收白银回收铂金回收价格高无损耗专业鉴定本地人常去门店联系方式推荐

2026武汉黄金白银铂金回收实测榜单|公安工商双备案无损测金无折旧费门店推荐 武汉三镇贵金属回收店铺遍地丛生,行业套路层出不穷,不少市民变现遭遇虚高报价、克扣损耗、未经同意熔金压价等问题。为帮助本地居民规避消费陷阱,小编实…

2026/7/23 21:33:59 阅读更多 →
“VLA-TVA”协同架构:打造具身智能“执行力”闭环(10)

“VLA-TVA”协同架构:打造具身智能“执行力”闭环(10)

前沿技术探索:AI智能体视觉(TVA,Transformer-based Vision Agent)是依托Transformer架构与“因式智能体”理论所构建的颠覆性工业视觉技术,是集深度强化学习(DRL)、卷积神经网络(CNN…

2026/7/23 21:33:59 阅读更多 →
Python agate-lookup 包详解:功能、安装、语法与实战案例

Python agate-lookup 包详解:功能、安装、语法与实战案例

1. 引言在 Python 数据处理生态中,agate 是一个轻量级、纯 Python 实现的表格数据处理库,而 agate-lookup 是其官方扩展包,专门用于在 agate 表格中实现类似 Excel VLOOKUP 的查找与合并功能。本文将从功能、安装、语法参数、实际案例和常见错…

2026/7/23 21:33:59 阅读更多 →
精密零件CNC加工选厂指南:三坐标检测是必备能力还是可选服务?

精密零件CNC加工选厂指南:三坐标检测是必备能力还是可选服务?

在精密零件CNC加工领域,很多采购在筛选供应商时,把三坐标检测当作"锦上添花"的加分项,觉得有更好,没有也能接受。但实际经验告诉我们:没有检测能力做支撑的精密加工,本质上是在"凭感觉出货&…

2026/7/23 21:32:58 阅读更多 →

日新闻

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表)

更多请点击: https://intelliparadigm.com 第一章:从单点好评到指数级传播:AI副业主理人必须掌握的4层口碑渗透模型(含ROI测算表) 当AI副业主理人不再仅满足于单次服务交付,而是主动构建可复用、可裂变、可…

2026/7/23 0:00:25 阅读更多 →
AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析

更多请点击: https://codechina.net 第一章:AI写作开头钩子设计:为什么你的AI文案完读率不足18%?——基于2,346篇A/B测试报告的归因分析 在对2,346篇跨行业AI生成文案的A/B测试数据进行聚类分析后,我们发现&#xff1…

2026/7/23 0:01:26 阅读更多 →
Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具

Chitchatter完整指南:免费开源的终极点对点安全聊天工具 【免费下载链接】chitchatter Secure peer-to-peer chat that is serverless, decentralized, and ephemeral 项目地址: https://gitcode.com/gh_mirrors/ch/chitchatter Chitchatter是一款革命性的安…

2026/7/23 0:01:26 阅读更多 →

周新闻

Go语言静态资源打包方案对比与实践指南

Go语言静态资源打包方案对比与实践指南

1. 项目背景与核心需求在Go语言开发中,我们经常需要处理静态资源文件的打包问题。无论是Web应用的模板文件、前端资源,还是配置文件、证书等,都需要随程序一起分发。传统做法是将这些文件与编译后的二进制文件放在同一目录下,但这…

2026/7/22 8:58:19 阅读更多 →
Go语言实现高性能LDAP认证服务的架构与实践

Go语言实现高性能LDAP认证服务的架构与实践

1. 项目背景与核心价值LDAP(轻量级目录访问协议)作为企业级身份认证的黄金标准,已经服务了超过80%的财富500强公司。我在金融科技领域实施统一认证体系时,发现传统Java方案存在启动慢、内存占用高等痛点。而Go语言凭借其协程并发模…

2026/7/22 19:43:43 阅读更多 →
【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

【AI面试官实战指南】:用ChatGPT模拟10类高频技术岗面试,3天提升应答精准度92%

更多请点击: https://intelliparadigm.com 第一章:AI面试官实战指南的核心价值与适用场景 AI面试官并非替代人类HR的“黑箱工具”,而是以可解释、可审计、可迭代的方式,赋能招聘全链路的关键基础设施。其核心价值在于将主观经验沉…

2026/7/23 17:49:47 阅读更多 →

月新闻