Skip to content

Latest commit

 

History

2 Commits

Folders and files

NameName
Last commit message
Last commit date
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 
 

Repository files navigation

Forward–Forward Algorithm 的后续改进研究地图

从正负好度到层协作、现代架构与物理部署的可审计谱系

完整文字版综述: 本 README 已直接收录领域全貌、综合报告、检索与证据审计,以及全部 14 项工作的逐篇解读。无需打开网页即可阅读全部研究内容;在线地图仅提供可选的可视化筛选与机制图。

在线地图 · 结构化真源 · 原始综合报告 · 原始检索审计

阅读导航

  1. 研究全貌
  2. 路线与层级
  3. 综合报告
  4. 全部研究工作
  5. 检索与证据审计
  6. 复现与使用边界

研究全貌

领域概览: FF 的核心变化不是换一个优化器,而是把全局损失改造成每层的正/负 goodness 判别,并用两次前向更新。后续研究主要沿三条互补方向推进:改造负样本与好度函数,向深层引入层间协作或层级目标,把机制迁移到 CNN、ViT、图网络和器件。直接反证同时显示,纯局部 FF 的深度协调、泛化和总系统成本仍未解决;更强的结果常引入局部截断反向、监督对比、多层融合或混合块,因此必须区分“跨层无反向”和“完全无反向”。

研究领域: Forward–Forward Algorithm 的后续改进

核心判断: 截至截止日,FF 的后续改进尚未证明可以在通用深度学习中全面替代反向传播;最清晰的进展是把问题从负样本与局部好度,推进到层间协调、真实数据公平评测和物理器件闭环。

阅读建议: 阅读时先区分纯 FF、跨层无反向但层内仍求梯度、以及硬件/邻接 forward-only 范式;评价新方法时同时要求同骨干精度、收敛、训练步数、总 FLOPs、显存、墙钟、负样本成本和硬件外围成本。

范围与纳排边界: 纳入 2022 年原始 Forward–Forward(FF)提出后,直接修改 FF 的正负相、goodness、负样本、层间协作、架构/任务、硬件实现或直接评测的工作;原始 FF 作为奠基条目。另纳入 4 个明确标注为邻接桥接的 forward-only/局部目标工作,用于解释 FF 的边界,但不把它们误称为严格 FF 变体。优先正式会议/期刊和作者预印本;截止 2026-08-13。长尾应用、只把 FF 当作未改造基线的论文、仅词面重合的 forward-forward、仍执行端到端反向传播的局部辅助损失均排除。

覆盖说明: 基于 2026-08-12 工作区内独立一手来源审计、原始 FF PDF 深读、前后向引用补漏和反证查询;本轮外部搜索与重新打开页面受环境策略限制,未把失败入口伪装成零命中。严格 FF 变体与邻接桥接已分层标注,长尾应用和未能重新打开的页面保留遗漏风险。

目标读者: 机器学习、计算神经科学、神经形态计算与物理学习研究人员

来源材料: 正式会议与期刊论文/DOI、OpenReview 与 PMLR 官方入口、arXiv 作者预印本、作者/机构项目与器件材料、工作区内原始 PDF 深读与独立审计记录

地图中心标签: 局部信用分配

内容语言: zh-CN

维度 数值
纳入成果 14 项
年份范围 2022—2026
研究路线 6 条
分析层级 4 个
覆盖等级 L2
资料截止 2026-08-13
第二轴 改进所处系统层级

路线与层级

路线(ID) 收录 判定问题 说明
好度与正负/自对比目标 / 好度与对比(goodness-negative 3 正负样本的差异是否让局部层学到任务结构,而不是标签或生成规则的捷径? 改变 goodness、负样本或自对比构造,使每层局部目标携带更有用的任务信息。
深度稳定与层间协作 / 深度与协作(depth-collaboration 4 早期层如何得到后续任务所需的协调信号,同时保持局部更新的边界? 处理独立层更新造成的语义错位、深度退化和训练不稳定,并记录是否重新引入截断反向。
架构与任务外延 / 架构外延(architecture-extension 2 机制能否穿过卷积、注意力或图消息传递接口,而不依赖小型全连接网络的特殊性? 把 FF 或相邻 forward-learning 机制迁移到 CNN、ViT、图网络和其他非原始多层感知机结构。
公平评测与反证 / 评测与反证(evaluation-counterevidence 2 改进是否在控制骨干、数据、训练预算和系统指标后仍成立? 直接比较同骨干 BP 与纯/混合 FF,记录真实数据、系统成本、负面结果和可扩展性审计。
物理器件与硬件部署 / 器件部署(hardware-deployment 1 无反向更新能否真正进入器件闭环,并在多层、读写和外围成本都计入后保持优势? 在忆阻器等物理介质中执行 FF/Competitive Forward,检查前向式更新、保持性和闭环范围。
相邻前向无反馈范式 / 相邻范式(adjacent-forward-only 2 如果完全的 FF 局部协调困难,目标投影或块分解是否提供另一种无跨层反向的折中? 保留直接解释 FF 边界的 forward-only、闭式投影和块级去噪工作,但明确它们不是原始 goodness 路线。
层级 说明
局部目标与好度 / 局部目标(0 直接改变正/负相、goodness、负样本或自对比学习信号,主要回答 FF 的最小机制问题。
网络深度与层间协作 / 深度协作(1 围绕多层训练的稳定性、层间语义协调和局部更新范围做改进;需要关注是否混入截断反向。
现代架构、任务与公平评测 / 规模评测(2 进入 CNN、ViT、图任务或真实数据与匹配预算比较;不等同于已经达到现代基础模型规模。
物理实现与部署 / 物理部署(3 在器件或硬件闭环中执行前向式更新,需同时核对矩阵乘、写入、控制、校准和保持性边界。

综合报告

Forward–Forward Algorithm 的后续改进:领域全貌与路线地图

覆盖等级:L2;声明范围内的结构化扫描、证据审计、严格验证和真实浏览器回归均已完成。检索截止:2026-08-13。这里的“全面”指覆盖原始机制、主要后续路线、现代架构外延、直接负面证据、硬件实现和相邻范式,而不是声称穷尽所有应用论文。

一句话结论

Forward–Forward(FF)最重要的变化是把全局损失的反向信用分配改成每层的正/负 goodness 判别:训练时做两次同构前向,当前层提高正样本好度、压低负样本好度,再把归一化活动送往下一层。原始 FF 之后,研究者主要在三处修补它:更好的负样本/好度函数,更强的层间协调与深度稳定,以及 CNN、ViT、图网络和物理器件外延。

截至截止日,没有一条证据链证明纯 FF 已在通用深度学习中全面替代反向传播。最有解释力的直接负面结果来自同一六层 CNN:BP 的 CIFAR-10 准确率为 85.4±0.4%,两种纯 FF 设置为 60.9±0.6% 与 68.6±0.5%。Scientific Reports 2025 近期改进确实缩小了局部目标与深度协调的差距,但通常伴随监督对比、层级标签、多层融合或有限范围反向;这必须在论文中单独记账。

范围合同

本地图纳入 2022 年原始 FF 之后,直接修改或直接评测 FF 的工作:正/负相、goodness、负样本、层间协作、训练深度、CNN/ViT/图任务扩展、硬件实现,以及对 FF 扩展性和公平预算的反证。原始 FF 是奠基条目。为解释边界,另纳入 ForwardGNN、Forward Projection 和 NoProp 三个相邻 forward-only/局部目标工作;它们在页面上标为“桥接”,不被称为严格 FF 变体。

排除项包括:只把 FF 当作未改造基线的应用论文;只因标题出现 forward-forward 的词面重合;仍保留端到端反向传播的深监督;以及纯零阶或反馈对齐方法。论文题名保留原文,出版状态与证据等级分开记录。

六条主要路线与四级系统层级

路线 主要修补点 代表条目 严格性边界
好度与正负/自对比目标 让局部 goodness 携带更可靠的任务结构,减少负样本捷径 原始 FFSCFFBiCovG 自对比、协方差和特征对齐增加了目标设计;BiCovG 的 Hybrid Goodness Blocks 允许块内 BP,不能和纯局部结果合并
深度稳定与层间协作 解决独立层的语义错位、深度退化和信息协调 TrifectaLayer CollaborationHCL-FF Trifecta 的 OLU 是两层截断反向;HCL-FF 用层级目标、监督对比和融合改善,但尚未同预算超越 BP
架构与任务外延 把局部目标带到 CNN、ViT 和图消息传递 CFF-ViTForwardGNN CFF-ViT 的局部目标内部仍可求梯度;ForwardGNN 是 forward-learning 桥接,不是原始 goodness 变体
公平评测与反证 用同骨干、真实数据和全栈资源审计扩展性 卷积 FF 对照DTG-FF 负面结果约束主张,不等于证明所有未来目标都失败;必须随方法改变更新审计
物理器件与硬件部署 把正/负或竞争更新写入忆阻器,检查保持性与闭环 忆阻器前向式学习 多层矩阵乘仍为软件仿真,完整硬件闭环只到单层;编程能耗不是全训练能耗
相邻前向无反馈范式 以随机目标投影、闭式回归或独立去噪块绕开跨层通信 Forward ProjectionNoProp 不是严格 FF;NoProp 块内仍使用 BP,Forward Projection 的目标生成与 FF goodness 不同

第二轴是“改进所处系统层级”,不是论文质量:

  1. 局部目标与好度:直接改正/负相、goodness 或自对比信号。
  2. 网络深度与层间协作:解决层级协调与深度稳定,核对是否重新引入截断反向。
  3. 现代架构、任务与公平评测:进入 CNN、ViT、图任务或匹配预算比较,但不等同于基础模型规模。
  4. 物理实现与部署:把更新真正放入器件或硬件闭环,并核查读写、控制和保持性。

发展时间线

  • 2022:定义范式。 Hinton 将两次前向、正/负样本和逐层 goodness 组合成 FF;原文明确这是少数小问题上的初步研究,并承认速度、泛化和负样本仍是缺口。原始 FF
  • 2024:从可行性转向深度协调。 Trifecta 以 SymBa、批归一化和 OLU 把可用深度推进到约 12 层,但 OLU 使完整方案不再是严格纯局部;Layer Collaboration 则把“独立层不能协作”作为显式机制问题。TrifectaLayer Collaboration
  • 2025:负样本、自监督与架构迁移。 CFF-ViT 进入 ViT,SCFF 用自对比关系扩展到 Tiny-ImageNet 与序列,卷积 FF 同骨干实验则给出纯局部深度协调的直接负面证据。CFF-ViTSCFF卷积 FF 对照
  • 2026:层级目标、好度统计、预算审计与器件化。 HCL-FF 将粗到细层级目标和监督对比引入 FF;BiCovG 转向协方差感知好度;DTG-FF 检查真实数据和 GPU 系统成本;忆阻器工作把监督 FF/Competitive Forward 写入物理阵列。HCL-FFBiCovGDTG-FF忆阻器前向式学习

机制对比:改进到底改变了什么

1. 负样本从外部构造转向自对比与层级目标

原始 FF 的负数据是核心设计变量:监督场景可以把错误标签并入输入,无监督场景则需要构造破坏长程结构的混合样本。原始 FF SCFF 把其中一部分负样本设计转成自对比关系,减少对人工负样本的依赖,但仍需要增强和读出协议;HCL-FF 则把目标从“所有层同一标签”改成由粗到细的层级目标,并加入监督对比。SCFFHCL-FF

这类改进的共同代价是:局部目标越来越像一个精心设计的监督/对比学习系统。它们可能更好地把标签信息送到早期层,却也削弱了“只靠简单本地 goodness 就能自然形成深层语义”的强主张。

2. 深度问题不是简单的优化器问题

Trifecta 的结果说明,归一化、对称化损失和局部更新窗口可以缓解深度退化;Layer Collaboration 的问题诊断更直接:各层独立优化时,层间缺少协作。TrifectaLayer Collaboration HCL-FF 继续用层级目标和多层融合改善协调,但论文仍报告收敛慢、泛化弱,且参数匹配的宽残差基线领先。HCL-FF

因此,判断“纯 FF 是否扩展”不能只看层数或单次准确率,还要问:后层目标是否能反过来影响前层、是否增加了重叠块、融合或额外读出、以及这些通道是否已经恢复了某种有限范围的信用传播。

3. 好度函数正在从标量活动量走向二阶结构

BiCovG 的路线不再把 goodness 限定为活动平方和,而是引入协方差感知统计和局部对齐;它在 ImageNet-100 上给出 73.01% 的纯局部结果,但允许块内 BP 的 Hybrid Goodness Blocks 才把与 BP 的差距缩至 3.6%。BiCovG 这是一条有价值的机制改进,也正好说明必须把“好度更强”和“块内 BP 更强”分开计数。

4. 架构迁移扩大了适用面,但没有自动带来规模化

CFF-ViT 说明局部对比 FF 可以进入 Vision Transformer;ForwardGNN 说明更宽的 forward-learning 局部目标可以进入图消息传递。CFF-ViTForwardGNN 但两者都不能直接支持“原始 FF 已经适用于所有现代架构”:CFF-ViT 的局部目标内部仍求梯度,ForwardGNN 也没有被本地图误标为原始 goodness 变体。

负面证据、争议与空白

直接负面结果
  • 同骨干卷积比较: BP 85.4±0.4%,纯 FF 60.9±0.6% 或 68.6±0.5%,并观察到标签捷径和更慢收敛。Scientific Reports 2025
  • 真实数据与全栈预算: DTG-FF 报告 CIFAR-10/100 中 BP 分别高 2.40/5.93 个百分点,ImageNet-100 层局部训练约 49.4%;8GB GPU 记录中 DTG-FF 约 7.90GB、138 图像/秒,BP+梯度累积约 4.18GB、157 图像/秒。DTG-FF
  • 改进仍有边界: HCL-FF 的相对 FF 提升并不等同超过 BP;BiCovG 的最佳差距缩小依赖混合块内 BP;Trifecta 的 OLU 也不是纯局部更新。HCL-FFBiCovGTrifecta
仍未解决的研究问题
  1. 纯局部协调: 能否让后层语义影响前层,而不把 OLU、跨层融合或局部反向重新命名为“纯 FF”?
  2. 负样本与标签捷径: 能否在自然数据流中自动形成稳定、任务相关而非投机的负样本?
  3. 现代规模: 是否能在 ImageNet-1K、长序列、开放词汇或大语言模型上,以同骨干、同数据和同调参预算比较?
  4. 总成本: 两次前向、负样本生成、层级标签、额外读出、局部融合和训练轮数的总 FLOPs、墙钟、显存和通信是多少?
  5. 硬件闭环: 忆阻器工作已经显示单层或部分多层可写入,但多层矩阵乘、器件漂移、校准、写入随机性和外围控制仍需一起测量。忆阻器前向式学习
  6. 可复现性: 后续论文应同时发布负样本构造、层冻结/解冻协议、局部读出、训练轮数和完整资源账本,避免用合成任务或不同骨干制造虚假的可比性。

推荐阅读路径

  • 先建立机制: 原始 FF,再读本地图中的逐条详情,尤其是正/负相、goodness、层归一化和监督推理。
  • 理解深度瓶颈: TrifectaLayer Collaboration。这条路径把“更深”与“层间协作”区分开,并明确 OLU 的混合边界。
  • 看现代架构与自监督: CFF-ViTSCFFHCL-FF
  • 必须读反证: 卷积 FF 对照DTG-FF。它们防止把局部更新直接等同为更强性能或更低总成本。
  • 看好度与部署: BiCovG忆阻器前向式学习。前者检查目标统计,后者检查器件闭环;两者都要保留预印本状态和边界。
  • 理解相邻路线: Forward ProjectionNoProp,用于区分“FF 后续”与“更宽的无跨层反向训练范式”。

覆盖闸门与限制

L2 闸门 本项目状态
范围与来源 已完成:范围合同冻结;14 个工作族均有 T1 一手入口,邻接桥接单独标注。
分支代表性 已完成(声明范围内):覆盖奠基、深度/协作、负样本/好度、现代架构、公平反证和硬件部署;硬件分支的直接 FF 文献仍稀疏,已明确记录。
边际收敛 已完成(继承本地独立审计):两轮互补饱和后未新增一级机制;本项目专项补漏主要新增版本和边界,而非新路线。
深读 已完成但有边界:多数核心条目完成正文/附录级记录;Advancing FF 保守为正式摘要级,并未把未核验组件写入详情。
证据审计 已完成:核心数字、比较、出版状态、纯局部/混合边界和预印本状态写入 planning/claim_ledger.csv;没有把“未发现”写成绝对不存在。

研究证据闸门已具备 L2 所需的结构化材料。2026-08-15 从最终位置复跑真实浏览器验收,14 条详情与 8 个非空聚合组在桌面、键盘、375 像素手机和 file:// 下全部通过,因此关闭早期环境限制并将交付提升为 L2。

本地图不声称绝对穷尽。当前外部 web 搜索接口返回网络错误,应用内浏览器重新打开 arXiv 与 AAAI 页面也被安全策略拒绝;这些失败入口已经写入 planning/search_ledger.jsonldocs/SEARCH_AUDIT.md。地图因此继承了工作区内 2026-08-12 的一手来源审计和原始 PDF 深读,不把本轮访问受限包装成新检索结果。后续更新应优先复核 2026 年预印本的正式版本、代码、数据和新的真实大规模 FF 评测。

全部研究工作(14 项)

以下条目严格保持 atlas.json 的策展顺序,并在 README 内直接列出问题、机制、证据、局限、启示、核验边界与全部可用来源。

1. Forward–Forward 算法:初步研究|The Forward-Forward Algorithm: Some Preliminary Investigations(2022 · arXiv)

作者: Geoffrey Hinton

书目: 年份 2022;载体 arXiv;状态 预印本;来源类型 paper

分类: 主路线 好度与正负/自对比目标;相关路线 好度与正负/自对比目标;层级 局部目标与好度;阅读层级 核心;证据等级 C;简称 原始 FF;相关性排序 1

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D2 / P=P1 / Q=Q1

标签: 正负样本、goodness、局部目标、奠基

定位: 每层用正/负两次前向提高或降低 goodness,去掉跨层反向梯度链。

问题: 能否用局部正负对比目标训练深层网络,而不把全局损失的导数沿网络反向传播?

机制: 正数据和负数据分别前向通过每层;当前层根据活动平方和等 goodness 目标更新本层权重,再把归一化活动送入下一层。监督分类可把标签并入输入,测试时按候选标签累计 goodness。

步骤:

  1. 构造正样本与负样本
  2. 分别执行两次前向过程
  3. 计算每层 goodness 与局部目标
  4. 只更新当前层并传递归一化活动

证据:

  • 预印本在混合负样本的 MNIST 任务中报告全连接版本约 1.37% 和局部感受野版本约 1.16% 测试错误;两种设置并非同一模型。
  • CIFAR-10 局部感受野实验中,逐标签 goodness 推理错误率约 41%,原文给出的 BP 对照约为 37%/39%;作者将工作定位为少数小问题上的初步调查。

局限:

  • 负样本构造是外部设计问题,简单负样本可能让网络学习生成规则而非任务结构。
  • 原文承认 FF 比 BP 慢且在部分问题上泛化较差;没有现代大规模视觉或语言证据。
  • 当前记录仍是预印本,不能把后续改进结果倒灌为原始 FF 证据。

意义:

  • 它改变的是训练目标与信用分配接口,而不只是换一种梯度估计器。
  • 后续研究的核心问题自然转向负样本、层间协调、深度稳定和硬件闭环。

边界: 已对工作区内原始 16 页 PDF 完成深读,并与 arXiv 一手入口记录核对;2026-08-13 无法重新打开 arXiv,未确认正式同行评议版本。证据仅覆盖原文实验与作者限定语。

标识: 工作族 ID ff-core

证据位置:

  • 摘要
  • §2–§4
  • 表1
  • §6–§8

资源: 一手入口

关联 ID: trifecta-2024 · layer-collaboration-2024 · ff-cnn-2025


2. Trifecta:训练更深 Forward–Forward 网络的三项简单技术|The Trifecta: Three simple techniques for training deeper Forward-Forward networks(2024 · Transactions on Machine Learning Research)

书目: 年份 2024;载体 Transactions on Machine Learning Research;状态 同行评议;来源类型 paper

分类: 主路线 深度稳定与层间协作;相关路线 深度稳定与层间协作、好度与正负/自对比目标;层级 网络深度与层间协作;阅读层级 核心;证据等级 A;简称 Trifecta;相关性排序 2

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D2 / P=P2 / Q=Q2

标签: 深度稳定、SymBa、批归一化、OLU、混合局部

定位: 用 SymBa、批归一化和重叠局部更新缓解 FF 的深度退化,但最后一项混入两层截断反向。

问题: 原始 FF 的逐层独立 goodness 在网络变深后难以保持稳定和可用表征,怎样增加深度而不直接恢复全网 BP?

机制: 工作将 goodness 损失、归一化和局部更新范围作为联合训练配方:SymBa 改善正负判别,批归一化稳定活动分布,OLU 让相邻层共享一个有限范围的训练窗口。

步骤:

  1. 用 SymBa 重新组织正负 goodness 损失
  2. 对层活动施加批归一化
  3. 以 OLU 在相邻层窗口内更新
  4. 在更深网络上比较深度与性能变化

证据:

  • 本地一手审计记录其在 CIFAR-10 等中型任务上把可用深度推进到约 12 层,最佳结果约 83.7%,训练约 500 个 epoch。
  • 审计同时记录超过约 12 层后增益停滞,说明技术组合缓解了深度问题但没有消除它。

局限:

  • OLU 是两层截断反向或重叠模块更新,不属于严格意义上的完全纯 FF。
  • 额外归一化、局部窗口和训练轮数增加了计算成本;没有通用基础模型或大规模 ImageNet-1K 证据。

意义:

  • FF 的深度瓶颈与跨层协调有关,单纯堆叠独立局部分类器并不能自然扩展。
  • 它建立了后续“纯局部改进 vs 混合局部方案”的边界基线。

边界: 使用 OpenReview/TMLR 版本族和本地 2026-08-12 逐条审计记录;机制、深度和 OLU 边界按正文/附录核验,未把 OLU 结果写成纯 FF 结果。

标识: 工作族 ID trifecta-2024

证据位置:

  • 摘要
  • 方法与训练配方
  • 深度消融
  • 附录 OLU 说明

资源: 一手入口

关联 ID: ff-2022 · layer-collaboration-2024 · hcl-ff-2026


3. Forward–Forward 算法中的层间协作|Layer Collaboration in the Forward-Forward Algorithm(2024 · AAAI)

书目: 年份 2024;载体 AAAI;状态 同行评议;来源类型 paper

分类: 主路线 深度稳定与层间协作;相关路线 深度稳定与层间协作、公平评测与反证;层级 网络深度与层间协作;阅读层级 核心;证据等级 A;简称 层间协作;相关性排序 3

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D2 / P=P2 / Q=Q2

标签: 层间协作、局部信用、机制反证、AAAI 2024

定位: 把“每层独立优化、层间不能协作”从 FF 的局限变成直接研究问题,并提出层间协作修复。

问题: 如果每一层只根据自身 goodness 学习,早期层如何知道后续层真正需要的语义结构?

机制: 在局部 FF 目标之外引入层间协作信息,使层更新不再完全由孤立的当前层判别决定;论文把这种协作作为对原始独立层训练的结构性修正。

步骤:

  1. 识别独立 goodness 导致的层间错位
  2. 保留局部正负训练接口
  3. 加入层间协作信号或联合约束
  4. 在深层任务上与原始 FF 比较

证据:

  • AAAI 正式论文明确把原始 FF 的层独立优化和次优性能作为动机,并报告层协作方向的改进证据。
  • 该工作在谱系中连接了原始 FF 与后续层级/对比目标方法,而不是把独立局部目标当作已经解决的问题。

局限:

  • 层间协作增加了额外信息通道,局部性与通信成本需要单独核算。
  • 现有证据仍处于中小规模深度视觉任务,不能推断在现代基础模型上有效。

意义:

  • 它给出 FF 后续改进最清晰的失败诊断之一:层级表征需要协作,而不是简单的逐层独立分类。
  • 后续 HCL-FF 的粗到细目标和多层融合可视为同一问题的不同修复路径。

边界: 正式 AAAI 2024 论文,DOI 10.1609/aaai.v38i13.29324;来自本地独立审计的摘要/方法核验,当前环境无法重新打开 AAAI 页面。

标识: DOI 10.1609/aaai.v38i13.29324;工作族 ID layer-collaboration-2024

证据位置:

  • 摘要
  • 动机与方法
  • 与原始 FF 的比较

资源: 一手入口

关联 ID: ff-2022 · trifecta-2024 · advancing-ff-2026 · hcl-ff-2026


4. 对比 Forward–Forward:一种视觉 Transformer 训练算法|Contrastive Forward-Forward: A Training Algorithm of Vision Transformer(2025 · Neural Networks)

书目: 年份 2025;载体 Neural Networks;状态 同行评议;来源类型 paper

分类: 主路线 架构与任务外延;相关路线 架构与任务外延、好度与正负/自对比目标;层级 现代架构、任务与公平评测;阅读层级 核心;证据等级 A;简称 CFF-ViT;相关性排序 4

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D2 / P=P2 / Q=Q2

标签: Vision Transformer、局部对比、跨模块无反向

定位: 把对比式 FF 的局部训练接口迁移到 Vision Transformer,并明确把梯度限制在局部模块内。

问题: 原始 FF 主要在多层感知机/卷积设置中讨论,注意力和 Transformer block 能否在不跨块反向的条件下训练?

机制: 每个 ViT 局部模块分别处理正/负或对比输入,计算局部目标并在模块内部更新;跨模块的全局梯度链被截断,但层内仍可以使用常规反向求局部目标。

步骤:

  1. 把图像切成 token 并进入 ViT block
  2. 为每个 block 构造正/负对比前向
  3. 只在当前 block 内优化局部目标
  4. 组合各层表征并评估视觉分类

证据:

  • 正式 Neural Networks 版本报告将 CFF 扩展到 Vision Transformer,并相对原始 FF 提升训练表现。
  • 本地审计未发现 ImageNet-1K 规模验证,因此只把它作为架构迁移证据。

局限:

  • 局部目标内部仍有反向计算,不能写成完全无梯度。
  • 任务与规模尚未覆盖 ImageNet-1K 或语言模型;局部目标、token 交互和最终读出成本需要公平核对。

意义:

  • FF 的局部目标可以进入注意力架构,但迁移并不自动解决跨层语义协调。
  • 它说明“跨模块无反向”与“完全无反向”是必须分开的两个研究问题。

边界: 使用 Neural Networks 正式 DOI 版本和本地审计记录;对应作者预印本入口为 arXiv:2502.00571,正式版本优先。

标识: DOI 10.1016/j.neunet.2025.107867;工作族 ID cff-vit-2025

证据位置:

  • 摘要
  • 局部 ViT 训练方法
  • 视觉实验与限制

资源: 一手入口

关联 ID: ff-2022 · scff-2025 · ff-cnn-2025 · forwardgnn-2024


5. 自对比 Forward–Forward 算法|Self-Contrastive Forward-Forward algorithm(2025 · Nature Communications)

书目: 年份 2025;载体 Nature Communications;状态 同行评议;来源类型 paper

分类: 主路线 好度与正负/自对比目标;相关路线 好度与正负/自对比目标、架构与任务外延;层级 现代架构、任务与公平评测;阅读层级 核心;证据等级 A;简称 SCFF;相关性排序 5

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D2 / P=P2 / Q=Q3

标签: 自监督、自对比、Tiny-ImageNet、序列

定位: 用自对比样本替代部分外部负样本设计,把 FF 推向自监督、序列和更复杂视觉任务。

问题: 原始 FF 依赖负样本或标签构造;能否从样本自身生成对比关系,降低负样本设计负担并扩展任务?

机制: 围绕同一输入或其变换构造自对比正/负关系,在每个局部模块上使用 FF 式 goodness/对比目标,最后用线性或任务读出完成评估。

步骤:

  1. 从样本或样本变换构造自对比对
  2. 分别执行局部正/负前向
  3. 优化每层自对比 goodness
  4. 冻结或组合表征后完成视觉/序列读出

证据:

  • Nature Communications 正式论文把自对比 FF 扩展到 Tiny-ImageNet 与序列数据,并报告相对原始局部方案的改进。
  • 作者讨论中仍承认纯局部学习与端到端自监督目标之间存在性能差距。

局限:

  • 自对比关系和数据增强仍是设计变量,可能把结构先验移入样本构造。
  • 完整分类性能需区分局部表征和监督线性读出;不能把读出结果等同端到端训练。
  • 尚无大规模 Transformer 或基础模型证据。

意义:

  • 负样本问题可以从外部负例转向自对比生成,但不等于层间协调已经解决。
  • 它把 FF 的研究焦点从“如何判别负样本”扩展到“如何构造可迁移的局部学习信号”。

边界: Nature Communications 2025 正式 DOI 版本;本地专项审计核验结果与讨论边界已写入 claim ledger。

标识: DOI 10.1038/s41467-025-61037-0;工作族 ID scff-2025

证据位置:

  • 摘要
  • 自对比构造
  • 视觉与序列实验
  • 讨论

资源: 一手入口

关联 ID: ff-2022 · cff-vit-2025 · hcl-ff-2026


6. 使用 Forward–Forward 算法训练卷积神经网络|Training convolutional neural networks with the Forward–Forward Algorithm(2025 · Scientific Reports)

书目: 年份 2025;载体 Scientific Reports;状态 同行评议;来源类型 paper

分类: 主路线 公平评测与反证;相关路线 公平评测与反证、架构与任务外延;层级 现代架构、任务与公平评测;阅读层级 核心;证据等级 A;简称 六层 CNN 反证;相关性排序 6

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D3 / P=P2 / Q=Q3

标签: CNN、CIFAR-10、同架构对照、负面证据

定位: 在同一六层 CNN 上直接对照 BP 与纯 FF,给出深层信息协调不足的强负面证据。

问题: 纯层局部 goodness 在卷积视觉任务中能否维持与同架构 BP 相当的判别信息?

机制: 将类别模式注入输入形成正/负样本,各卷积层独立优化局部 goodness,并冻结层间梯度;同一骨干另用 BP 训练作直接对照。

步骤:

  1. 生成带空间标签的正负输入
  2. 逐层优化卷积 goodness
  3. 切断层间梯度并保持骨干一致
  4. 报告 BP、两种纯 FF 设置的多次运行结果

证据:

  • CIFAR-10 同一六层 CNN 中,BP 准确率为 85.4±0.4%,两种纯 FF 设置为 60.9±0.6% 和 68.6±0.5%。
  • 论文还观察到标签捷径与更慢收敛,直接把层间协调而不是单纯优化器列为瓶颈线索。

局限:

  • 研究集中在中小型卷积网络,不能排除更好的局部目标、宽度或硬件配方。
  • 结果是对两种纯 FF 设定的反证,不应外推为所有后续 FF 变体必然失败。

意义:

  • 它是评估后续改进最重要的同骨干负面基线之一。
  • 任何声称“无反向即更好”的方法都应报告真实数据、同骨干 BP、训练预算和总系统成本。

边界: Scientific Reports 2025 正式 DOI 版本;数值来自本地专项审计记录的同架构主实验,未把负面结果扩大到未测试的 FF 变体。

标识: DOI 10.1038/s41598-025-26235-2;工作族 ID ff-cnn-2025

证据位置:

  • 主实验
  • CIFAR-10 表
  • 标签捷径分析
  • 讨论

资源: 一手入口

关联 ID: ff-2022 · cff-vit-2025 · hcl-ff-2026 · dtg-ff-2026


7. 推动 Forward–Forward 算法走向高性能深层局部学习|Advancing the forward-forward algorithm towards high-performance deep local learning(2026 · Neural Networks)

书目: 年份 2026;载体 Neural Networks;状态 同行评议;来源类型 paper

分类: 主路线 深度稳定与层间协作;相关路线 深度稳定与层间协作、公平评测与反证;层级 现代架构、任务与公平评测;阅读层级 桥接;证据等级 B;简称 高性能深层 FF;相关性排序 7

核验: 来源层级 T1;核验状态 abstract-checked;V/D/P/Q V=V2 / D=D2 / P=P2 / Q=Q2

标签: 深层局部学习、性能修复、2026 前沿

定位: 把原始 FF 在复杂任务上的性能与泛化不足明确化,并以深层局部学习为目标推进修复。

问题: 原始 FF 的局部 goodness 能否通过更高性能的深层局部训练机制进入复杂视觉任务?

机制: 论文围绕深层局部学习的性能瓶颈设计改进训练方案,并将原始 FF 作为基线比较;由于当前环境无法重新打开页面,本地图只保留正式摘要与独立审计支持的机制级描述。

步骤:

  1. 识别原始 FF 的深层性能和泛化缺口
  2. 构造增强的深层局部训练流程
  3. 在复杂任务上与原始 FF/基线比较
  4. 报告改进效果与仍存在的泛化边界

证据:

  • 正式 Neural Networks 2026 入口明确把原始 FF 的次优性能和复杂任务泛化问题作为后续改进动机。
  • 本地独立审计将其列入直接负面与修复链,而不是只作为标题线索。

局限:

  • 当前条目以正式摘要和版本元数据为主,未把未重新打开的正文组件或数值扩写进地图。
  • 即使复杂任务表现提升,也不能由题名或摘要推出已全面超越 BP。

意义:

  • 它把 FF 后续工作从“可否工作”推进到“如何高性能深层化”的阶段。
  • 后续阅读应重点核查它是否保持纯局部,以及改进来自目标设计、协作通道还是混合反向。

边界: 正式 DOI 10.1016/j.neunet.2026.108765;本地独立审计已核验出版状态与摘要级主张,因当前页面访问限制,机制细节保守降为 V2。

标识: DOI 10.1016/j.neunet.2026.108765;工作族 ID advancing-ff-2026

证据位置:

  • 正式摘要
  • 出版元数据
  • 独立审计筛选记录

资源: 一手入口

关联 ID: layer-collaboration-2024 · hcl-ff-2026 · bicovg-2026 · dtg-ff-2026


8. HCL-FF:面向 Forward–Forward 算法的层级与对比学习|HCL-FF: Hierarchical and Contrastive Learning for Forward-Forward Algorithm(2026 · CVPR)

书目: 年份 2026;载体 CVPR;状态 同行评议;来源类型 paper

分类: 主路线 深度稳定与层间协作;相关路线 深度稳定与层间协作、好度与正负/自对比目标、公平评测与反证;层级 现代架构、任务与公平评测;阅读层级 核心;证据等级 A;简称 HCL-FF;相关性排序 8

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D2 / P=P2 / Q=Q2

标签: 层级目标、监督对比、残差融合、CIFAR、Tiny-ImageNet

定位: 用粗到细层级目标、监督对比和无参数残差融合推进纯局部 FF 的跨层协调。

问题: 如果所有层都直接学习同一细粒度标签,深层 FF 如何避免目标重复、语义错位和信息传递退化?

机制: 按网络深度为层分配粗到细的层级标签目标,在每层加入监督对比项,并以不引入可学习参数的残差融合汇聚多层信息。

步骤:

  1. 构建粗到细的标签层级
  2. 按深度分配不同粒度目标
  3. 联合优化 goodness 与监督对比项
  4. 用无参数残差融合层级表征并评估

证据:

  • CVPR 2026 正文报告相对既有 FF 方法在 CIFAR-10、CIFAR-100 和 Tiny-ImageNet 分别提升 5.46、17.00 和 12.51 个百分点。
  • 论文仍报告收敛慢于 BP、泛化较弱;参数匹配的宽残差网络继续领先。

局限:

  • 类别分配和层级标签会随标签空间变大而变得昂贵,能否迁移到开放词汇或基础模型未知。
  • 多层融合、监督对比和更宽骨干使比较必须控制参数量、训练预算和读出方式。

意义:

  • 层级目标是直接回应层间协作缺口的较强纯局部改进路线。
  • 它同时说明纯 FF 的主要进展仍是缩小差距,而非在同预算下取代 BP。

边界: CVPR 2026 正式开放论文页与本地版本族核验;数值来自正文结果表,作者预印本作为版本补充但不替代正式入口。

标识: 工作族 ID hcl-ff-2026

证据位置:

  • 摘要
  • 层级目标与对比损失
  • CIFAR/Tiny-ImageNet 结果
  • 局限讨论

资源: 一手入口

关联 ID: trifecta-2024 · scff-2025 · advancing-ff-2026 · bicovg-2026 · dtg-ff-2026


9. 面向可扩展 Forward–Forward 学习的协方差感知好度|Covariance-Aware Goodness for Scalable Forward-Forward Learning(2026 · arXiv)

书目: 年份 2026;载体 arXiv;状态 预印本;来源类型 paper

分类: 主路线 好度与正负/自对比目标;相关路线 好度与正负/自对比目标、公平评测与反证;层级 现代架构、任务与公平评测;阅读层级 核心;证据等级 C;简称 BiCovG;相关性排序 9

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V4 / D=D3 / P=P1 / Q=Q3

标签: 协方差、goodness、ImageNet-100、混合块、预印本

定位: 用协方差感知的 goodness 与局部特征对齐改善 FF 的规模化,并把纯局部与块内 BP 混合版分开。

问题: 标量活动平方和难以表达高维表征的协方差结构,能否用二阶统计量帮助局部 FF 学到可迁移特征?

机制: 以协方差感知好度替代单一活动长度,并结合局部特征对齐目标;论文另给出允许块内 BP 的 Hybrid Goodness Blocks,用于区分目标函数改进与有限范围反向协调。

步骤:

  1. 统计局部表示的协方差结构
  2. 构造协方差感知 goodness 与对齐损失
  3. 分别训练纯局部和混合块版本
  4. 在统一 VGG-16/图像任务上比较规模与边界

证据:

  • 预印本报告纯局部 BiCovG+FAL 在 ImageNet-100 达 73.01%。
  • 同一记录显示,允许块内 BP 的 Hybrid Goodness Blocks 才把与 BP 的差距缩至 3.6%;复现 DeeperForward 的融合准确率仅约 13%。

局限:

  • 截至截止日仍为预印本,结果和代码需要独立复核。
  • 混合块结果不能作为纯 FF 结果;二阶统计量和对齐损失也会增加计算与设计复杂度。
  • ImageNet-100 不等同于 ImageNet-1K 或基础模型规模。

意义:

  • goodness 的统计形式本身是可研究的瓶颈,不必局限于活动平方和。
  • 它把“性能提升来自更好的局部目标”与“性能提升来自重新引入块内反向”明确拆开。

边界: arXiv:2605.04346 预印本;使用本地独立审计的正文/附录记录,正式出版状态截至截止日未确认。纯局部与 Hybrid Goodness Blocks 的证据分别记录。

标识: 工作族 ID bicovg-2026

证据位置:

  • 方法
  • ImageNet-100 主表
  • Hybrid Goodness Blocks
  • DeeperForward 复现附录

资源: 一手入口

关联 ID: ff-2022 · hcl-ff-2026 · advancing-ff-2026 · dtg-ff-2026


10. 合成基准高估了 Forward–Forward 的扩展性:层局部训练在真实数据上的边界|Synthetic Benchmarks Overstate Forward-Forward Scaling: Real-Data Limits of Layer-Local Training(2026 · arXiv)

书目: 年份 2026;载体 arXiv;状态 预印本;来源类型 benchmark

分类: 主路线 公平评测与反证;相关路线 公平评测与反证、深度稳定与层间协作;层级 现代架构、任务与公平评测;阅读层级 核心;证据等级 C;简称 DTG-FF 公平审计;相关性排序 10

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V4 / D=D3 / P=P1 / Q=Q3

标签: 公平基准、真实数据、显存、吞吐、反证

定位: 用匹配骨干、真实数据和系统指标审计 FF 的扩展性主张,直接检验合成任务与理论内存优势是否能外推。

问题: 纯局部 FF 在合成或小任务上的结果,是否会在真实图像、匹配预算和实际 GPU 系统中失效?

机制: 它不是新的 FF 优化器,而是统一骨干、训练配方、数据和系统测量的审计框架;同时比较 BP-DeepSup、层局部 FF 及其真实数据表现。

步骤:

  1. 固定骨干、数据和训练配方
  2. 在合成与真实图像上分别训练 BP 与 FF
  3. 测量准确率、显存和吞吐而非只看局部更新
  4. 检查层数与数据分布变化下的扩展性

证据:

  • 预印本报告匹配骨干下 BP 在 CIFAR-10/100 分别高 2.40/5.93 个百分点,ImageNet-100 中层局部方法约 49.4%,而典型 BP 基线高于 75%。
  • 在 8GB GPU 系统记录中,BP+梯度累积约 4.18GB、157 图像/秒,DTG-FF 约 7.90GB、138 图像/秒;这不支持局部更新必然带来系统优势。

局限:

  • 预印本审计结果依赖所选骨干、训练配方和基准,不能证明所有未来 FF 设计都失败。
  • 负面结果需要与各改进论文的自定义数据增强、宽度和读出协议逐项对齐。

意义:

  • 它把“算法局部性”与“总系统资源优势”分开,是解释 FF 后续结果的关键反证。
  • 未来改进应优先报告同骨干真实数据和全栈预算,而不是只报告层内激活内存。

边界: arXiv:2606.06539 预印本;数值来自本地独立审计的正文和系统附录记录,正式出版状态截至截止日未确认。

标识: 工作族 ID dtg-ff-2026

证据位置:

  • CIFAR-10/100 表
  • ImageNet-100 表
  • 8GB GPU 系统附录
  • 讨论

资源: 一手入口

关联 ID: ff-cnn-2025 · bicovg-2026 · hcl-ff-2026 · forward-projection-2026


11. 具有月级稳定性的忆阻器阵列前向式学习|Forward-only learning in memristor arrays with month-scale stability(2026 · arXiv)

书目: 年份 2026;载体 arXiv;状态 预印本;来源类型 paper

分类: 主路线 物理器件与硬件部署;相关路线 物理器件与硬件部署、好度与正负/自对比目标;层级 物理实现与部署;阅读层级 核心;证据等级 C;简称 忆阻器 FF;相关性排序 11

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D2 / P=P1 / Q=Q2

标签: 忆阻器、Competitive Forward、器件保持、硬件闭环、预印本

定位: 在 HfOx/Ti 忆阻器阵列中执行监督 FF 与 Competitive Forward,展示前向更新和月级器件保持性。

问题: FF 的局部正负更新能否脱离数字反向梯度,直接写入物理器件,并在长期保持性与编程能耗上可用?

机制: 以双通道监督 FF 或单通道 Competitive Forward 产生前向局部更新,用低于 1 V 的单次复位脉冲和差分器件改变忆阻状态;不构造反向梯度。

步骤:

  1. 将正/负或竞争更新映射到器件差分状态
  2. 用低压脉冲写入 HfOx/Ti 忆阻器
  3. 在器件阵列上验证分类与写入稳定性
  4. 分离报告多层软件仿真和单层硬件闭环

证据:

  • 预印本报告最多 8,064 个器件;熊图像头部分类中监督 FF 约 89.5%、Competitive Forward 约 89.6%、BP 约 90.0%。
  • 90 天后 3,456 个器件中约 90.7% 的漂移小于 3 μS;作者还报告相对写入/验证方案的编程能耗下降。

局限:

  • 依赖预训练 ResNet18,只使用 512 维特征中的前 32 维。
  • 多层实验的硬件写入与软件矩阵乘混合,完整硬件闭环仅单层;不能称为多层自治片上训练。
  • 能耗比较主要针对编程策略,不是包含数据搬运、矩阵乘、控制和校准的完整系统总能耗。

意义:

  • 这是把 FF 从算法规则推进到物理器件接口的直接证据。
  • 它把后续问题从“有没有反向路径”转成“多层矩阵乘、读写、保持、校准和外围是否都能闭环”。

边界: arXiv:2601.09903v2 预印本;本地硬件分支候选包核验了器件、任务和保持性边界,未确认正式期刊版本。

标识: 工作族 ID memristor-ff-2026

证据位置:

  • Figs.3–5
  • 器件保持实验
  • 编程能耗比较
  • Methods

资源: 一手入口

关联 ID: ff-2022 · bicovg-2026


12. 图神经网络的前向学习|Forward Learning of Graph Neural Networks(2024 · ICLR)

书目: 年份 2024;载体 ICLR;状态 同行评议;来源类型 paper

分类: 主路线 架构与任务外延;相关路线 架构与任务外延、相邻前向无反馈范式;层级 现代架构、任务与公平评测;阅读层级 桥接;证据等级 B;简称 ForwardGNN;相关性排序 12

核验: 来源层级 T1;核验状态 abstract-checked;V/D/P/Q V=V2 / D=D2 / P=P2 / Q=Q2

标签: 图神经网络、消息传递、桥接、ICLR 2024

定位: 把 forward-learning 的局部训练接口迁移到图神经网络,是 FF 之外但与其直接相邻的任务外延。

问题: 图消息传递和图结构目标能否脱离全图端到端反向梯度,在模块边界执行前向式局部训练?

机制: 为图网络模块设置局部或标签相关目标,图消息前向传播后在模块内更新,阻断全图反向链;它不明确等同于原始 FF 的 goodness 正负相位。

步骤:

  1. 执行图消息前向传播
  2. 构造图模块局部目标
  3. 在模块边界阻断全局梯度
  4. 组合图表示并进行节点/图任务评估

证据:

  • ICLR 2024 正式入口报告在多种图任务上比较前向学习与基线,说明局部前向思想可离开图像多层感知机。

局限:

  • 它是 forward-learning 桥接而非严格 FF goodness 变体,不能作为 FF 已迁移到图网络的直接证明。
  • 图任务、模型规模和局部标签设计仍有限,未覆盖通用图基础模型。

意义:

  • 它帮助区分“FF 名称谱系”和“更宽的 forward-only 局部学习谱系”。
  • 图结构是检验局部目标是否真正携带结构信息的自然后续场景。

边界: ICLR 2024 OpenReview 正式入口;被纳为桥接条目,未把标题中的 forward learning 改写为原始 FF 算法。

标识: 工作族 ID forwardgnn-2024

证据位置:

  • 正式摘要
  • 图模块训练方法
  • 图任务实验

资源: 一手入口

关联 ID: cff-vit-2025 · forward-projection-2026


13. 通过前向投影实现闭式无反馈学习|Closed-form feedback-free learning with forward projection(2026 · Nature Communications)

书目: 年份 2026;载体 Nature Communications;状态 同行评议;来源类型 paper

分类: 主路线 相邻前向无反馈范式;相关路线 相邻前向无反馈范式、公平评测与反证;层级 现代架构、任务与公平评测;阅读层级 桥接;证据等级 B;简称 Forward Projection;相关性排序 13

核验: 来源层级 T1;核验状态 full-text-checked;V/D/P/Q V=V3 / D=D2 / P=P2 / Q=Q2

标签: 闭式回归、随机投影、无反馈、桥接

定位: 用输入与标签的随机非线性投影生成层目标,再用闭式回归一次拟合权重,是解释 FF 边界的邻接方案。

问题: 如果逐层 goodness 协调困难,能否在没有反馈误差传播的条件下直接构造隐藏目标并一次遍历求解?

机制: 每层把突触前活动和标签通过随机投影组合成目标膜电位,累计 Gram 矩阵后用岭回归闭式求解权重;它改变了目标生成方式,而不是沿用原始 FF 正/负 goodness。

步骤:

  1. 联合投影输入与标签
  2. 生成隐藏层目标活动
  3. 累积 Gram 矩阵与局部统计
  4. 闭式求解每层权重并按层推理

证据:

  • Nature Communications 2026 正式论文在时序生物医学、少样本图像和标准数据上与局部监督/FF 等方法比较。
  • 独立审计记录指出其计算和内存要求与 BP 相近,不能仅凭“无反馈”宣称系统更省。

局限:

  • 闭式矩阵求逆、标签依赖和特定数据规模限制了通用性。
  • 它不是严格 FF 后继,现代大模型、开放词汇和长期在线学习尚未覆盖。

意义:

  • 它提供了除正/负 goodness 以外的反馈自由目标生成路线。
  • 作为邻接对照,它提醒研究者:减少反向通信不自动减少总计算、存储或标签依赖。

边界: Nature Communications 2026 正式论文;作为桥接条目纳入,依据正式方法、比较表和本地独立审计记录,不把它归入严格 FF 变体。

标识: DOI 10.1038/s41467-026-69161-1;工作族 ID forward-projection-2026

证据位置:

  • 方法
  • 局部目标与闭式解
  • 任务比较表
  • 资源分析

资源: 一手入口

关联 ID: ff-2022 · forwardgnn-2024 · noprop-2026 · dtg-ff-2026


14. NoProp:不使用反向传播或前向传播训练神经网络|NoProp: Training Neural Networks without Back-propagation or Forward-propagation(2026 · Conference on Lifelong Learning Agents)

书目: 年份 2026;载体 Conference on Lifelong Learning Agents;状态 同行评议;来源类型 paper

分类: 主路线 相邻前向无反馈范式;相关路线 相邻前向无反馈范式、架构与任务外延;层级 现代架构、任务与公平评测;阅读层级 桥接;证据等级 B;简称 NoProp;相关性排序 14

核验: 来源层级 T1;核验状态 abstract-checked;V/D/P/Q V=V3 / D=D2 / P=P2 / Q=Q2

标签: 块分解、去噪目标、局部 BP、桥接、CLLA 2026

定位: 把网络拆成独立目标去噪块,连通常的层级前向依赖也被重构,但块内仍使用反向传播。

问题: 能否不沿全网传播前向表征或反向误差,而让不同模块各自学习预设目标的去噪路径?

机制: 为各块指定不同噪声级别的目标表示,每块只接收本地输入并在内部学习去噪;推理时按去噪链组合模块。

步骤:

  1. 生成分级噪声目标
  2. 各块独立接收本地输入
  3. 块内用局部 BP 学习目标去噪
  4. 按去噪链执行推理

证据:

  • 正式 PMLR 论文在 MNIST、CIFAR-10 和 CIFAR-100 上验证独立块目标训练。
  • 其核心贡献是重构网络分解和跨块依赖,而非复现原始 FF 的 goodness 正负相位。

局限:

  • 块内仍用反向传播,不能算完全无 BP。
  • 固定目标表示可能削弱通常的层级特征学习;现代架构和大规模任务未知。

意义:

  • 它是解释 FF 层间协调难题的另一条邻接路线:用预设目标分解网络,而不是让所有层共同形成 goodness。
  • 它进一步证明“无跨块反向”与“无任何反向”必须分别报告。

边界: PMLR 2026 正式入口;作为邻接桥接条目纳入,依据正式摘要/方法记录,未把块内 BP 隐去。

标识: 工作族 ID noprop-2026

证据位置:

  • 正式摘要
  • 去噪块方法
  • MNIST/CIFAR 实验
  • 局限讨论

资源: 一手入口

关联 ID: trifecta-2024 · forward-projection-2026 · dtg-ff-2026


检索与证据审计

展开完整检索、纳排、去重、证据分级与覆盖限制

Forward–Forward Algorithm 的后续改进检索与证据审计

当前覆盖等级:L2。结构化数据、严格验证以及最终位置的桌面、手机、键盘和 file:// 真实浏览器回归均已通过。

范围与截止日期

  • 研究问题: 2022 年 FF 提出后,哪些工作真正修改或直接检验了 FF 的正/负相、goodness、负样本、层间协作、架构外延、物理实现或扩展性边界?
  • 受众: 机器学习、计算神经科学、神经形态计算和物理学习研究人员。
  • 时间: 2022-10-01 至 2026-08-13;原始 FF 是奠基条目。
  • 语言: 英文为主,中文只用于交付说明。
  • 来源优先级: T1 正式论文/DOI/会议期刊页、OpenReview/PMLR、arXiv 作者预印本;T2 作者/机构项目或代码;T3 搜索结果、博客和聚合页只用于发现,不能单独支撑结论。
  • 严格纳入: 直接修改或直接评测 FF;原始 FF 后续的 goodness、正负/自对比、层协作、深度、CNN/ViT/图任务、器件闭环和公平反证。
  • 桥接纳入: ForwardGNN、Forward Projection、NoProp,因它们直接解释或比较 FF 的局部前向边界,但页面中显式标为邻接范式。
  • 排除: 仅把 FF 当作基线、仍执行端到端 BP 的深监督、直接反馈对齐/零阶优化而非 FF goodness、词面重合和无法核验一手入口的工作。

检索分层与查询矩阵

检索采用“发现 → 核验 → 反证 → 补漏”。本项目的结构化账本在 planning/search_ledger.jsonl,共 21 条查询记录、约 158 次候选筛选、32 次纳入事件,最终去重为 14 个工作族;命中总量均写为 null,因为搜索服务没有稳定返回可复现命中数。

查询家族 精确查询示例 目的 结果
核心对象 \"Forward-Forward Algorithm\" Hinton 2022 paper 确认原始论文、名称和版本 原始 arXiv 预印本;本地 PDF 深读
历史与谱系 \"Forward-Forward\" references citations later variants 追踪后续变体和相邻概念 Trifecta、Layer Collaboration、SCFF、CFF-ViT 等
方法路线 \"The Trifecta\" deeper Forward-Forward\"HCL-FF\" hierarchical contrastive Forward-Forward 搜索深度、层级、对比和好度改进 Trifecta、HCL-FF、BiCovG、Advancing FF
评测与应用 \"Training convolutional neural networks with the Forward-Forward Algorithm\"Forward-only learning in memristor arrays with month-scale stability 发现同骨干反证、硬件和真实任务 Scientific Reports 2025、DTG-FF、忆阻器预印本
综述与谱系 Forward-Forward algorithm scaling benchmark arXiv OpenReview 发现术语、版本族和引用链 仅作为候选发现,不承担核心证据
风险与反证 failure limitation negative result benchmark fairness reproducibility Forward-Forward 主动寻找局限、负面、显存和吞吐证据 卷积 FF、DTG-FF、Advancing FF
前沿更新 Forward-Forward 2026 CVPR Neural Networks Nature Communications 截止日前复核正式/预印本状态 HCL-FF、BiCovG、DTG-FF、Forward Projection、NoProp

查询日志摘要

完整逐条记录见 planning/search_ledger.jsonl。其中 2026-08-12 的记录来自工作区已有独立审计:它保存了正式论文、DOI、OpenReview 和作者预印本入口,以及独立的反证与版本核验。2026-08-13 追加了当前任务的范围化查询和失败入口。

本轮网络限制如下:外部 web 搜索接口返回网络错误;命令行 DNS 请求失败;应用内浏览器访问 arXiv 与 AAAI 正式页被安全策略拒绝。因此 2026-08-13 的失败记录的 screenedincluded 均为 0,不能解释成“没有搜索结果”。本项目沿用工作区内上一轮对一手页面的审计结果,并在每条 source_note 里标出证据边界。

纳入、排除与去重

纳入标准是:工作必须贡献机制、直接扩展、直接反证或部署证据中的至少一种,并且有可核验的一手入口。筛选结果保存在 planning/screening.csv,包括 14 个纳入工作族、3 个排除/边界对照和版本/机制边界说明。

去重顺序为 DOI → arXiv/OpenReview/PMLR 等稳定 ID → 正式论文 URL → 规范化题名与作者。预印本与正式版若属于同一工作族,优先用正式版本的题名、年份和证据;预印本仍在 source_note 或版本字段中保留。BiCovG、DTG-FF、忆阻器 FF 当前均按预印本处理,不能误写为同行评议论文。

证据与阅读层级

  • A: 正式论文且直接回答 FF 的机制、比较或边界问题,例如 Layer Collaboration、CFF-ViT、SCFF、卷积 FF 和 HCL-FF。
  • B: 正式但属于邻接 forward-learning,或正式条目的可访问正文有限,例如 ForwardGNN、Forward Projection、NoProp、Advancing FF。
  • C: 预印本、原始初步调查或硬件前沿,必须显式保留出版和复现边界,例如 Hinton 2022、BiCovG、DTG-FF 和忆阻器 FF。

出版状态不等于证据质量。planning/claim_ledger.csv 给出每条核心主张的 V/D/P/Q:核验深度、支持直接性、出版/验证状态和研究质量。纯局部、局部目标内部 BP、截断反向、预训练读出和物理闭环均分开记账。

反证与负面结果

反证轮重点检查了 failurelimitationnegative resultbenchmarkfairnessmemorywall-clockenergyreproducibility。最重要的直接结果如下:

  1. Scientific Reports 2025 同一六层 CNN 的 BP 为 85.4±0.4%,纯 FF 为 60.9±0.6% 或 68.6±0.5%。
  2. DTG-FF 2026 在匹配骨干真实数据上报告 BP 在 CIFAR-10/100 高 2.40/5.93 个百分点;ImageNet-100 和 8GB GPU 系统测量没有支持局部更新自动带来更优总成本。
  3. HCL-FF 的相对既有 FF 提升不能写成超越 BP;BiCovG 的最佳差距缩小依赖允许块内 BP 的混合版本;Trifecta 的 OLU 也是有限范围反向边界。
  4. 忆阻器 FF 的多层实验仍有软件矩阵乘,完整硬件闭环只到单层;器件写入能耗不等于完整训练系统能耗。

覆盖饱和与 L2 闸门

闸门 状态 审计依据
范围与来源 通过 planning/research_contract.yaml 已冻结;严格条目与邻接桥接分开;14 个工作族均有 T1 入口。
分支代表性 通过(声明范围内) 覆盖奠基、正负/好度、深度协作、架构外延、反证、硬件和邻接范式;硬件分支稀疏但已保留直接条目与缺口。
边际收敛 通过(声明范围内) 工作区独立审计记录两个互补饱和轮未发现新的一级机制;本专项补漏新增的是版本、评测和硬件边界。
深读 通过 原始 FF、Trifecta、Layer Collaboration、CFF-ViT、SCFF、卷积 FF、HCL-FF、BiCovG、DTG-FF、忆阻器完成正文/附录级记录;Advancing FF 保守为摘要级,不把未核验组件写入结论。
证据审计 通过 claim_ledger.csv 覆盖数字、比较、因果/性能边界、出版状态和纯局部/混合边界;“未发现”措辞没有被升级为绝对不存在。

失败入口与后续更新

  • 当前外部搜索和应用内浏览器无法重新打开页面;完整失败记录已保留,未安装未经用户同意的依赖,也未把搜索结果页当作证据。
  • 预印本正式化、代码和数据更新仍可能改变出版状态与结果;下次更新优先复核 BiCovG、DTG-FF、忆阻器 FF 和 Advancing FF。
  • 需要新的研究时,应沿同一查询矩阵增加真实数据、ImageNet-1K/长序列/开放词汇和全栈资源测量,并保持工作族去重。

复现与使用边界

  • atlas.json 是人工维护的结构化研究真源;data/、网页与本 README 是确定性派生阅读层。
  • 页面可离线打开;论文、代码、数据集与官方图表等一手外部入口需要联网。
  • 机制步骤与网页机制图是依据一手文字证据形成的解释性整理,不替代原论文图表或独立复核。
  • 出版状态、阅读优先级、证据等级与展示层级是不同维度,不能互相替代。
  • 本综述有明确截止日期和纳入边界,不声称穷尽互联网中的全部长尾资料。

生成与验证工具:build-research-atlas

About

从正负好度到层协作、现代架构与物理部署的可审计谱系|14 项记录

Topics

Resources

Stars

0 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages