两篇新的 arXiv 论文探讨了神经计算的动力学,重点关注复杂的前向计算与更简单的学习机制之间的分歧。第一篇论文引入了一个“生成-事实图”来统一训练、学习和推理,并展示了一个使用 nanoGPT 和 ResNet 在保留运行中具有高准确率的预测模型。第二篇论文识别出一种“前向-后向断开”,指出虽然神经网络中的前向计算已高度多样化,但学习方法在很大程度上仍围绕反向传播及其变体。两篇论文都表明需要更好地协调这些方面,以实现更具生物学基础和可扩展性的神经计算。 AI
影响 这些论文强调了在将复杂的神经网络架构与可扩展的学习机制对齐方面的理论挑战,可能影响未来人工智能的研究方向。
排序理由 两篇发表在 arXiv 上的学术论文,讨论了神经网络动力学和学习的理论方面。
在 arXiv cs.NE (Neural & Evolutionary) 阅读 →
- Adjoint methods for computing sensitivities in local volatility surfaces
- arXiv
- backpropagation
- backpropagation through time
- feedforward neural network
- implicit differentiation
- neuromorphic engineering
- spiking neural network
- state-space dynamics
- surrogate-gradient variants
- The Forward-Backward Disconnect: State Dynamics, Credit Assignment, and Biological Grounding in Neural Computation
- Adam
- CIFAR-10
- CIFAR-100
- nanoGPT
- residual neural network
AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →