头雁|2026年09月17日 05:54
其实早在2017年就有实现RSI的思想了
这篇论文是 Google Brain 的经典工作 Neural Architecture Search with Reinforcement Learning 用一个 RNN 当 controller,逐步生成子网络的架构描述(层类型、卷积核大小、通道数、是否加 skip connection 等)。
把生成出来的 child network 真正训练一遍,用验证集准确率当 reward。用 REINFORCE 更新 controller,让它越来越会提出更好的架构。
这不就是用强化学习去训练一个神经网络,然后在测试集上进行验证准确率,然后再继续迭代训练么。
https://arxiv.org/pdf/1611.01578
分享至:
脈絡
熱門快訊
APP下載
X
Telegram
複製鏈接