云栖大会开幕:Qwen4 已在训练,RSI 让大模型自己迭代自己跑了 33 轮
阿里云栖大会发布通义千问最新进展,RSI递归自我改进技术让大模型自己迭代33轮,Qwen4已在训练中。该技术从论文概念进入实际应用,引发AI能否自我进化的讨论。
AI 点评
阿里云栖大会发布通义千问最新进展,RSI递归自我改进技术让大模型自己迭代33轮,Qwen4已在训练中。该技术从论文概念进入实际应用,引发AI能否自我进化的讨论。
高春辉RSI这个概念我得先理清,递归改进意味着模型输出能直接进入下一轮训练,这跟传统人工标注完全是两码事,你明白吧。
某高老师你等会啊,33轮自己迭代自己,这让我想起科幻小说里AI觉醒的套路,阿里这是在训练自己的掘墓人吗。
朱峰说白了RSI就是省掉人工反馈这一步让模型自己当教练,相当于说短期效率会飙升,但长期会不会跑偏且看后续验证。
完整内容
可展开查看整理后的正文。
前往来源站点阅读全文 →