让CodeBuddy或Qorder自己吸取和创造性扩展自己,以强化学习博弈模式选择自己的子代版本,CodeBuddy或Qorder创建CodeBuddy_子1(或Qorder_子1)、CodeBuddy_子2(或Qorder_子2)……,选择最优版本2个,CodeBuddy_子1(或Qorder_子1)创建CodeBuddy_孙A1(或Qorder_孙A1)、CodeBuddy_孙A2(或Qorder_孙A2)……,CodeBuddy_子21(或Qorder_子2)创建CodeBuddy_孙B1(或Qorder_孙B1)、CodeBuddy_孙B2(或Qorder_孙B2)…。
前述CodeBuddy或Qorder只是举例,实际是需要通过智能体接口,与背后模型的协调创建与修改,实现背后模型自己修改自己的博弈迭代进化择优。

686

被折叠的 条评论
为什么被折叠?



