模型 自己修改自己 的 博弈迭代 进化择优

让CodeBuddy或Qorder自己吸取和创造性扩展自己,以强化学习博弈模式选择自己的子代版本,CodeBuddy或Qorder创建CodeBuddy_子1(或Qorder_子1)、CodeBuddy_子2(或Qorder_子2)……,选择最优版本2个,CodeBuddy_子1(或Qorder_子1)创建CodeBuddy_孙A1(或Qorder_孙A1)、CodeBuddy_孙A2(或Qorder_孙A2)……,CodeBuddy_子21(或Qorder_子2)创建CodeBuddy_孙B1(或Qorder_孙B1)、CodeBuddy_孙B2(或Qorder_孙B2)…。

前述CodeBuddy或Qorder只是举例,实际是需要通过智能体接口,与背后模型的协调创建与修改,实现背后模型自己修改自己的博弈迭代进化择优。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值