Stable Vicuna

2天前发布 6,602,431 0 1.8K

Stability AI发布的Vicuna,第一个开源RLHF聊天机器人

收录时间:
2026-02-02
Stable VicunaStable Vicuna
广告也精彩

StableVicuna,这是第一个通过人类反馈强化学习(RHLF)训练的大规模开源聊天机器人。StableVicuna是Vicuna v0 13b的进一步指令微调和RLHF训练版本,它是一个指令微调的LLaMA 13b模型。

同样,这里有一些基准,显示了与其他类似规模的开源聊天机器人相比,StableVicuna的整体性能。

为了实现StableVicuna的强大性能,我们利用Vicuna作为基础模型,并遵循Steinnon等人和Ouyang等人概述的典型的三阶段RLHF管道。使用三个数据集,通过监督微调(SFT)进一步训练基础Vicuna模型:

广告也精彩

数据统计

数据评估

Stable Vicuna浏览人数已经达到6,602,431,如你需要查询该站的相关权重信息,可以点击"5118数据""爱站数据""Chinaz数据"进入;以目前的网站数据参考,建议大家请以爱站数据为准,更多网站价值评估因素如:Stable Vicuna的访问速度、搜索引擎收录以及索引量、用户体验等;当然要评估一个站的价值,最主要还是需要根据您自身的需求以及需要,一些确切的数据则需要找Stable Vicuna的站长进行洽谈提供。如该站的IP、PV、跳出率等!

关于Stable Vicuna特别声明

本站聚灵AI导航提供的Stable Vicuna都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由聚灵AI导航实际控制,在2026年2月2日 上午5:36收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,聚灵AI导航不承担任何责任。

相关导航

广告也精彩

暂无评论

none
暂无评论...