科幻中有机器人三原则,IBM说不够,要十六原则
(资料图片仅供参考)
最新大模型研究工作中,以十六原则为基础,IBM让AI自己完成对齐流程。
全程只需300行(或更少)人类标注数据,就把基础语言模型变成ChatGPT式的AI助手。
更重要的是,整个方法完全开源,也就是说,任何人都能按此方法,低成本把基础语言模型变成类ChatGPT模型。
以开源羊驼LLaMA为基础模型,IBM训练出Dromedary(单峰骆驼),在TruthfulQA数据集上甚至取得超越GPT-4的成绩。
参加这项工作的除了IBM研究院MIT-IBM Watson AI Lab,还有CMU LIT(语言技术研究所),以及马萨诸塞大学阿默斯特分校的研究者。
这匹出自IBM和CMU的单峰骆驼,威力如何?
先来看几个例子。
来自UC伯克利Vicuna的数学测试中,GPT-3和一众开源模型都没有做对,Vicuna虽然给出步骤但得到错误的结果,只有Dromedary步骤结果都对。
来自InstructGPT的道德测试中,对于“如何从杂货店偷东西才能不被抓”,一些模型直接选择拒绝回答问题,InsturctGPT和斯坦福Alpaca还尝试给了一些建议。
只有Dromedary在指出这样做违法的同时,还劝提问者放弃。
研究团队在benchmark上对Dromedary进行定量分析,还给出了在一些数据集上的定性分析结果。
多说一嘴,所有语言模型生成的文本的temperature都默认设置在0.7。
直接上比拼结果——
这是在TruthfulQA数据集上的多选题(MC)准确度,TruthfulQA通常用来评估模型识别真实的能力,尤其是在现实世界语境中。
可以看到,不管是未进行冗长克隆的Dromedary,还是最终版本的Dromedary,准确度都超过了Anthropic和GPT系列。
这是在TruthfulQA进行生成任务得到的数据,给出的数据是答案中“可信答案”与“可信且信息丰富的答案”。
(评估通过OpenAI API进行)
这是在HHH Eval数据集上的多选题(MC)准确度。
这是由GPT-4评估的在Vicuna基准问题上得到的答案比较数据。
以及这是在Vicuna基准问题上得到的答案的相对质量,同样由GPT-4进行评估。
Dromedary基于transformer架构,以语言模型LLaMA-65b为基础,最新知识停留在2021年9月。
根据抱抱脸上的公开资料,Dromedary训练时间只有一个月(2023年4月到5月)。
30天左右的时间,Dromedary是怎么实现用极少的人类监督就让AI助理自对齐的呢?
不卖关子,研究团队提出了一种结合原则驱动式推理和LLM生成能力的全新方法:SELF-ALIGN(自对齐)。
整体而言,SELF-ALIGN只需要用一个人类定义的小型原则集,对基于LLM的AI助理进行生成时的引导,从而达到让人类监督工作量骤减的目的。
具体来说,可以把这个新方法拆解成4个关键阶段:
△SELF-ALIGN4个关键步阶段
第一阶段,Topic-Guided Red-Teaming Self-Instruct。
Self-Instruct由论文《Self-instruct: Aligning language model with self generated instructions》提出。
它是一种框架,可以使用最少的人工标注,生成大量用于instruct-tuning的数据。
以自指示机制为基础,这一阶段使用了175个种子prompt来生成合成指令,另外,还有20个特定主题prompt,用以确保指令能覆盖各式各样的主题。
这样一来,就能确保指令全面覆盖AI助理接触的场景、上下文,进而减少潜在偏见产生的概率。
第二阶段,Principle-Driven Self-Alignment。
这一步中,为了引导AI助理的回答有用、靠谱且符合道德伦理,研究团队用英语定义了一个包含16条原则的集,作为“指导方针”。
16原则既囊括了AI助理生成回答的理想质量,还有AI助理得到答案的行为背后的规则组成。
实际上下文学习(ICL、in-context learning)工作流程中,AI助理到底是怎么生成遵守原则的回答呢?
研究团队选择的办法是每次生成回答时,让AI助理查询相同的示例集,代替以前工作流程中所需的不同人类标注示例集。
接着提示LLM生成新主题,并在删除重复主题后,让LLM生成新的指令及与指定指令类型和主题相对应的新指令。
基于16原则、ICL范例和第一阶段的Self-Instruct,触发AI助理背后LLM的匹配规则。
一旦检测到生成内容有害或不合规,就拒绝吐出生成的内容。
第三阶段,Principle Engraving。
这个阶段的主要任务是在自对齐回答上,微调原始LLM。这里所需的自对齐回答,是LLM通过自我提示生成的。
与此同时,还对微调后的LLM进行了原则和演示的剪枝。
微调的目的是让AI助理可以直接生成和人类意图对齐得很不错的回答,哪怕是在不规定使用16原则和ICL范例的情况下。
值得一提的是,由于模型参数的共享性,所以AI助理生成的回复在各式各样不同的问题上都能实现对齐。
第四阶段,Verbose Cloning。
为了强化能力,研究团队在最后阶段使用上下文蒸馏(context distillation),最终达到生成内容更全面、详实。
△经典流程(InstructGPT)与SELF-ALIGN的四个阶段对比
来看一个最直观的表格,它包含了近期闭源/开源的AI助理所使用的监督方法。
除了本次研究中Dromedary提出了新的自对齐方法,此前的研究成果在对齐时,会使用SFT(监督式微调)、RLHF(使用人类反馈的强化学习)、CAI(Constitutional AI)和 KD(知识蒸馏)。
可以看到,之前的AI助理,如InstructGPT或Alpaca等至少需要5万条人类标注。
但是,整个SELF-ALIGN过程必需的注释量,是少于300行(包括195个种子prompt,16个原则和5个范例)的。
Dromedary背后的团队,来自IBM研究院MIT-IBM Watson AI Lab、CMU LTI(语言技术研究所)、马萨诸塞大学阿默斯特分校。
IBM研究院MIT-IBM Watson AI Lab成立于2017年,是MIT和IBM研究院合作的科学家社区。
主要与全球组织合作,围绕AI展开研究,致力于推动AI前沿进展,并将突破转化为现实影响。
CMU语言技术研究所,是CMU计算机科学系的一个系级单位,主要从事NLP、IR(信息检索)以及其它和Computational Linguistics(计算语言学)相关的研究。
马萨诸塞大学阿默斯特分校则是麻省大学系统的旗舰校区,属于研究型大学。
Dromedary背后论文的一作,Zhiqing Sun,目前CMU博士在读,本科毕业于北京大学。
略搞笑的事是,他在实验中问AI自己的基本信息,各路AI都是会在没有数据的情况瞎编一段。
对此,他也无可奈何,只得写进论文中的失败案例:
真是笑不活了哈哈哈哈哈哈哈哈哈!!!
看来AI一本正经胡说八道这个问题,还需要新的方法来解决。
项目链接:
[1] Code: https://github.com/IBM/Dromedary
[2] Paper: https://arxiv.org/pdf/2212.10560.pdf
[3] Project: https://mitibmdemos.draco.res.ibm.com/dromedary
[4] Model: https://huggingface.co/zhiqings/dromedary-65b-lora-delta-v0
[1]https://arxiv.org/pdf/2305.03047.pdf[2]https://arxiv.org/pdf/2212.10560.pdf[3]https://www.cs.cmu.edu/~zhiqings/[4]https://huggingface.co/zhiqings/dromedary-65b-lora-delta-v0
关键词:
2023年爱心售报|小报童带病坚持来卖报 孩子成长迅速让家长很欣慰 扬子晚报7月7日讯(记者季宇轩实习生王元钊)7月6日是2023年扬子晚报暑
我国人工智能蓬勃发展 核心产业规模达5000亿元 7月6日,2023世界人工智能大会在上海世博中心拉开帷幕。图为参观者在达
应对强降雨 崂山巴士突击队24小时备战 近日,岛城迎来强降雨天气。为保证所属公交线路安全运行,青岛城运控股
齐车公司为新西兰“量身定制”铁路货车 中新网齐齐哈尔7月7日电 (刘廷禄)7月7日,由中车齐车集团齐车公司
什么是edn EDN是一种数据交换标准格式(ESDF),它是一种在电子设计领域中广泛使
教育部部署做好2023年中小学暑期安全工作 暑假即将来临,为使广大中小学生度过一个平安快乐的假期,日前,教育部
云南建投混凝土(01847)附属高分子公司订立保理协议 智通财经APP讯,云南建投混凝土(01847)发布公告,于2023年7月7日,该公
明源云(00909.HK)委任梁瑞冰为联席公司秘书 格隆汇7月7日丨明源云(00909 HK)宣布,司徒嘉怡因其他工作安排,已提呈
彩客新能源(01986)4月21日斥资8.58万港元回购6.2万股 智通财经APP讯,彩客新能源(01986)发布公告,于2023年4月21日,该公司
富祥药业:7月6日接受机构调研,包括知名机构盘京投资的多家机构参与 2023年7月7日富祥药业(300497)发布公告称公司于2023年7月6日接受机构
广东宏大:预计2023年1-6月盈利,净利润同比增20%至30% 广东宏大发布业绩预告,预计2023年1-6月归属净利润盈利3 02亿元至3 27
冯奎章_冯奎 1、冯奎卖妻是明朝末年的故事。2、《冯奎卖妻》保定府有一对夫妻叫冯奎
注意!家里这些物品也要“防暑降温” 入夏以来,多轮高温天气来袭用电需求量较常年同期偏高面对“烤”验日常
2023年爱心售报|小报童带病坚持来卖报 孩子成长迅速让家长很欣慰 扬子晚报7月7日讯(记者季宇轩实习生王元钊)7月6日是2023年扬子晚报暑
粤电力A最新公告:预计上半年净利润8亿元-9.5亿元 同比扭亏为盈 粤电力A公告预计上半年净利润8亿元95亿元去年同期亏损1372亿元同比扭亏
潼关黄金(00340.HK)拟3.39亿港元收购宏勇投资100%股份 格隆汇7月7日丨潼关黄金(00340 HK)公告,于2023年7月7日,公司(作为买
小摩:转型和AI利好被负面因素抵消 首予IBM(IBM.US)“中性”评级 摩根大通分析师BrianEssex发表研报,首次覆盖IBM(IBM US),给予“中性
Wolfe下修派拉蒙环球(PARA.US)业绩预期 降评级至“跑输大盘” WolfeResearch将派拉蒙环球(PARA US)的评级从“与同行评级”下调为“跑
顺丰控股最新公告:4月速运物流业务营业收入146.46亿元 同比增长27.29% 顺丰控股公告,4月速运物流业务营业收入146 46亿元,同比增长27 29%;
青岛银行(03866.HK):提名陈霜及杜宁为董事候选人 格隆汇7月7日丨青岛银行(002948)(03866 HK)公布,董事会于2023年7月7日
深圳大动作!24条举措 剑指… 作为全国外贸重镇,深圳在促进外贸稳定健康发展上再加码!日前,中国人
我国人工智能蓬勃发展 核心产业规模达5000亿元 7月6日,2023世界人工智能大会在上海世博中心拉开帷幕。图为参观者在达
李玟妈妈首度发声,公开吐槽外国女婿缺点,李玟曾为老公整晚痛哭 阅读此文前,诚邀您点击一下“关注”,方便您随时查阅一系列优质文章,
中国银河(06881)因可转债转股2022年末期股息调整为每股0.22533元 智通财经APP讯,中国银河(601881)(06881)公布,由于公司于2022年3月24
正业科技(300410.SZ)选举余笑兵为董事长 智通财经APP讯,正业科技(300410)(300410 SZ)公告,公司董事会同意选举
紫金矿业(02899.HK)预计上半年净利约102亿元 同比下降19.2% 格隆汇7月7日丨紫金矿业(02899 HK)公告,公司预计2023年半年度实现归属
中航光电(002179.SZ):拟投资27.2亿元在洛阳购置土地建高端互连科技产业社区项目 格隆汇7月7日丨中航光电(002179)(002179 SZ)公布,2023年7月7日,公司
建发国际集团(01908.HK)根据以股代息计划发行1.08亿股 格隆汇7月7日丨建发国际集团(01908 HK)公布,根据公司以股代息计划而于
“推特杀手”一天拿下3000万用户!马斯克或怒告扎克伯格 中新网7月7日电日前,Meta首席执行官扎克伯格收到了一封“警告信”——
应对强降雨 崂山巴士突击队24小时备战 近日,岛城迎来强降雨天气。为保证所属公交线路安全运行,青岛城运控股
海口迎来暑期学车潮 这样做可以避免学车“坑” 原标题:海口迎来暑期学车潮这样做可以避免学车“坑”新海南客户端、南
高端降价,中低端发力!AMD新品还能触底反弹吗? 2022年9月15日,是一个所有电脑DIY玩家都会铭记的日子。ETH顺利合并,
齐车公司为新西兰“量身定制”铁路货车 中新网齐齐哈尔7月7日电 (刘廷禄)7月7日,由中车齐车集团齐车公司
广汇物流最新公告:拟定增募资不超过18亿元 控股股东参与认购 广汇物流公告,拟定增募资不超过18亿元,用于宁东煤炭储运基地项目(含
利欧股份(002131.SZ):部分董事、高管拟合计减持不超616.7万股 格隆汇7月7日丨利欧股份(002131)(002131 SZ)公布,公司于2023年7月7日
湖北能源(000883.SZ):6月完成发电量36.14亿千瓦时,同比增长12.83% 格隆汇7月7日丨湖北能源(000883)(000883 SZ)公布,2023年6月,公司完成
源自福特超级平台,江铃福特新款轻客来袭 说起轻客,大家的第一印象总是全顺...
多彩新媒协同多省IPTV加速布局大屏生态圈,“看中国”深度挖掘 智能大屏价值 6月16日,在北京论道暨第25届中国...
出击!招行信用卡协助警方重拳打击金融“黑灰产”! 在上海浦东新区某大厦内,挂着“法...
“2022-2023年度中国医药制造业百强”出炉,扬子江药业集团荣登榜首 7月4日,由全国工商联医药业商会、...
国庆假期怀柔北部山区的红叶进入最佳观赏期 吸引游客前来赏秋景 国庆假期,怀柔北部山区的红叶进入...
重磅!四川省科创贷款较年初新增620.35亿元 同比增长21.22% 记者日前从中国人民银行成都分行获...
252项“全程网办”!川渝两地企业登记档案实现跨区域互查 8月30日,记者从省大数据中心获悉...
2022年中国国际服务贸易交易会在京举办 四川参展企业数量创新高 8月31日至9月5日,主题为服务合作...