Redian新闻
>
​GPT充当大脑,指挥多个模型协作完成各类任务,通用系统AutoML-GPT来了

​GPT充当大脑,指挥多个模型协作完成各类任务,通用系统AutoML-GPT来了

公众号新闻


MLNLP社区是国内外知名的机器学习与自然语言处理社区,受众覆盖国内外NLP硕博生、高校老师以及企业研究人员。
社区的愿景是促进国内外自然语言处理,机器学习学术界、产业界和广大爱好者之间的交流和进步,特别是初学者同学们的进步。
转载自 | 机器之心
编辑 | 马梓文、小舟

使用 ChatGPT 实现通用人工智能,思路打开了。

当前,AI 模型虽然已经涉及非常广泛的应用领域,但大部分 AI 模型是为特定任务而设计的,它们往往需要大量的人力来完成正确的模型架构、优化算法和超参数。ChatGPT、GPT-4 爆火之后,人们看到了大型语言模型(LLM)在文本理解、生成、互动、推理等方面的巨大潜力。一些研究者尝试利用 LLM 探索通往通用人工智能(AGI)的新道路。

近期,来自德克萨斯州大学奥斯汀分校的研究者提出一种新思路 —— 开发任务导向型 prompt,利用 LLM 实现训练 pipeline 的自动化,并基于此思路推出新型系统 AutoML-GPT。

论文地址:

https://papers.labml.ai/paper/35151be0eb2011edb95839eec3084ddd

AutoML-GPT 使用 GPT 作为各种 AI 模型之间的桥梁,并用优化过的超参数来动态训练模型。AutoML-GPT 动态地接收来自 Model Card [Mitchell et al., 2019] 和 Data Card [Gebru et al., 2021] 的用户请求,并组成相应的 prompt 段落。最后,AutoML-GPT 借助该 prompt 段落自动进行多项实验,包括处理数据、构建模型架构、调整超参数和预测训练日志。

AutoML-GPT 通过最大限度地利用其强大的 NLP 能力和现有的人工智能模型,解决了各种测试和数据集中复杂的 AI 任务。大量实验和消融研究表明,AutoML-GPT 对许多人工智能任务(包括 CV 任务、NLP 任务)是通用的、有效的。

AutoML-GPT 简介

AutoML-GPT 是一个依赖数据和模型信息来格式化 prompt 输入段落的协作系统。其中,LLM 作为控制器,多个专家模型作为协作的执行者。AutoML-GPT 的工作流程包括四个阶段:数据处理、模型架构设计、超参数调整和训练日志生成。

具体来说,AutoML-GPT 的工作机制如下:

  • 通过 Model Card 和 Data Card 生成固定格式的 prompt 段落

  • 构建训练 pipeline,在选定的数据集和模型架构上处理用户需求

  • 生成性能训练日志并调整超参数

  • 根据自动建议的(auto-suggested)超参数调整模型

输入分解

AutoML-GPT 的第一阶段是让 LLM 接受用户输入。为了提高 LLM 的性能并生成有效的 prompt,该研究对输入 prompt 采用特定的指令。这些指令包括三个部分:Data Card、Model Card、评估指标和附加要求。

如下图 2 所示,Data Card 的关键部分由数据集名称、输入数据集类型(如图像数据或文本数据)、标签空间(如类别或分辨率)和默认评估指标组成。

如下图 3 所示,Model Card 由模型名称、模型结构、模型描述和架构超参数组成。通过提供这些信息,Model Card 能告知 LLM 整个机器学习系统使用了哪些模型,以及用户对模型架构的偏好。

除了 Data Card 和 Model Card,用户还可以选择请求更多的评估基准、评估指标或任何约束。AutoML-GPT 将这些任务规范作为高级指令提供给 LLM,用于相应地分析用户需求。

当有一系列需要处理的任务时,AutoML-GPT 需要为每个任务匹配相应的模型。为了达到这一目标,首先系统需要获得 Model Card 和用户输入中的模型描述。

然后,AutoML-GPT 使用 in-context 任务 - 模型分配机制,动态地为任务分配模型。这种方法通过将模型描述和对用户需求的更好理解结合起来,实现了增量模型(incremental model)访问,并提供了更大的开放性和灵活性。

用预测训练日志调整超参数

AutoML-GPT 根据 Data Card 和 Model Card 设置超参数,并通过生成超参数的训练日志来预测性能。该系统自动进行训练并返回训练日志。在数据集上的模型性能训练日志记录了训练过程中收集的各种指标和信息,这有助于了解模型训练进展,找出潜在问题,以及评估所选架构、超参数和优化方法的有效性。

实验

为了评估 AutoML-GPT 的性能,该研究使用 ChatGPT(OpenAI 的 GPT-4 版本)来实现它,并进行多项实验从多个角度展示了 AutoML-GPT 的效果。

下图 4 展示了使用 AutoML-GPT 在未知数据集上训练的结果:

下图 5 展示了 AutoML-GPT 在 COCO 数据集上完成目标检测任务的过程:

下图 6 展示了 AutoML-GPT 在 NQ 开放数据集(Natural Questions Open dataset,[Kwiatkowski et al., 2019])上的实验结果:

该研究还使用 XGBoost 在 UCI Adult 数据集 [Dua and Graff, 2017] 上评估了 AutoML-GPT,以探究其在分类任务上的性能,实验结果如下图 7 所示:

感兴趣的读者可以阅读论文原文,了解更多研究细节。


技术交流群邀请函

△长按添加小助手

扫描二维码添加小助手微信

请备注:姓名-学校/公司-研究方向
(如:小张-哈工大-对话系统)
即可申请加入自然语言处理/Pytorch等技术交流群

关于我们

MLNLP 社区是由国内外机器学习与自然语言处理学者联合构建的民间学术社区,目前已经发展为国内外知名的机器学习与自然语言处理社区,旨在促进机器学习,自然语言处理学术界、产业界和广大爱好者之间的进步。
社区可以为相关从业者的深造、就业及研究等方面提供开放交流平台。欢迎大家关注和加入我们。

微信扫码关注该文公众号作者

戳这里提交新闻线索和高质量文章给我们。
相关阅读
如果集合100个模型工程师的大脑,然后变成一个工厂新征程上共谱沪滇协作新篇章!陈吉宁龚正今天与王宁王予波举行沪滇对口协作联席会议紫东太初全模态大模型来了,一个模型打通感知、认知、决策交互屏障OpenAI现场演示官方版AutoGPT!创作画画发推一条龙,自主调用外部应用完成任务英国少女只剩一年寿命,却梦想开坦克,当铁匠,指挥军舰…最终全实现了!调用多个ChatGPT API相互对话,清华开源的多轮对话数据UltraChat来了MathGPT来了!专攻数学大模型,解题讲题两手抓金融圈注意了!BloombergGPT来了用ChatGPT「指挥」数百个模型,HuggingGPT让专业模型干专业事马斯克着手开发TruthGPT来最大限度寻找真相,以对抗ChatGPT|环球科学要闻The Same Love全新中文大模型多任务基准CMMLU:评估中文多任务语言理解能力讯飞星火大模型抢先进入​「升级战」:中国版ChatGPT来了去小儿的法学院GPT-4充当评测老师,效果惊艳,港中文(深圳)开源凤凰、Chimera等大模型AutoGPT太火了,无需人类插手自主完成任务,GitHub2.7万星大盘点!Costco母亲节周末折扣盘点来了,鞋子衣服,饼干零食,千余种类任你挑选GitHub 2.7万星!AutoGPT太火了,无需人类插手自主完成任务突破封锁,“活下来了”!华为官宣:这一应用系统实现自主可控→ChatGPT已过时?Auto-GPT迅速走红,无需人类插手自主解决复杂任务,GitHub标星5万晚清老照片,名妓果然是名妓,就算是放在今天那也是妥妥的美女开源中文医疗大模型华佗GPT来了,真人医生盲测效果优于ChatGPT多个ChatGPT合作完成指定任务,迷你AGI控制世界要来了?Conagen和Natáur达成合作,生产可持续天然牛磺酸剑桥、腾讯AI Lab等提出大语言模型PandaGPT:一个模型统一六种模态通用视觉GPT时刻来临?智源推出通用分割模型SegGPTChatGPT充当大脑,指挥AudioGPT解决语音、音乐、音效等任务ChatGPT暂停集成Bing搜索;英伟达收购AI创企OmniML;天猫精灵启动大模型终端操作系统内测丨AIGC大事日报280万条多模态指令-响应对,八种语言通用,首个涵盖视频内容的指令数据集MIMIC-IT来了童声合唱团里的罪恶!巡演中,指挥走进孩子淋浴间·····碾压ChatGPT、自主完成任务、Star数超8万的Auto-GPT,是炒作还是未来?高手!四川男子第一次和女生约会就去爬山,当天就确定了情侣关系开源方案“走不通”!运维一百多应用系统,广州银行信用卡中心如何构建自动化实践AutoGPT,你给个任务,它就能自己做!看!清朝三大名妓的美艳老照片。。。。。。。。。。
logo
联系我们隐私协议©2024 redian.news
Redian新闻
Redian.news刊载任何文章,不代表同意其说法或描述,仅为提供更多信息,也不构成任何建议。文章信息的合法性及真实性由其作者负责,与Redian.news及其运营公司无关。欢迎投稿,如发现稿件侵权,或作者不愿在本网发表文章,请版权拥有者通知本网处理。