Redian新闻
>
微软必应再进化!接入DALL·E模型,文字生成图像功能来了!

微软必应再进化!接入DALL·E模型,文字生成图像功能来了!

公众号新闻

点击下方卡片,关注“CVer”公众号

AI/CV重磅干货,第一时间送达

点击进入—>【计算机视觉】微信技术交流群

转载自:机器之心

微软必应完善文字生成图像能力,Adobe 今日也发布 Firefly,杀入生成式 AI 这场游戏。


今晚实在是有些热闹。


一边英伟达 GTC 正在进行中,一边谷歌正式开放了 Bard 的测试,这里微软必应也不甘寂寞。



今日,微软正式宣布,必应搜索引擎接入了 OpenAI 的 DALL·E 模型,增加了 AI 生成图像的功能。


也就是说,在接入 ChatGPT 之后,必应再次强化,Bing Image Creator 能够让用户用 DALL·E 模型生成图像。


「对于拥有必应预览版权限的用户,Bing Image Creator 将完全集成到必应聊天体验中,首先在创意模式下推出。」微软消费者营销主管 Yusuf Mehdi 解释道。「通过输入图像描述,提供位置或活动等额外语境,选择艺术风格,Image Creator 将根据用户的想象生成图像。」



必应具有三种响应模式:创意模式、平衡(balanced)模式和精确(precise)模式。创意模式下必应生成的结果通常是「原创和富有想象力的」,而精确模式则倾向于准确性和相关性,以获得更真实和简洁的答案。目前 Image Creator 只能在创意模式下使用。


值得一提的是,即使没有必应预览版的使用权限,用户也可以通过直接访问 bing.com/create 单独使用 Image Creator 来尝试其图像生成功能,目前仅支持英文输入。微软表示,随着时间的推移,它将支持更多的语言输入。


此外,微软今天还在必应中推出了新的 AI 支持的视觉故事(visual Stories)和 Knowledge Cards 2.0。



我们简单为大家梳理介绍下 OpenAI 文本生成图像的 DALL·E 系列研究。


2021 年 1 月 6 日,OpenAI 博客发布了两个连接文本与图像的神经网络:DALL・E 和 CLIP。DALL・E 可以基于文本直接生成图像,CLIP 则能够完成图像与文本类别的匹配。这两项研究的发布,引起了社区极大的关注。


据博客介绍,DALL・E 可以将以自然语言形式表达的大量概念转换为恰当的图像,可以说是 GPT-3 的 120 亿参数版本,可基于文本描述生成图像。


DALL・E 示例。给出一句话「牛油果形状的椅子」,就可以获得绿油油、形态各异的牛油果椅子图像。


2 个月后,DALL·E 的论文和代码公开。



  • 项目地址:https://github.com/openai/DALL-E

  • 论文地址:https://arxiv.org/abs/2102.12092


2022 年 4 月 7 日左右,DALL・E 迎来了升级版本 ——DALL・E 2。与 DALL・E 相比,DALL・E 2 在生成用户描述的图像时具有更高的分辨率和更低的延迟。并且,新版本还增添了一些新的功能,比如对原始图像进行编辑。


OpenAI 还公布了 DALL・E 2 的研究论文《Hierarchical Text-Conditional Image Generation with CLIP Latents》。



论文地址:https://cdn.openai.com/papers/dall-e-2.pdf


此次必应接入的 DALL・E 应该是经过更新迭代的。这在一定程度上,弥补了当前 ChatGPT 在跨模态生成方面缺失的体验。不过等到 GPT-4 多模态能力开放后,也许能为我们带来更多新的体验。


最后提一句,今日还有一项生成式 AI 的发布引起了业内人士的关注与讨论。

那就是 Adobe 发布 Firefly。这是一系列用于创意表达的生成式 AI 模型,让用户可以通过键入命令快速修改图像。目前,Firefly 开放了测试版本,感兴趣的读者可以申请体验。


如今看来,生成式 AI 这场游戏有越来越多的玩家涌入,竞争也变得越来越激烈。


参考链接:

https://blogs.microsoft.com/?p=52560769

https://www.theverge.com/2023/3/21/23649943/microsoft-bing-openai-dall-e-image-creator-ai


点击进入—>【计算机视觉】微信技术交流群


最新CVPP 2023论文和代码下载


后台回复:CVPR2023,即可下载CVPR 2023论文和代码开源的论文合集

后台回复:Transformer综述,即可下载最新的3篇Transformer综述PDF


目标检测和Transformer交流群成立


扫描下方二维码,或者添加微信:CVer333,即可添加CVer小助手微信,便可申请加入CVer-目标检测或者Transformer 微信交流群。另外其他垂直方向已涵盖:目标检测、图像分割、目标跟踪、人脸检测&识别、OCR、姿态估计、超分辨率、SLAM、医疗影像、Re-ID、GAN、NAS、深度估计、自动驾驶、强化学习、车道线检测、模型剪枝&压缩、去噪、去雾、去雨、风格迁移、遥感图像、行为识别、视频理解、图像融合、图像检索、论文投稿&交流、PyTorch、TensorFlow和Transformer等。


一定要备注:研究方向+地点+学校/公司+昵称(如目标检测或者Transformer+上海+上交+卡卡),根据格式备注,可更快被通过且邀请进群


▲扫码或加微信号: CVer333,进交流群


CVer计算机视觉(知识星球)来了!想要了解最新最快最好的CV/DL/AI论文速递、优质实战项目、AI行业前沿、从入门到精通学习教程等资料,欢迎扫描下方二维码,加入CVer计算机视觉,已汇集数千人!


扫码进星球

▲点击上方卡片,关注CVer公众号

整理不易,请点赞和在看

微信扫码关注该文公众号作者

戳这里提交新闻线索和高质量文章给我们。
相关阅读
下载量暴增10倍!微软必应集成ChatGPT后需求大爆发;4省份上调最低工资标准;淘宝已屏蔽ChatGPT关键词丨邦早报OpenAI新老员工对决!「叛徒」团队发布Claude模型:ChatGPT的RLHF过时啦!How did Mao Zedong solve the opium addiction problem?Spring + OpenAI 生成图像一年结束了,明年会更好。。谷歌大模型团队并入DeepMind!誓要赶上ChatGPT进度【南北碰碰胡】#17 北方 北京早餐《豆浆油条》+ 北京糖葫芦辞旧迎新,卯年吉祥开挖扩散模型小动作,生成图像几乎原版复制训练数据,隐私要暴露了GitHub裁员10%,办公室全关,全体远程办公;微软必应集成ChatGPT下载量猛增10倍;谷歌出师不利市值蒸发超万亿|Q资讯岚图汽车否认裁员传闻; 微软必应搜索引擎日活用户突破1亿|首席资讯日报终结扩散模型:OpenAI开源新模型代码,一步成图,1秒18张GPT-4震撼发布:多模态大模型,升级ChatGPT和必应,开放API,太太太强了![电脑] 13700K/ROG Z790-E/XFX 7900XT,追风者!再进化!G500A装机展示别让GPT-4再进化!马斯克带头呼吁AI实验室立即暂停研究中文多模态模型问世!IDPChat生成图像文字,只需5步+单GPU宝马降10万!超30个汽车品牌花式打价格战;SHEIN表示暂无上市计划;微软必应搜索引擎日活用户首次突破1亿丨邦早报阿里CEO下令所有产品接入大模型!钉钉对标微软Office,已解锁近10项新功能OpenAI文本生成3D模型再升级,数秒完成建模,比Point·E更好用「Tiamat」完成近千万美元A轮融资,专注将AI生成图像的可控性做到极致|早起看早期GPT-4震撼发布:多模态大模型,直接升级ChatGPT、必应,开放API,游戏终结了?人体器官移植的真实故事微软杀疯了!接入ChatGPT后首次交卷,一季度营收528亿美元猩猩为什么停止进化,估计它知道,再进化就得早起上班了GPT-4被曝进入微软必应搜索,几周内完成微软必应能画图了/ Adobe新AI一句话就能P视频/ 比尔·盖茨最新发文:人工智能时代已经开始…今日更多新鲜事在此CVPR'23 最佳论文候选 | 采样提速256倍!蒸馏扩散模型生成图像质量媲美教师模型图像生成终结扩散模型,OpenAI「一致性模型」加冕!GAN的速度一步生图,高达18FPS微软必应升级:注册就能用,聊天画图两不误,WolframAlpha任你调用UMEPLAY:实体影院的再进化?实景游戏续写沉浸式电影空间朋友圈想发长照片?iPhone一键拼图功能来了!库克现身米哈游总部/ 周鸿祎演示360GPT/ 微软必应有广告了…今日更多新鲜事在此别让GPT-4再进化!马斯克带头签署千人联名信,紧急呼吁AI实验室立即暂停研究ChatGPT版必应:我会PUA、emo和威胁人类,但我是个好必应刚刚宣布!微信新功能来了,可以同步注册小号了!你绝对想不到...
logo
联系我们隐私协议©2024 redian.news
Redian新闻
Redian.news刊载任何文章,不代表同意其说法或描述,仅为提供更多信息,也不构成任何建议。文章信息的合法性及真实性由其作者负责,与Redian.news及其运营公司无关。欢迎投稿,如发现稿件侵权,或作者不愿在本网发表文章,请版权拥有者通知本网处理。