Redian新闻
>
桌面版ChatGPT登台演讲,能视频通话还会实时读屏,GPT-4o最新demo再次惊艳:“能力还是被低估了”

桌面版ChatGPT登台演讲,能视频通话还会实时读屏,GPT-4o最新demo再次惊艳:“能力还是被低估了”

公众号新闻
克雷西 发自 凹非寺
量子位 | 公众号 QbitAI

GPT-4o桌面端最新Demo,与Sora的新作品一同亮相“欧洲AI春晚”VivaTech。

现场,OpenAI工作人员不仅展示了观众期待已久的“视频通话”,还试着让ChatGPT发表了演讲。

在视频聊天当中,即使给它的只有一幅抽象的简笔画,它也能立马get到这是巴黎地标。

然后再给它看一眼地铁图,指一指当前位置,就能火速设计出乘车路线。

而且,除了能像移动端一样通过摄像头感知环境之外,桌面端的ChatGPT还能够对屏幕内容进行读取,结合代码现场debug。

一系列震撼的演示效果,让前线的Tom’s Guide编辑Ryan Morrison感叹,GPT的语音功能和GPT-4o的潜力,看来是被低估了。

桌面端“视频通话”震撼全场

在现场给400多名观众演示ChatGPT最新功能的,是OpenAI开发者体验主管Romain Huet。

本来Huet打算用手机来演示,结果受到现场技术条件限制无法展示,于是改用Mac,但也正是如此观众们才有机会看到它的屏幕读取能力。

一开始,Huet问ChatGPT能不能给现场的观众讲一点什么,然后ChatGPT真就像模像样地打起了招呼。

不过Huet觉得这样的开场白还不够有气势,于是提示它面前是一大群人,它马上就心领神会,改用了更“燃”的措辞和语气。

当然,Huet没有让ChatGPT一直讲下去,而是在做完开场白之后改由自己来介绍其最新功能。

所有对话,即使跨越语言也能快速响应,现场Huet就要求ChatGPT把自己说的英文翻译成法语,整个过程行云流水。

另外,看上去是bug,但也许是feature的一点是,翻译出的法语还带着一些美国口音,不过Huet表示之后会进行优化,让ChatGPT说外(非英)语时更像当地人。

又是一通补充讲解之后,人们期待的“视频通话”功能终于正式登场了。

只见Huet现场用笔画出了埃菲尔铁塔和凯旋门的草图,结果ChatGPT只看了一眼就直接识破。

Huet自己也打趣地对它说,”非常感谢你,我画的这么烂你都能看懂。”

这还没完,Huet紧接着又掏出了一张巴黎地铁图,用手指了指当前的大概位置。

然后,ChatGPT立刻就给出了前往埃菲尔铁塔的乘车路线,随着Huet的一句Thank You,现场爆发了潮水般的掌声。

当然,最新的ChatGPT不仅能拿来读取摄像头画面,也能实时读取屏幕和剪贴板当中的内容。

作为OpenAI负责开发者体验的主管,Huet和ChatGPT一起现场搞起了代码。

Huet通过复制到剪贴板的方式,让客户端读取了一段React框架编写的网页代码,结果ChatGPT立马就把代码的语言、功能介绍得头头是道。

甚至还当众进行了Debug,通过让ChatGPT读取屏幕,Huet告诉它目前这个网页存在不能根据屏幕宽度进行适配的问题。

通过几轮对话,Huet成功借助ChatGPT的帮助,完美解决了这个问题,再次收获了观众的掌声。

One More Thing

在现场,Huet还播放了一段用Sora为大会创作的新视频,由于现场生成时间较长,观众看到的视频预先制作好的,这也是活动中唯一一个提前做好的效果。

一同展示的还有声音克隆引擎Voice Engine,Huet录制了一段20秒的声音样本,并用VE进行了完美复刻,而且只需一个按钮,就能从英语切换到法语、日语等其他语言,并在Sora中应用。

不过由于安全问题仍未解决,Sora和Voice Engine依旧不能公开发布,想体验的朋友要再等一等了。

另外,说到克隆声音的问题,寡姐和OpenAI关于Sky的争议刚好也有了新消息。

华盛顿邮报称,根据其所获得的文件和录音显示,给Sky配音的女演员的确另有其人。

而且,寡姐所称的受到奥特曼邀请发生在去年9月,而配音演员的招募在5月就已开始。

不过,仍然有网友认为,就算真的是另找了一名演员,也不能说明OpenAI就没有模仿寡姐的意图。

但无论OpenAI的意图如何,真正给Sky配音的演员却是无辜的,也有表演的权利。

不少网友发声对她表示同情:

Sky的配音演员同样有权利使用她自己的声音,难道因为(寡姐)是名人,所拥有的知识产权就比普通人更多吗?

进一步地,我认为虽然“OpenAI侵犯了寡姐的‘公开权’”这个观点比单纯的侵犯知识产权的想法好些,但仍然站不住脚。

总之,寡姐抛向OpenAI的子弹仍未落地,我们不妨一边吃瓜,一边等待着GPT-4o视频对话的正式更新。

参考链接:
[1]
https://vimeo.com/949419199
[2]https://www.tomsguide.com/ai/chatgpt/i-finally-saw-a-live-demo-of-chatgpt-4o-voice-if-anything-it-is-underhyped
[3]https://www.washingtonpost.com/technology/2024/05/22/openai-scarlett-johansson-chatgpt-ai-voice/

量子位年度AI主题策划正在征集中!

欢迎投稿专题 一千零一个AI应365行AI落地方案

或与我们分享你在寻找的AI产品,或发现的AI新动向


点这里👇关注我,记得标星哦~

一键三连「分享」、「点赞」和「在看」

科技前沿进展日日相见 ~ 


微信扫码关注该文公众号作者

戳这里提交新闻线索和高质量文章给我们。
相关阅读
用了几天新版微信输入法,我觉得微信里的 AI 体验被低估了OpenAI一夜之间革了Siri和同传的命,GPT-4o五大核心能力炸场!美股基本面 - 2024_03_25 * 午报 * 美联储理事Cook强调在降息方面必须谨慎行事。Match与激进投资者Ell惊掉下巴:GPT-4o现场爆改代码看图导航!OpenAI曝光LLM路线图,GPT Next年底发奥特曼深夜发动价格战,GPT-4o mini暴跌99%!清华同济校友立功,GPT-3.5退役xAI 和 Oracle 间 100 亿美元的生意谈崩了!有钱也租不到芯片的马斯克要自建超级计算中心,就不信“钞”能力还会失效?录取率最低的美国大学出炉!MIT没进前5,第一名真的被低估了!最高25.6℃!人少景美的避暑天堂,但作为亲子旅行地,它还是被严重低估了波士顿动力断臂转型!弃液压转电驱,新机器人再次惊艳世界OpenAI颠覆世界:GPT-4o完全免费,实时语音视频交互震撼全场,直接进入科幻时代GPT-4o恩怨开局,Google再次躺枪GPT-4o再秀神操作,“复现”OpenAI总裁讲课,网友当真了林更新向你发起视频通话邀请OpenAI CEO最新演讲:GPT-5性能远超GPT-4;媲美Sora,视频生成模型EMO上线通义APP丨AIGC日报中美防长视频通话!GPTCopilot功能大礼包!微软让个人AI助手进入团队,GPT-4o现已助力Azure,浏览器视频实时翻译穿越百年再次惊艳巴黎 现代东方茶亮相联合国诠释东方魅力推广||这个百元级国货牌子被低估了!推荐你们趁618试试~ChatGPT登录iPhone!Siri引入“最强大脑”,能看图能识字,iOS 18必升!ChatGPT实体化了!手机变身ChatGPT实体机器人,只需一个配件,能说话还会做梦,真的牛!OpenAI 突然发布 GPT-4o mini !更快更便宜,人人免费可用,GPT-3.5 成为历史中国鸡苗大王,被低估了国内“避暑”天花板:游客不足大理的1%,安逸不输成都!均温18℃,不用空调!!严重被低估了......GPT-4o发布!AI实时视频通话丝滑如人类,Plus功能免费使用ChatGPT 之父最新专访:发现 GPT-4o 惊喜用途,下一代模型可能不是 GPT-5山姆-奥特曼怒喷谷歌,GPT-4o抢了Gemini风头GPT-4o深夜炸场!AI实时视频通话丝滑如人类,Plus功能免费可用,奥特曼:《她》来了OpenAI推迟发布ChatGPT语音模式,但MAC端桌面版ChatGPT上线了第一次看见天鹅飞和应好好珍惜的中年开源视频版GPT-4o?快速记忆,实时问答,拿下CVPR'24长视频问答竞赛冠军国内住院,同病房有人说\'你叛国\'枫叶红透 第五节回国看军史, 蒋介石被斯大林泡了OpenAI 发布 GPT-4o mini,GPT-3.5 退役/曝娃哈哈总经理宗馥莉请辞/香港消委会致歉农夫山泉今日arXiv最热大模型论文:上海AI lab发布MathBench,GPT-4o的数学能力有多强?
logo
联系我们隐私协议©2024 redian.news
Redian新闻
Redian.news刊载任何文章,不代表同意其说法或描述,仅为提供更多信息,也不构成任何建议。文章信息的合法性及真实性由其作者负责,与Redian.news及其运营公司无关。欢迎投稿,如发现稿件侵权,或作者不愿在本网发表文章,请版权拥有者通知本网处理。