正确的提示信息

扫码打开虎嗅APP

从思考到创造
打开APP
搜索历史
删除
完成
全部删除
热搜词
2024-05-24 20:49

桌面版ChatGPT亮相“欧洲AI春晚”,有多惊艳?

本文来自微信公众号:量子位(ID:QbitAI),作者:克雷西,原文标题:《桌面版ChatGPT登台演讲,能视频通话还会实时读屏,GPT-4o最新demo再次惊艳:“能力还是被低估了”》,题图来自:视觉中国

文章摘要
ChatGPT桌面版在“欧洲AI春晚”上展示了惊人的实时读屏和视频通话功能。

• 💬 ChatGPT能够实时读取屏幕内容和剪贴板,帮助进行代码debug。

• 🖼️ ChatGPT可通过摄像头感知环境,立即识别巴黎地标和设计乘车路线。

• 👏 演示中ChatGPT的语音功能和潜力令现场观众叹为观止。

GPT-4o桌面端最新Demo,与Sora的新作品一同亮相“欧洲AI春晚”VivaTech。


现场,OpenAI工作人员不仅展示了观众期待已久的“视频通话”,还试着让ChatGPT发表了演讲。




在视频聊天当中,即使给它的只有一幅抽象的简笔画,它也能立马get到这是巴黎地标。



然后再给它看一眼地铁图,指一指当前位置,就能火速设计出乘车路线。



而且,除了能像移动端一样通过摄像头感知环境之外,桌面端的ChatGPT还能够对屏幕内容进行读取,结合代码现场debug。



一系列震撼的演示效果,让身在前线的Tom’s Guide编辑Ryan Morrison感叹,GPT的语音功能和GPT-4o的潜力,看来是被低估了。



桌面端“视频通话”震撼全场


在现场给400多名观众演示ChatGPT最新功能的,是OpenAI开发者体验主管Romain Huet。


本来Huet打算用手机来演示,结果受到现场技术条件限制无法展示,于是改用Mac,但也正是如此,观众们才有机会看到它的屏幕读取能力。


一开始,Huet问ChatGPT能不能给现场的观众讲一点什么,然后ChatGPT真就像模像样地打起了招呼。


不过Huet觉得这样的开场白还不够有气势,于是提示它面前是一大群人,它马上就心领神会,改用了更“燃”的措辞和语气。




当然,Huet没有让ChatGPT一直讲下去,而是在做完开场白之后改由自己来介绍其最新功能。


所有对话,即使跨越语言也能快速响应,现场Huet就要求ChatGPT把自己说的英文翻译成法语,整个过程行云流水。


另外,看上去是bug,但也许是feature的一点是,翻译出的法语还带着一些美国口音,不过Huet表示之后会进行优化,让ChatGPT说外(非英)语时更像当地人。




又是一通补充讲解之后,人们期待的“视频通话”功能终于正式登场了。


只见Huet现场用笔画出了埃菲尔铁塔和凯旋门的草图,结果ChatGPT只看了一眼就直接识破。


Huet自己也打趣地对它说:“非常感谢你,我画得这么烂你都能看懂。”




这还没完,Huet紧接着又掏出了一张巴黎地铁图,用手指了指当前的大概位置。


然后,ChatGPT立刻就给出了前往埃菲尔铁塔的乘车路线,随着Huet的一句Thank You,现场爆发了潮水般的掌声。




当然,最新的ChatGPT不仅能拿来读取摄像头画面,也能实时读取屏幕和剪贴板当中的内容。


作为OpenAI负责开发者体验的主管,Huet和ChatGPT一起现场搞起了代码。


Huet通过复制到剪贴板的方式,让客户端读取了一段React框架编写的网页代码,结果ChatGPT立马就把代码的语言、功能介绍得头头是道。


甚至还当众进行了Debug,通过让ChatGPT读取屏幕,Huet告诉它目前这个网页存在不能根据屏幕宽度进行适配的问题。


通过几轮对话,Huet成功借助ChatGPT的帮助,完美解决了这个问题,再次收获了观众的掌声。




One More Thing


在现场,Huet还播放了一段用Sora为大会创作的新视频,由于现场生成时间较长,观众看到的视频是预先制作好的,这也是活动中唯一一个提前做好的效果。




一同展示的还有声音克隆引擎Voice Engine,Huet录制了一段20秒的声音样本,并用Voice Engine进行了完美复刻,而且只需一个按钮,就能从英语切换到法语、日语等其他语言,并在Sora中应用。


不过由于安全问题仍未解决,Sora和Voice Engine依旧不能公开发布,想体验的朋友要再等一等了。


另外,说到克隆声音的问题,寡姐和OpenAI关于Sky的争议刚好也有了新消息。


华盛顿邮报称,根据其获得的文件和录音显示,给Sky配音的女演员的确另有其人。而且,寡姐所称的受到奥特曼邀请发生在去年9月,而配音演员的招募在5月就已开始。



不过,仍然有网友认为,就算真的是另找了一名演员,也不能说明OpenAI就没有模仿寡姐的意图。


但无论OpenAI的意图如何,真正给Sky配音的演员却是无辜的,也有表演的权利。


不少网友发声对她表示同情:


Sky的配音演员同样有权利使用她自己的声音,难道因为(寡姐)是名人,所拥有的知识产权就比普通人更多吗?


进一步地,我认为虽然“OpenAI侵犯了寡姐的‘公开权’”这个观点比单纯的侵犯知识产权的想法好些,但仍然站不住脚。



总之,寡姐抛向OpenAI的子弹仍未落地,我们不妨一边吃瓜,一边等待着GPT-4o视频对话的正式更新。


参考链接:

[1]https://vimeo.com/949419199

[2]https://www.tomsguide.com/ai/chatgpt/i-finally-saw-a-live-demo-of-chatgpt-4o-voice-if-anything-it-is-underhyped

[3]https://www.washingtonpost.com/technology/2024/05/22/openai-scarlett-johansson-chatgpt-ai-voice/


本文来自微信公众号:量子位(ID:QbitAI),作者:克雷西

本内容为作者独立观点,不代表虎嗅立场。未经允许不得转载,授权事宜请联系 hezuo@huxiu.com
如对本稿件有异议或投诉,请联系tougao@huxiu.com
打开虎嗅APP,查看全文
频道:

支持一下

赞赏

0人已赞赏

大 家 都 在 看

大 家 都 在 搜

好的内容,值得赞赏

您的赞赏金额会直接进入作者的虎嗅账号

    自定义
    支付: