没有大家期待的GPT5,没有大家期待的AI搜索引擎。
但是,GPT-4o来啦!
今天凌晨,OpenAI春季发布会开了,带来了新的震撼:GPT-4o。
什么是GPT-4o?
之前的AI大模型,通常会分为文本大模型、图像大模型等,每次用户根据自己的需求使用不同的大模型。而这次,OpenAI将文本、语音、图像之间无缝对接,揉在一起,真正实现多态合一,不用用户再麻烦做出选择,根据实际场景,在文本、语音、图像之间自由切换,非常方便和人性化!
GPT-4o给我们带来了三大震撼,下边我给大家简要讲下。
一是语音功能带来的震撼。
我们都用过语音助手,比如苹果下的Siri,每次需要时,我们“Hey Siri”,接下来说出我们要它做的指令,但这有两个毛病,一是每次跟它说话,它都要等待几秒才能回答,二是当它开始说话时,你没法打断它,否则又得重新跟它讲一遍,二GPT-4o不仅可以随时随地打断它,它都能记住你之前说的话,另外,它的反应跟正常人差不多,几乎感受不到它的延迟性。
语音最重要的一个改进,就是GPT-4o竟然可以通过我们的声音,识别我们的情绪如开心,生气,愤怒等,而且,它竟然还可以根据我们的情绪,改变它自己说话的语气!
纳尼?AI要逆天了???下次再不开心,跟它聊天,让它安慰你!
第二个震撼,就是GPT-4o带来了同声翻译。
相比之前的翻译,这次的同声翻译,简直达到了翻译界的天花板。就想你请了个翻译高手,她就坐你身边,随时帮你翻译全世界50种不同语言。
这真是,有了GPT-4o,走遍天下都不发愁了!
第三个震撼,就是GPT-4o的视觉增强。
GPT-4o可以通过摄像头,识别场景,通过识别之后,可以帮你做现场做题;通过GPT-4o的电脑桌面应用屏幕直接读代码,修改完善。。。
以后出门,碰到不认识的花花草草动物世界,随时问GPT-4o。:)
最最最重要的是,GPT-4o现在竟然可以免费直接用了!!!
欢迎关注我的微信视频号【大伟说AI】
总结一句话,GPT-4o 做到了不是人适应工具,而是真正让工具适应人。