题图:Cheva用new bing AI生成
这段时间,AI行业真的是持续爆发,新产品层出不穷。虽然最强的GPT-4被说得神乎其神,但是因为要花钱升级到Plus才能用,所以只在poe.com和forefront.ai这两个提供免费试用次数的网站上试过。其实对日常生活来说,Chat GPT-3.5已经足够用了。我有一个自己邮箱注册的Chat GPT账号,加上网上各种免费接口也多如牛毛,比如上面提到的poe.com网站,电报上的zahai机器人。
如果就功能和便利性来说,还是做了很多年互联网产品的微软,更懂消费者。从功能上来说,微软的新必应应该是所有的智能聊天AI中体验最好的。国内的那些追赶产品,比如百度的文心一言,我申请试用快一个多月了,也没有通过。还有国内比较早进行AI研究的讯飞(之前这家的语音识别和文字转语音方面的AI很不错。用了很多年他们的听书软件),前几天也推出了自己的大模型,据说申请通过率很高,昨天也去申请试用了,再等两天看能不能用上。其实如果会翻墙的话,新必应加chart gpt已经足够好用了,而且新必应背后也是用的gpt4的模型,还是很强大的。比如你故意故意绕晕它,问:“鲁迅和周树人吵架了,怎么办?”它会告诉你,这不可能,鲁迅和周树人是同一个人。而chat gpt3.5,则会写一堆不知所云的文字出来。
相比于这些商业公司搞出来的大模型,我现在对那些开源的语言模型倒是更感兴趣,因为这些大公司为了迎合企业管理层的价值观,或者避免法律纠纷,往往会给自家的模型施加各种各样的限制,就像之前有人用chat gpt做实验,让它写一首赞美川普的诗,他就会以政治中立为由拒绝,但是如果让他写一篇赞美拜登的诗,它就可以写出很肉麻的诗句。而开源模型则没有这方面的问题了,它更像是真正的知识,可以随意的复制和分发,人们也可以根据自己的需要进行修改。所以它生成的内容就会没有审查,应该来说这是对言论自由最大的保障,也是充分发挥AI能力的保证。在这些开源的模型里面,绝大多数都是基于facebook,现在叫meta泄露出来的一个语言模型—llama。。因为这个模型名字的缩写发音,很像英语单词“羊驼”,也就是中文互联网上人尽皆知的——草泥马,所以基于llama模型训练出来的各种开源模型,也都非常知趣地给自己起名为不同种类的羊驼,比如斯坦福大学发布的Alpaca,还有最近比较引人关注,回复质量,达到了Chat GPT 90%的Vicuna,这些英文都是不同种类羊驼的名字。今天看到一个比较搞笑的是,国内的团队,也是在llama模型的基础上,用中文的医学资料训练了一个,可以回答医学问题的模型,起的名字叫做华佗。简直可以说是双关梗的天花板了,既保持了llama模型的衍生模型都叫什么什么驼的特点,而华驼又是中国古代的名医,和医学问答模型的用途完全切合。
这些开源的大语言模型还有一个特点,就是他们的参数量都在70亿上下,也就是说这些模型的模型文件占用存储空间,也就在5到8G左右,这让这些开源大模型,在个人电脑上运行起来成为了可能,当然这个个人电脑也不是所有的电脑,还是需要配置比较高的,特别是对显卡的要求还是很高的,需要15G以上的显存。但是这比据说有上千亿参数的GPT-3.5甚至规模更大的GPT-4,只能在专门的昂贵的专用服务器上运行,已经要强出不少。当然如果你不想自己折腾,或者没有配置足够好的PC机,也可以去这个网站——chat.llmsys.org,上面有很多这些驼类大模型,我试了一下,这些模型对话能力,确实和Chat GPT非常接近,但是解决问题的推理能力,和提供信息的能力还是要差一些。似乎这类模型,大家的主要用途,是在调教它们来玩角色扮演游戏。
不管怎样这些技术的开源化,避免让AI这门技术被掌握在少数大公司的手里,让他们更容易为普通人所利用,这才是科学技术的最根本的好处,就连谷歌都承认,最大的威胁不是来自微软或者OpenAI,而是来自开源的技术。