编辑:金磊 梦晨
转自:量子位 | 公众号 QbitAI

一觉醒来,万众期待的GPT-4,它来了!

OpenAI老板Sam Altman直接开门见山地介绍说:

这是我们迄今为止功能最强大的模型!

c5c412688446da76a6d69afa0eadb235.png

有多强?

根据OpenAI官方的介绍,GPT-4是一个超大的多模态模型,也就是说,它的输入可以是文字(上限2.5万字),还可以是图像。

(看图)手套掉下去会怎样?

它会掉到木板上,并且球会被弹飞。

9e2b1d95bdd57f7e26151e232f48915a.gif

甚至只需要简单在纸上画一个网站的草稿图:

f2680c25a1211c9325e9308e9a6aa129.gif

拍一张照片上传给GPT-4,它就可以立马生成网站的HTML代码!

f5d83f3f00dc8ad00ec564184c5faa74.gif

在性能表现上,OpenAI直接甩出一句话:

在各种专业和学术基准上和人类相当

而且不只是发布GPT-4这么简单,OpenAI这次“啪的一下”把相关“大动作”一步到位了:

  • ChatGPT Plus:集成GPT-4的ChatGPT升级版

  • 发布GPT-4的API

  • 公布技术论文 * 公开System Card

不仅如此,传闻的“必应早就用上了GPT-4”在今天也得到了微软方面的证实:

没错,确实是这样的!

0bfd74ab146c7c27121dbcd7e1dc1d27.png

不得不说,自打ChatGPT问世以来,微软和谷歌之间打响的数轮科技战役,微软这次又双叒叕赢麻了。

甚至这一次,不少网友都发出了“见证历史”的感慨:

3512c068242c6883f61323a6b90881f3.png

史上最强大模型

正如之前传言,GPT-4确实拥有多模态能力,可以接受图像输入并理解图像内容。

并且可接受的文字输入长度也增加到3.2万个token(约2.4万单词)。

升级之后,GPT-4在各种职业和学术考试上表现和人类水平相当。

比如模拟律师考试,GPT-4取得了前10%的好成绩,相比之下GPT-3.5是倒数10%。

做美国高考SAT试题,GPT-4也在阅读写作中拿下710分高分、数学700分(满分800)。

372e8fd4b736fa5daa242ddc3720df44.png

那么GPT-4这些新能力实际用起来是什么样的?技术报告中也给出不少展示。

首先,看图能力可以用来解释表情包、梗图。

提问这张图哪里好笑?GPT-4可以按顺序描述出每一格的内容,并总结出笑点:

用巨大的过时VGA接口给小巧的现代智能手机充电。

3804941c1d6e782e19d26c1e02aef92c.png

更进一步,GPT-4可以理解图表中数据的含义,并做进一步计算。

4f97d59fc3d15e6a4c7759f173e3230f.png

甚至可以直接把论文截图发给它,GPT-4可以按像素处理其中的文字和图片,并给出对整篇论文的总结摘要。

4c2da5f1862ff421ef68d5a459683b92.png

文字输入长度限制的增加,也大大扩展了GPT-4的实用性。

发布会直播上,OpenAI总裁Gregman现场表演了一波GPT-4给代码修Bug。

出现问题啥也不用想,直接把1万字的程序文档一股脑扔给GPT-4就行。格式也不用管,你只需要Ctrl+A、Ctrl+C、Ctrl+V。

998983ba5bc901b70f04ca731a6edfc1.gif

再最后附上出现的问题,在几秒钟内瞬间得到解决办法。

adff4dd9deb389f83234121260d3cc93.png

在API方面,GPT-4还开放了一个使用功能,允许修改“系统提示”。

之前ChatGPT的回答总是冗长而平淡,这是因为系统提示中规定了“你只是一个语言模型……你的知识截止于2021年9月”。

现在通过修改这句话,GPT-4就可以展现出更多样的性格,比如扮演苏格拉底。

4ceb88292ee2aed0c7c33f55fec6f14c.png

也可以指定之后所有回答的形式,比如全用json格式。

87e3bceb90c7b918881d0dda30368040.png

虽然GPT-4这波能力大升级,但之前ChatGPT会出现幻觉、胡说八道的毛病还是没能完全改掉。

从前面的官方示例也可以看出,要想最大程度发挥GPT-4的能力,最好还是用上思维链路提示(Chain-of-thought Prompt)。

操作起来也非常简单,只需在提问的时候额外提醒AI给出步骤,就能大大提高推理和计算的准确率。

谷歌依旧在跟

就在GPT-4发布前,谷歌方面为了迎战微软,宣布将一系列即将推出的AIGC功能,应用到自家产品中。

包括谷歌 Docs(文档)、Gmail、Sheets(表格)和 Slides(幻灯片)。

5be43408bfe1cc915ec1a7065461105a.png

但不同于微软和OpenAI的“发布即可用”,谷歌只会先将Docs和Gmail中的AI工具,在月底提供给一些“值得信赖的开发人员”。

而其它功能则将是在今年晚些时候向公众开放。

至于具体时间,谷歌方面并没有具体说明。

而外界对此评价是谷歌希望抢先微软原定于本周四的发布。

但从今天的结果上来看,微软依旧提前“抢滩登陆”。

6de4f2c7a7b7adbd6ffb677c0643cac0.png

One More Thing

在GPT-4发布之前,便有网友做出了GPT-3和GPT-4参数量的对比图,并猜测GPT-4的参数量将达到100万亿。

这一次亦是如此。

有网友预言,未来GPT-5的参数量,会是这样的:

44c4577e2f0611512fffabb7c250d56b.png

但无论如何,这一次,我们离真·人工智能,更近了一步。

参考链接:

[1] https://openai.com/research/gpt-4
[2] https://blogs.bing.com/search/march_2023/Confirmed-the-new-Bing-runs-on-OpenAI%E2%80%99s-GPT-4
[3] https://www.youtube.com/watch?v=outcGtbnMuQ

------

我们创建了一个高质量的技术交流群,与优秀的人在一起,自己也会优秀起来,赶紧点击加群,享受一起成长的快乐。另外,如果你最近想跳槽的话,年前我花了2周时间收集了一波大厂面经,节后准备跳槽的可以点击这里领取

推荐阅读

··································

你好,我是程序猿DD,10年开发老司机、阿里云MVP、腾讯云TVP、出过书创过业、国企4年互联网6年。从普通开发到架构师、再到合伙人。一路过来,给我最深的感受就是一定要不断学习并关注前沿。只要你能坚持下来,多思考、少抱怨、勤动手,就很容易实现弯道超车!所以,不要问我现在干什么是否来得及。如果你看好一个事情,一定是坚持了才能看到希望,而不是看到希望才去坚持。相信我,只要坚持下来,你一定比现在更好!如果你还没什么方向,可以先关注我,这里会经常分享一些前沿资讯,帮你积累弯道超车的资本。

点击领取2023最新10000T学习资料

Logo

开放原子开发者工作坊旨在鼓励更多人参与开源活动,与志同道合的开发者们相互交流开发经验、分享开发心得、获取前沿技术趋势。工作坊有多种形式的开发者活动,如meetup、训练营等,主打技术交流,干货满满,真诚地邀请各位开发者共同参与!

更多推荐