正文内容 评论(0

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了
2023-10-31 19:53:41  出处:量子位  作者:丰色 编辑:若风     评论(0)点击可以复制本篇文章的标题和链接

突然间,整个大模型圈都在谈论同一件事。

微软论文里一张「乍一看不足为奇」的统计图,泄露了“天机”。

引领全球风暴的ChatGPT,背后大模型参数竟只有200亿???

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

论文一经发布,就吸引了国内外众多关注。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

不少网友还不相信:确定不是拼写错了?

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

有网友表示:难怪OpenAI对开源这么紧张。又或者,这也许是为OpenAI开源做准备。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

无独有偶,就在前几天有网友在GitHub Copilot的API中发现了疑似GPT-4新型号:copilot-gpt-4-2,所拥有的知识更新到了2023年3月。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

这篇论文说了啥?

除了泄露机密,这篇论文本身也值得一看:业内首个用扩散模型做代码生成。

研究团队设想了这样一个场景:

如果开发人员只能修改最后一行代码,那么需要多少次从头开始编写一个函数才能完成呢?

用自然语言生成代码的自回归模型也有类似的局限性:不太容易重新考虑之前生成的tokens。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

微软研究员提出了采用编码-解码架构的CODEFUSION,主要包括编码器、解码器、去噪器以及Classification Head,将自然语言输入编码为连续表示,然后将其附加条件输入Diffusion模型中用高斯噪声进行迭代去噪。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

为了生成语法正确的代码,去噪后输入解码器中获得代码tokens,通过针对代码的连续段落去噪(CPD)任务预训练CODEFUSION。

在Python、Bash和Excel条件格式化(CF)规则三个语言任务上评估了CODEFUSION。

结果显示其7500万参数规模CODEFUSION性能,同200亿参数的GPT-3.5-turbo接近,而且还生成更加多样化的代码。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

与纯文本生成的diffusion模型相比,CODEFUSION生成更多语法正确的代码;与自动回归模型相比,生成更加多样化的候选代码。

与最先进的自回归系统(350M-175B 参数)相比,在前 1 名的准确率方面表现相当,而在前 3 名和前 5 名的准确率方面,由于其在多样性与质量之间取得了更好的平衡,其表现优于自回归系统。

结果这原本只是一次再正常不过的性能比较,没想到引起轩然大波。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

也有人开始了阴谋论,或许这是OpenAI开源的“前菜”,故意而为之——

因为不少大模型已经追赶上来了,而且早在今年5月,路透社就曾爆料OpenAI准备开源新大语言模型。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

One More Thing

值得一提的是,早在今年2月份福布斯一则新闻报道里,就曾透露过ChatGPT只有200亿参数。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

当时标题是「越大越好吗?为什么 ChatGPT VS GPT-3 VS GPT-4 的 “战斗 “只是一次家庭聊天?」

只是当时没有太多人在意。

ChatGPT真实参数只有200亿 首次被微软曝光!网友惊:要开源了

责任编辑:若风

  • 支持打赏
  • 支持0

  • 反对

  • 打赏

文章价值打分

当前文章打分0 分,共有0人打分
  • 分享好友:
  • |
本文收录在
#ChatGPT#AI#科技

  • 热门文章
  • 换一波

  • 好物推荐
  • 换一波

  • 关注我们

  • 微博

    微博:快科技官方

    快科技官方微博
  • 今日头条

    今日头条:快科技

    带来硬件软件、手机数码最快资讯!
  • 抖音

    抖音:kkjcn

    科技快讯、手机开箱、产品体验、应用推荐...