> 自媒体 > (AI)人工智能 > 微软论文一张截图,曝出GPT-3
微软论文一张截图,曝出GPT-3
来源:悠闲铅笔X2O
2023-11-14 13:54:37
701
管理

最近微软的一份论文引起了广泛关注,该论文爆料了 GPT-3.5 的参数规模仅为 20B,这与之前公开宣布的 GPT-3 的 175B 相去甚远。这一消息让大家纷纷感到惊讶,ChatGPT 的性能是否能够与如此小的参数规模相匹配呢?这一发现引发了大规模的讨论和猜测,令人瞩目。

微软的这篇论文不仅带来了关于 GPT-3.5 参数规模的重大揭示,还提出了一个参数仅有 75M 的小规模模型——CodeFusion。这一模型主要用于代码生成任务,具有令人印象深刻的性能。尽管参数相对较小,CodeFusion 在 top-1 准确率方面能够与那些庞大的模型相媲美,例如 350M-175B 模型。这为小型模型的潜力提供了强有力的证据。

CodeFusion 的模型架构经过了两个关键阶段的训练:无监督预训练和有监督微调。在无监督预训练阶段,CodeFusion 利用未标记的代码片段来训练降噪器和解码器,同时使用可训练的嵌入层 L 将代码嵌入到连续空间中。在有监督微调阶段,CodeFusion 使用文本-代码对数据进行微调,调整编码器、降噪器和解码器,以提高性能。此外,CodeFusion 还借鉴了关于文本生成的研究成果,将解码器的隐藏表示 D 融入模型,以进一步改进性能。这个模型还引入了噪声,以确保生成的代码片段符合预期标准。

尽管微软的论文揭示了 GPT-3.5 的参数规模,但一些问题仍然未解。例如,GPT-4 和 GPT-3.5 之间的技术联系以及它们是专家集成模型还是通用模型的问题仍待进一步研究。此外,GPT-3.5 的参数规模是如何实现的,是通过更大模型的蒸馏还是更多数据的训练,这些问题需要进一步的开源研究才能揭开谜团。

总之,微软的论文不仅揭示了 GPT-3.5 的真实参数规模,还展示了小型模型在代码生成任务中的潜力。这一发现将进一步推动自然语言处理领域的研究和创新。

0
点赞
赏礼
赏钱
0
收藏
免责声明:本文仅代表作者个人观点,与本站无关。其原创性以及文中陈述文字和内容未经本网证实,对本文以及其中全部或者 部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。 凡本网注明 “来源:XXX(非本站)”的作品,均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对 其真实性负责。 如因作品内容、版权和其它问题需要同本网联系的,请在一周内进行,以便我们及时处理。 QQ:617470285 邮箱:617470285@qq.com
相关文章
卡罗拉:换代不是跟风,是丰田读懂中国家用车的务实转身..
大家好我是心心念念,每天给大家带来最新动态,不赶节奏,内容随缘更,但..
狂跌420亿元,丰田利润大跳水
全球第一大车企丰田,一个季度净利下滑420亿!车东西2月11日消息,日前,..
2026年日系新车盘点,丰田/日产是主力,雷克萨斯ES将换代..
新一代车型变化明显,取消了经典的纺锤体中网,造型设计与铂智7类似,更..
新车 | 新增芥末黄车色,新款丰田YARIS官图,可选四驱/1.5升混动..
文:懂车帝原创 张晓丹[懂车帝原创 产品] 2月20日,丰田汽车发布了新款YA..
丰田推新一代插混 覆盖RAV4卡罗拉 国内引入存悬念
2026年2月丰田在日本发布第六代RAV4 PHEV,同步宣布下一代卡罗拉将搭载全..
广汽丰田2026:有质量的80万,有雄心的百万
2026年,广汽丰田将年度产销目标锁定在80万台。数字之下,涌动着“重回百..
BBA率先官降,日产、丰田跟进:新一轮“价格战”在酝酿?..
都说合资品牌是1月国内车市销量榜上表现相对较好的板块,但这一点儿没妨..
伏尔加品牌携手长安汽车重启,首款SUV预告图曝光
【网通社快报】沉寂十余年的苏联经典汽车品牌伏尔加(Volga)正借力中国..
50万以上价格车型销量排行,自主品牌强势挑战德系三强..
作为汽车市场的品牌号召力表现和“价值高地”,50万以上这一价位段的竞争..
关于作者
杨子(普通会员)
文章
2020
关注
0
粉丝
0
点击领取今天的签到奖励!
签到排行

成员 网址收录40418 企业收录2986 印章生成263660 电子证书1157 电子名片68 自媒体105416

0
0
分享
请选择要切换的马甲:

个人中心

每日签到

我的消息

内容搜索