首页时尚玩车保健情感

更多

腕表饮食视频美女百科

0

老男人 > 科技 > 正文

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

2023-09-18 21:06:48 发布人：hao333 阅读( 5287)

苹果Transformer的“秘密”，让发烧友给扒出来了。大模型浪潮下，即使保守如苹果，也每逢发布会必提“Transformer”。比如，在今年的WWDC上，苹...

苹果Transformer的“秘密”，让发烧友给扒出来了。

大模型浪潮下，即使保守如苹果，也每逢发布会必提“Transformer”。

比如，在今年的WWDC上，苹果就已宣布，船新版本的iOS和macOS将内置Transformer语言模型，以提供带文本预测功能的输入法。

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

苹果官方没有透露更多信息，但技术爱好者们可坐不住了。

一位名叫Jack Cook的小哥，就把macOS Sonoma beta翻了个底朝天，结果，还真挖出不少新鲜信息：

-模型架构上，Cook小哥认为苹果的语言模型更像是基于GPT-2打造的。

-在分词器方面，表情符号在其中十分突出。

更多细节，一起来看。

基于GPT-2架构

先来回顾一下苹果基于Transformer的语言模型能在iPhone、MacBook等设备上实现怎样的功能。

主要体现在输入法方面。语言模型加持下的苹果自带输入法，可以实现单词预测和纠错的功能。

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

Jack Cook小哥具体测试了一下，发现这个功能主要实现的是针对单个单词的预测。

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

图源：Jack Cook博客文章

模型有时也会预测即将出现的多个单词，但这仅限于句子语义十分明显的情况，比较类似于Gmail里的自动完成功能。

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

图源：Jack Cook博客文章

那么这个模型具体被装在了哪里？一通深入挖掘之后，Cook小哥确定：

原因是：

1、unilm.bundle中的许多文件在macOS Ventura里并不存在，仅出现在了新版本macOS Sonoma beta里。

2、unilm.bundle中存在一个sp.dat文件，这在Ventura和Sonoma beta里都能找到，但Sonoma beta的版本中更新了明显像是分词器的一组token。

3、sp.dat中token的数量跟unilm.bundle中的两个文件——unilm_joint_cpu.espresso.shape和unilm_joint_ane.espresso.shape能匹配得上。这两个文件描述了Espresso/CoreML模型中各层的形状。

进而，小哥根据unilm_joint_cpu中描述的网络结构，推测苹果模型是基于GPT-2架构打造的：

主要包含token embeddings、位置编码、解码器块和输出层，每个解码器块中都有类似gpt2_transformer_layer_3d这样的字眼。

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

图源：Jack Cook博客文章

根据每层大小，小哥还推测，苹果模型约有3400万参数，隐藏层大小是512。也就是说，它比GPT-2最小的版本还要小。

小哥认为，这主要是因为苹果想要一种不太耗电，但同时能够快速、频繁运行的模型。

而苹果官方在WWDC上的说法是，“每点击一个键，iPhone就会运行模型一次”。

不过，这也就意味着，这个文本预测模型并不能很好地完整续写句子或段落。

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

图源：Jack Cook博客文章

模型架构之外，Cook小哥还挖出了分词器的相关信息。

他在unilm.bundle/sp.dat里发现了一组数量为15000的token，值得关注的是，其中包含100个emoji。

Cook揭秘库克

尽管此Cook非彼库克，小哥的博客文章一发出，还是吸引了不少关注。

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

基于他的发现，网友们热烈地讨论起苹果在用户体验和前沿技术应用之间的平衡大法。

揭秘iPhone里的Transformer，基于GPT-2架构，分词器含emoji，MIT校友出品

回到Jack Cook本人，他本科和硕士毕业于MIT的计算机专业，目前还在攻读牛津大学的互联网社会科学硕士学位。

此前，他曾在英伟达实习，专注于BERT等语言模型的研究。他还是《纽约时报》的自然语言处理高级研发工程师。

那么，他的这一番揭秘是否也引发了你的一些思考？欢迎在评论区分享观点~

上一篇：极兔疾行之后

相关阅读

RelatedReading

今年首个高温黄色预警！省钱换空调等家电家居产品就来京东618
索尼电视怎么安装第三方应用？超简单教程小白一看就会
三星、LG将展示FC-BGA最新封装技术
特斯拉Cyberquad玩具车在中国市场一度挤爆官网，加价销售引争议
美国科技大佬齐聚国会闭门商讨AI，“对文明的未来非常重要”
CKE中国婴童用品展快讯：2023德国红点奖今年都有哪些好设计？

猜你喜欢

Guessyoulike

中华企业拟定增募资不超过45亿元股价跌1.82%

中华企业拟定增募资不超过45亿元股价跌1.82%

hao333 8841次阅读2023-06-05 16:06

汇富纳米业绩飙升负债率55%偿债能力偏弱三度分红

汇富纳米业绩飙升负债率55%偿债能力偏弱三度分红

hao333 4505次阅读2023-03-30 08:57

太平岁有余庆终身寿险10年后在那里取钱(太平岁有余庆终身寿险保十年后能取出吗)

太平岁有余庆终身寿险10年后在那里取钱(太平岁有余庆终身寿险保十年后能取出吗)

hao333 7049次阅读2023-05-28 22:03

搭载巨湾技研XFC电池合创V09刷新纯电MPV充电新速度

搭载巨湾技研XFC电池合创V09刷新纯电MPV充电新速度

hao333 4157次阅读2023-07-29 11:16

专题页

HOT榜单

华泰柏瑞基金副总经理董元星离任
致远互联涨6.73% 三个交易日机构净买入1.42亿元
知名火锅品牌向顾客赔钱：凭支付记录领1000元，总计835.4万元
德施曼智能锁“虹膜识别”技术，开启一场家门口的技术革命！
"离婚式减持"新规定后首例！国光股份董事长离婚对半分割股份

锂电池板块跌0.69% 退市未来涨10.77%居首
2-3不敌泰国女排，女排亚锦赛中国队摘得银牌
绿盟科技拟定增募资不超12亿元股价跌0.7%
理想汽车L系列突破20万辆交付量持续领跑新势力
泰安银行济南分行被罚150万存涉规向建筑企业放贷等

换一组看看

频道最IN

>世界首富阿尔诺同款、泰格豪雅究竟有什么魅力？

世界首富阿尔诺同款、泰格豪雅究竟有什么魅力？

>百度2023 Q1财报公布,小度业务增长强劲,多项服务稳居市场第一

百度2023 Q1财报公布,小度业务增长强劲,多项服务稳居市场第一

>小刀电动车航天动力系怎么样？航天科技加持，加速4秒1，爬坡如平地

小刀电动车航天动力系怎么样？航天科技加持，加速4秒1，爬坡如平地

关于我们法律声明联系我们广告服务隐私条款

@老男人网版权所有/信息产业部备案号：蜀ICP备13015099号-1