0

0

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发

PHPz

PHPz

发布时间:2023-09-20 13:05:09

|

1037人浏览过

|

来源于51CTO.COM

转载

发烧友们已经揭开了苹果transformer的“秘密”

在大型模型浪潮的影响下,即使是保守的苹果公司,在每次发布会上也必定会提及"Transformer"

比如,在今年的WWDC上,苹果就已宣布,船新版本的iOS和macOS将内置Transformer语言模型,以提供带文本预测功能的输入法。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发

虽然苹果官方没有透露更多信息,但技术爱好者们却迫不及待

一位名叫Jack Cook的小哥,成功地翻开了macOS Sonoma beta的新篇章,意外地发现了许多新的信息

  • 模型架构上,Cook小哥认为苹果的语言模型更像是基于GPT-2打造的。
  • 在分词器(tokenizer)方面,表情符号在其中十分突出。

更多细节,一起来看。

基于GPT-2架构

首先,让我们回顾一下苹果基于Transformer的语言模型在iPhone、MacBook等设备上能够实现的功能

需要重写的内容是:主要体现在输入法方面。在语言模型的支持下,苹果自带的输入法可以实现单词预测和纠错的功能

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发

Jack Cook小哥具体测试了一下,发现这个功能主要实现的是针对单个单词的预测。

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发
需要进行改写的内容是:△来源:Jack Cook的博客文章

模型有时也会预测即将出现的多个单词,但这仅限于句子语义十分明显的情况,比较类似于Gmail里的自动完成功能。

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发
需要进行改写的内容是:△来源:Jack Cook的博客文章

那么这个模型具体被装在了哪里?一通深入挖掘之后,Cook小哥确定:

我在 /System/Library/LinguisticData/RequiredAssets_en.bundle/AssetData/en.lm/unilm.bundle 中找到了预测文本模型。

原因是:

  1. unilm.bundle中的许多文件在macOS Ventura(13.5)里并不存在,仅出现在了新版本macOS Sonoma beta(14.0)里。
  2. unilm.bundle中存在一个sp.dat文件,这在Ventura和Sonoma beta里都能找到,但Sonoma beta的版本中更新了明显像是分词器的一组token。
  3. sp.dat中token的数量跟unilm.bundle中的两个文件——unilm_joint_cpu.espresso.shape和unilm_joint_ane.espresso.shape能匹配得上。这两个文件描述了Espresso/CoreML模型中各层的形状。

进一步推测,根据unilm_joint_cpu中描述的网络结构,小哥认为苹果模型是基于GPT-2架构构建的

造梦阁AI
造梦阁AI

AI小说推文一键成片,你的故事值得被看见

下载

主要的组成部分包括令牌嵌入、位置编码、解码器块和输出层,在每个解码器块中都会出现类似于"gpt2_transformer_layer_3d"这样的词汇

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发

需要进行改写的内容是:△来源:Jack Cook的博客文章

根据每层大小,小哥还推测苹果模型约有3400万个参数,隐藏层大小为512。换句话说,它比GPT-2最小版本还要小

小哥认为,这主要是因为苹果想要一种不太耗电,但同时能够快速、频繁运行的模型。

而苹果官方在WWDC上的说法是,“每点击一个键,iPhone就会运行模型一次”。

然而,这也意味着这个文本预测模型无法很好地续写句子或段落

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发

需要进行改写的内容是:△来源:Jack Cook的博客文章

模型架构之外,Cook小哥还挖出了分词器(tokenizer)的相关信息。

他在unilm.bundle/sp.dat里发现了一组数量为15000的token,值得关注的是,其中包含100个emoji

Cook揭秘库克

虽然这个Cook不是那个库克,但小哥的博客文章一发布,仍然吸引了很多关注

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发

基于他的发现,网友们热烈地讨论起苹果在用户体验和前沿技术应用之间的平衡大法。

iPhone中隐藏的机器人:基于GPT-2架构,带有emoji分词器,由MIT校友开发

回到Jack Cook本人,他本科和硕士毕业于MIT的计算机专业,目前还在攻读牛津大学的互联网社会科学硕士学位。

他之前曾在英伟达实习,专注于研究BERT等语言模型。他还担任《纽约时报》的自然语言处理高级研发工程师

相关专题

更多
登录token无效
登录token无效

登录token无效解决方法:1、检查token的有效期限,如果token已经过期,需要重新获取一个新的token;2、检查token的签名,如果签名不正确,需要重新获取一个新的token;3、检查密钥的正确性,如果密钥不正确,需要重新获取一个新的token;4、使用HTTPS协议传输token,建议使用HTTPS协议进行传输 ;5、使用双因素认证,双因素认证可以提高账户的安全性。

6085

2023.09.14

登录token无效怎么办
登录token无效怎么办

登录token无效的解决办法有检查Token是否过期、检查Token是否正确、检查Token是否被篡改、检查Token是否与用户匹配、清除缓存或Cookie、检查网络连接和服务器状态、重新登录或请求新的Token、联系技术支持或开发人员等。本专题为大家提供token相关的文章、下载、课程内容,供大家免费下载体验。

804

2023.09.14

token怎么获取
token怎么获取

获取token值的方法:1、小程序调用“wx.login()”获取 临时登录凭证code,并回传到开发者服务器;2、开发者服务器以code换取,用户唯一标识openid和会话密钥“session_key”。想了解更详细的内容,可以阅读本专题下面的文章。

1059

2023.12.21

token什么意思
token什么意思

token是一种用于表示用户权限、记录交易信息、支付虚拟货币的数字货币。可以用来在特定的网络上进行交易,用来购买或出售特定的虚拟货币,也可以用来支付特定的服务费用。想了解更多token什么意思的相关内容可以访问本专题下面的文章。

1222

2024.03.01

macOS怎么切换用户账户
macOS怎么切换用户账户

在 macOS 系统中,可通过多种方式切换用户账户。如点击苹果图标选择 “系统偏好设置”,打开 “用户与群组” 进行切换;或启用快速用户切换功能,通过菜单栏或控制中心的账户名称切换;还能使用快捷键 “Control+Command+Q” 锁定屏幕后切换。

331

2025.05.09

iPhone文本消息乱序错误如何解决?
iPhone文本消息乱序错误如何解决?

解决办法:1、强制关闭消息应用程序;2、重启你的iPhone;3、自动禁用设置并再次启用;4、关闭iMessage并重新打开;5、重置所有设置;6、使用ReiBoot修复iOS。本专题为大家提供相关的文章、下载、课程内容,供大家免费下载体验。

328

2024.11.19

删除iPhone上所有照片的方法
删除iPhone上所有照片的方法

删除iPhone上所有照片的方法;1、删除整个照片库;2、从相册中删除所有照片;3、仅从图库中删除照片;4、仅删除视频,屏幕截图,自拍,实时或人像照片;5、删除某人的所有照片;6、永久删除已删除的照片等等。想了解更多相关的内容,请阅读专题下面的文章。

866

2024.12.11

iPhone静音开关不起作用
iPhone静音开关不起作用

若 iPhone 静音开关失效,先检查硬件,看开关状态、清洁缝隙。接着重启手机,查看静音及勿扰模式设置,更新系统。若都不行,可恢复出厂设置(提前备份)。若仍无效,可能是严重硬件问题,需联系苹果客服或去授权维修中心。

180

2025.03.20

Golang gRPC 服务开发与Protobuf实战
Golang gRPC 服务开发与Protobuf实战

本专题系统讲解 Golang 在 gRPC 服务开发中的完整实践,涵盖 Protobuf 定义与代码生成、gRPC 服务端与客户端实现、流式 RPC(Unary/Server/Client/Bidirectional)、错误处理、拦截器、中间件以及与 HTTP/REST 的对接方案。通过实际案例,帮助学习者掌握 使用 Go 构建高性能、强类型、可扩展的 RPC 服务体系,适用于微服务与内部系统通信场景。

6

2026.01.15

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
10分钟--Midjourney创作自己的漫画
10分钟--Midjourney创作自己的漫画

共1课时 | 0.1万人学习

Midjourney 关键词系列整合
Midjourney 关键词系列整合

共13课时 | 0.9万人学习

AI绘画教程
AI绘画教程

共2课时 | 0.2万人学习

关于我们 免责申明 举报中心 意见反馈 讲师合作 广告合作 最新更新
php中文网:公益在线php培训,帮助PHP学习者快速成长!
关注服务号 技术交流群
PHP中文网订阅号
每天精选资源文章推送

Copyright 2014-2026 https://www.php.cn/ All Rights Reserved | php.cn | 湘ICP备2023035733号